教程中心
AI Agent 从入门到实战:概念理解、MCP 使用、平台实操、工作流自动化
246
教程总数
44
入门教程
20
实操教程
按主题浏览
LLM API 成本控制实战:把 AI 账单从 $500 降到 $80 的 12 个方法
生产环境 LLM 成本优化全攻略,每个技巧都有实测数据
LLM 成本优化实战指南:12 个可操作方法把 AI 账单降下来。覆盖模型分层路由、Prompt 压缩、语义缓存、Batch API、上下文裁剪、tokenizer 计费原理与监控归因,每个方法附真实代码与落地细节。
Dify vs 扣子(Coze) vs FastGPT:2026年AI应用构建平台终极对比
三大中文AI应用平台深度评测,帮你选出最适合的工具
Dify vs 扣子(Coze) vs FastGPT 终极对比(2026):企业私有化选 Dify、国内渠道分发选扣子、中文知识库问答选 FastGPT。含 Docker 部署实操、API 调用示例、四大场景选型与常见坑。
Kimi K2 完整使用指南 2026:长上下文 + 深度研究的正确打开方式
全面掌握 Kimi 的核心优势和使用技巧
Kimi K2 使用指南(2026):助手端三大场景(超长文档分析提问法/深度研究框架化提问/中文写作)+ 开发者端(OpenAI 兼容 API、开源权重部署门槛、与 ChatGPT/Claude 的分工路由表)。含长上下文注意力稀释等避坑。
GitHub Copilot 进阶技巧 2026:90% 的人没用过的 8 个高效功能
从自动补全到 Copilot Workspace,解锁 GitHub Copilot 的全部潜力
GitHub Copilot 进阶 8 技(2026):内联 Chat 斜杠命令、仓库级 copilot-instructions.md(影响最大的杠杆)、#file/@workspace 上下文变量、Edits 多文件编辑、Agent 模式验收标准前置、补全隐藏操作、代码评审、CLI。
Replit Agent 完整教程 2026:AI 帮你写代码、运行、部署一条龙
从提示词到上线应用,Replit Agent 全流程实战
Replit Agent 完整教程(2026):真实 Linux 环境里的对话式全栈助手——从一句话需求到公网 URL。含验收标准前置提示词、Agent vs Assistant 成本分工、Secrets/Checkpoint 工程习惯、与 Bolt/Cursor 的赛道划分。
Stable Diffusion 3.5 本地部署完整指南:免费生成无限图片
从安装到出图,ComfyUI + SD3.5 全流程教程
SD 3.5 本地部署指南(2026):硬件表(Medium 8GB 显存可跑)、ComfyUI 安装、模型与文本编码器放置(漏装 t5 是第一报错)、参数要点(CFG 4-6)、LoRA/ControlNet/批量 API 进阶路线、常见报错速查。
LlamaIndex 实战指南:RAG 应用开发从入门到生产
LlamaIndex vs LangChain 怎么选?5个真实场景代码示例
LlamaIndex 专为 RAG 应用而生,是构建企业知识库问答系统的首选框架。本文覆盖核心架构、与 LangChain 的关键区别,以及从文档加载到生产部署的 5 个完整代码示例。
Dify 企业私有知识库完全搭建指南:RAG 配置与最佳实践(2026)
从部署到调优,手把手搭建企业级 RAG 知识库问答系统
详细讲解用 Dify 搭建企业私有知识库的完整流程:Docker 私有化部署、文档预处理策略、分块参数调优、嵌入模型选择、混合检索配置,以及解决「答非所问」「遗漏关键信息」等常见问题的实用技巧。
Voice Activity Detection (VAD):用 Python 检测「有没有人在说话」
语音应用的第一道关卡,做好它能省一大半识别成本
Voice Activity Detection(VAD)判断音频中哪段是人声,是语音应用省成本的第一关。本文用 Python 实战 webrtcvad 与 Silero VAD:硬约束、原理对比、Whisper 串联与实时流式。
LLM Fallback 降级策略:模型挂了,你的应用还能活吗
生产级 LLM 应用必须有 Plan B——超时、限流、宕机时怎么优雅降级
生产级 LLM 应用的 llm fallback 实战:重试、熔断、多提供商降级、缓存兜底四层防线。讲清指数退避加 jitter、超时预算分配、大模型降级小模型的质量权衡,以及级联超时、重试风暴等真实工程坑。
AI 编程实战:从 Claude Code 到自进化工作流,重塑软件工程
掌握四种循环模式,设计可验证的自动化开发流水线
AI 编程正从「写提示词」转向「设计循环」。本文基于 Claude Code 官方定义,深度拆解回合制、目标、定时、主动四种循环模式,结合 Bun 16.5 万美元 Rust 迁移案例和 /checkup 自愈机制,讲解如何构建可验证工作流、控制 Token 消耗、保障代码质量。适合中高级开发者掌握 AI 工程化核心技能。
大模型推理加速实战:Prefill/Decode 优化、投机解码与国产芯片适配
从底层原理到前沿方案,系统降低大模型部署成本
本文从大模型推理的底层原理出发,深入剖析 Prefill 与 Decode 两阶段的计算与带宽瓶颈,系统介绍 KV 缓存优化、量化压缩等经典手段。重点解读投机解码技术的最新进展,包括动态推测解码、冻结多 Token 预测 (MTP) 以及 Domino 等创新方案,并探讨国产芯片适配与 Token 优化工厂等降本路径。最后提供 FAQ 解答常见问题,帮助开发者全面掌握推理加速与部署优化的核心方法。
Agent 数据架构新范式:Skill + 语义层 + 知识库,让企业 Agent 真正落地
从数据架构角度出发,结合 Skill、语义层和知识库,解决 Agent 落地中的指标口径、实时数据和权限等卡点。
企业 Agent 从 Demo 到生产,数据架构是关键瓶颈。本文深入剖析 Agent 数据架构新范式,围绕 Skill、语义层和知识库三大支柱,解决指标口径不一致、实时数据接入难、权限控制复杂等核心问题。结合腾讯、Datastrato、OceanBase 等实践,提供从元数据治理到语义层建设的完整方法论,并探讨 Apache Ossie 等开放标准。适合正在构建企业级 Agent 的数据工程师和架构师。
AI编程智能体深度实战:从Claude Code到Codex的工程化之路
对比主流AI编程工具,剖析架构、Harness、循环工程与企业落地经验
本文深入对比了Claude Code、Codex、Cursor等主流AI编程智能体的技术架构、Harness设计、循环工程模式及企业落地经验。文章从安全后门事件切入,分析了Claude Code的隐写术争议、Bun的Rust迁移案例,并详细拆解了控制理论驱动的编码循环、验证系统设计、成本控制等工程化实践。最后提供了国产模型替代方案与团队角色重塑建议,帮助开发者在AI编程时代构建可靠、可控的自动化工作流。
Agent Harness 工程完全指南:从模型到可落地智能体的关键基础设施
系统拆解 Harness 的概念、架构、与模型的关系,以及如何通过 Harness 实现 Agent 的自进化与可控执行
Agent Harness 是包裹在大语言模型之外的完整软件基础设施,它决定了模型如何思考、规划、调用工具、管理上下文、存储记忆以及评估结果。本文从 Harness 的基本概念出发,系统拆解其核心设计模式、12个生产级组件、三层工程层级,并深入探讨 Harness 如何通过上下文工程、工作流设计、自我改进循环和进化搜索实现 AI 的递归自我改进。同时,本文还讨论了本体驱动的可控执行、Token 成本优化、以及 Harness 工程面临的真实挑战与未来方向,帮助开发者构建真正可落地的智能体系统。
用自然语言查世界杯数据:Text-to-SQL 实战(2026)
「哪些球队控球率超 60% 却输了球」——把这句话变成 SQL 自动查出来,背后的工程怎么做
世界杯数据多到查不过来。这篇带你用 Text-to-SQL 把自然语言问题自动翻译成 SQL 查询,搭一个能用大白话问的赛事数据助手,重点讲清 Schema 设计、防止查错、以及 SQL 注入安全这几个生产必须解决的问题。
大模型后训练实战:从 SFT 到 RL 的完整技术栈
系统讲解后训练中的关键方法(SFT、RLHF、OPD、PEFT),并给出评估通用能力损失的量化方法
本文系统讲解大模型后训练的关键技术,包括监督微调(SFT)、参数高效微调(PEFT)、基于人类反馈的强化学习(RLHF)以及在线策略蒸馏(OPD)。重点分析各方法的原理、优劣及适用场景,并引入稳定性-可塑性权衡框架来量化微调带来的通用能力损失。通过对比全量微调、LoRA、OFT等PEFT方法的遗忘特性,揭示激活空间几何结构破坏是遗忘的关键机制。最后总结OPD作为新范式的优势,并提供落地指南和常见问题解答。
LlamaIndex vs LangChain:到底该用哪个搭 RAG(2026 实战对比)
两个都用过半年后,我把选型逻辑讲清楚:什么项目用 LlamaIndex,什么项目用 LangChain
都说 LlamaIndex 专注检索、LangChain 偏向编排,但落到具体项目还是会纠结。这篇按"你要做什么"来分,配真实代码和踩过的坑,帮你 10 分钟内做出选型决定。
通义千问 API 开发者指南 2026:性价比最高的国产 LLM 集成方案
从 API 接入到生产部署,Qwen 全流程开发教程
阿里云通义千问(Qwen)系列在性价比和多语言能力上领先国产模型,Qwen2.5 已被全球开发者广泛使用。本文从 API Key 获取到生产级应用构建,详细讲解 Qwen API 的开发最佳实践。
豆包高级使用指南 2026:字节跳动 AI 助手的隐藏能力全解析
从聊天到工作流,豆包不只是 AI 对话工具
豆包是字节跳动推出的 AI 助手,月活已超过 5000 万。大多数用户只用了基础对话功能,本文深入讲解豆包的 AI 插件系统、智能体创建、与飞书的集成,以及豆包 API 的开发接入方法。