LLM 大模型实战教程与资源
大模型工程实战:成本优化、Fallback 降级、推理部署、幻觉治理等生产级主题教程合集,帮你把 LLM 应用从 Demo 打磨到可上线。
LLM 大模型实战教程与资源
大模型工程实战:成本优化、Fallback 降级、推理部署、幻觉治理等生产级主题教程合集,帮你把 LLM 应用从 Demo 打磨到可上线。
24 篇教程 · 0 个 MCP Server · 0 个 Agent
相关教程
2026-2027 年最抢手的 10 项 AI 技能
基于 50000 个职位招聘分析——薪资最高的技能
进阶Gemini 2.5 Pro(2026-01):新特性与使用指南
最新 Gemini 2.5 Pro 能力完整指南:200 万上下文、原生工具使用、深度思考模式
高级Claude 扩展思考 vs OpenAI o3 vs Gemini 2.5 Pro:推理型 AI 对比(2026)
扩展思考模型横向评测:何时使用推理型 AI,哪家更强
进阶OpenAI API vs Anthropic API vs Gemini API:2026年开发者对比
面向开发者的LLM API对比:定价、速率限制、SDK及生产模式
高级LlamaIndex 教程 2026:构建生产级 RAG 应用
通过 LlamaIndex 摄取管道和查询引擎将 LLM 连接到您的文档
进阶Claude Opus 4 API 教程 2026:高级推理与长上下文
使用 Claude Opus 4 构建处理复杂推理任务的高级 AI 应用
入门Perplexity AI API 指南 2026:为 AI 应用提供实时网络搜索
使用 Perplexity 搜索 API 为 AI 应用注入实时网络知识
进阶LangChain vs LlamaIndex 2026:构建RAG应用该选哪个框架?
LangChain与LlamaIndex构建检索增强生成应用的诚实技术对比,含基准测试、用例及迁移指南
进阶Dify 工作流平台:教程与最佳实践
使用 Dify 构建生产级 AI——开源 LLM 工作流平台
进阶vLLM 高吞吐量服务:教程与最佳实践
使用 vLLM 构建生产级 AI——PagedAttention 实现 GPU 推理
进阶元认知提示:2026年完整指南与示例
掌握元认知提示,获得更优AI输出
高级Hugging Face SFT Trainer:实战教程
使用 Hugging Face TRL SFTTrainer 进行监督微调——逐步实现指南
进阶LLM API 成本控制实战:把 AI 账单从 $500 降到 $80 的 12 个方法
生产环境 LLM 成本优化全攻略,每个技巧都有实测数据
高级LLM 微调实战:LoRA、QLoRA 与 RLHF(2025版)
使用参数高效微调技术,将基础模型高效适配到你的领域
进阶LLM Fallback 降级策略:模型挂了,你的应用还能活吗
生产级 LLM 应用必须有 Plan B——超时、限流、宕机时怎么优雅降级
进阶LangSmith LLM 评估:构建系统化反馈循环
追踪收集、评估数据集、A/B 测试与回归检测
高级RLHF vs DPO:基于人类反馈训练LLM——2025技术指南
从人类反馈的强化学习、直接偏好优化及其替代方案
高级LLM 推理优化:vLLM、TensorRT-LLM 与规模化服务(2026)
PagedAttention、连续批处理、量化及生产级服务策略
入门Ollama vs vLLM:本地大模型部署该选谁?(2026)
Ollama 与 vLLM 本地大模型部署深度对比
进阶通义千问 API 开发者指南 2026:性价比最高的国产 LLM 集成方案
从 API 接入到生产部署,Qwen 全流程开发教程
高级减少LLM幻觉:面向生产应用的实用技术
解决已部署AI系统中最持久的可靠性问题的工程方案
入门LiteLLM 完整教程 2026:如何用一个 API 调用 100 多个 LLM 提供商
使用 LiteLLM 构建 AI 驱动 API 工作流的分步指南
高级LLM应用架构模式:从简单到复杂系统
简单链、RAG、智能体与多智能体模式及决策框架
高级在 vLLM Production Serving 上部署 Llama 3.1 70B — 高吞吐量服务
在 vLLM Production Serving 上本地运行 Llama 3.1 70B 的完整设置指南,实现高吞吐量服务