EN

LLM 大模型实战教程与资源

大模型工程实战:成本优化、Fallback 降级、推理部署、幻觉治理等生产级主题教程合集,帮你把 LLM 应用从 Demo 打磨到可上线。

全部标签

LLM 大模型实战教程与资源

大模型工程实战:成本优化、Fallback 降级、推理部署、幻觉治理等生产级主题教程合集,帮你把 LLM 应用从 Demo 打磨到可上线。

24 篇教程 · 0 个 MCP Server · 0 个 Agent

相关教程

入门

2026-2027 年最抢手的 10 项 AI 技能

基于 50000 个职位招聘分析——薪资最高的技能

进阶

Gemini 2.5 Pro(2026-01):新特性与使用指南

最新 Gemini 2.5 Pro 能力完整指南:200 万上下文、原生工具使用、深度思考模式

高级

Claude 扩展思考 vs OpenAI o3 vs Gemini 2.5 Pro:推理型 AI 对比(2026)

扩展思考模型横向评测:何时使用推理型 AI,哪家更强

进阶

OpenAI API vs Anthropic API vs Gemini API:2026年开发者对比

面向开发者的LLM API对比:定价、速率限制、SDK及生产模式

高级

LlamaIndex 教程 2026:构建生产级 RAG 应用

通过 LlamaIndex 摄取管道和查询引擎将 LLM 连接到您的文档

进阶

Claude Opus 4 API 教程 2026:高级推理与长上下文

使用 Claude Opus 4 构建处理复杂推理任务的高级 AI 应用

入门

Perplexity AI API 指南 2026:为 AI 应用提供实时网络搜索

使用 Perplexity 搜索 API 为 AI 应用注入实时网络知识

进阶

LangChain vs LlamaIndex 2026:构建RAG应用该选哪个框架?

LangChain与LlamaIndex构建检索增强生成应用的诚实技术对比,含基准测试、用例及迁移指南

进阶

Dify 工作流平台:教程与最佳实践

使用 Dify 构建生产级 AI——开源 LLM 工作流平台

进阶

vLLM 高吞吐量服务:教程与最佳实践

使用 vLLM 构建生产级 AI——PagedAttention 实现 GPU 推理

进阶

元认知提示:2026年完整指南与示例

掌握元认知提示,获得更优AI输出

高级

Hugging Face SFT Trainer:实战教程

使用 Hugging Face TRL SFTTrainer 进行监督微调——逐步实现指南

进阶

LLM API 成本控制实战:把 AI 账单从 $500 降到 $80 的 12 个方法

生产环境 LLM 成本优化全攻略,每个技巧都有实测数据

高级

LLM 微调实战:LoRA、QLoRA 与 RLHF(2025版)

使用参数高效微调技术,将基础模型高效适配到你的领域

进阶

LLM Fallback 降级策略:模型挂了,你的应用还能活吗

生产级 LLM 应用必须有 Plan B——超时、限流、宕机时怎么优雅降级

进阶

LangSmith LLM 评估:构建系统化反馈循环

追踪收集、评估数据集、A/B 测试与回归检测

高级

RLHF vs DPO:基于人类反馈训练LLM——2025技术指南

从人类反馈的强化学习、直接偏好优化及其替代方案

高级

LLM 推理优化:vLLM、TensorRT-LLM 与规模化服务(2026)

PagedAttention、连续批处理、量化及生产级服务策略

入门

Ollama vs vLLM:本地大模型部署该选谁?(2026)

Ollama 与 vLLM 本地大模型部署深度对比

进阶

通义千问 API 开发者指南 2026:性价比最高的国产 LLM 集成方案

从 API 接入到生产部署,Qwen 全流程开发教程

高级

减少LLM幻觉:面向生产应用的实用技术

解决已部署AI系统中最持久的可靠性问题的工程方案

入门

LiteLLM 完整教程 2026:如何用一个 API 调用 100 多个 LLM 提供商

使用 LiteLLM 构建 AI 驱动 API 工作流的分步指南

高级

LLM应用架构模式:从简单到复杂系统

简单链、RAG、智能体与多智能体模式及决策框架

高级

在 vLLM Production Serving 上部署 Llama 3.1 70B — 高吞吐量服务

在 vLLM Production Serving 上本地运行 Llama 3.1 70B 的完整设置指南,实现高吞吐量服务