教程中心
AI Agent 从入门到实战:概念理解、MCP 使用、平台实操、工作流自动化
246
教程总数
44
入门教程
20
实操教程
按主题浏览
高级其他
扩散模型详解:从DDPM到Stable Diffusion与FLUX
去噪扩散、潜空间与条件机制的技术解析
一份关于扩散模型(2026年)的详细技术解析:涵盖DDPM前向/反向过程的数学原理、UNet噪声预测、潜扩散(Stable Diffusion的64倍效率技巧)、CFG引导公式,以及基于DiT和整流流的SD3/FLUX。包含理论到工具的对比表格。
diffusion-modelsStable-Diffusion
12分钟高级其他
RLHF vs DPO:基于人类反馈训练LLM——2025技术指南
从人类反馈的强化学习、直接偏好优化及其替代方案
偏好学习对齐指南(2026):将基础模型转变为有用、无害、诚实的助手。RLHF(SFT + 奖励模型 + PPO)复杂但强大;DPO使用单一偏好损失,跳过奖励模型和强化学习,更简单稳定。包含对比表格及IPO/KTO等变体。
RLHFDPO
11分钟高级其他
AI驱动的先进时间序列预测:N-BEATS、PatchTST与基础模型
从经典ARIMA到神经网络与基础模型方法的生产级预测
进阶时间序列预测:经典(ARIMA/Prophet)到深度(N-BEATS/N-HiTS/TFT)到时序基础模型(TimeGPT/Chronos/Moirai),方法选型、指标与回测。
time-seriesforecasting
35分钟高级其他
机器人基础模型:RT-2、OpenVLA 与 Physical Intelligence
视觉-语言-动作模型如何实现通用机器人控制
机器人基础模型与 VLA(视觉-语言-动作):核心概念、代表性公开研究(RT-2、Open X-Embodiment、π0 等)、数据与泛化挑战。
robotics-AIfoundation-models
32分钟高级其他
AI模型融合:SLERP、TIES、DARE与模型汤技术
无需额外训练,组合多个微调模型以创建更优模型
模型合并把多个微调模型融合成一个,无需重训。基于 mergekit:linear/SLERP/TIES/DARE/task-arithmetic 等方法原理、真实 YAML 配置与适用场景。
model-mergingSLERP
28分钟