EN

教程中心

AI Agent 从入门到实战:概念理解、MCP 使用、平台实操、工作流自动化

246

教程总数

44

入门教程

20

实操教程

高级其他

扩散模型详解:从DDPM到Stable Diffusion与FLUX

去噪扩散、潜空间与条件机制的技术解析

一份关于扩散模型(2026年)的详细技术解析:涵盖DDPM前向/反向过程的数学原理、UNet噪声预测、潜扩散(Stable Diffusion的64倍效率技巧)、CFG引导公式,以及基于DiT和整流流的SD3/FLUX。包含理论到工具的对比表格。

diffusion-modelsStable-Diffusion
12分钟
高级其他

RLHF vs DPO:基于人类反馈训练LLM——2025技术指南

从人类反馈的强化学习、直接偏好优化及其替代方案

偏好学习对齐指南(2026):将基础模型转变为有用、无害、诚实的助手。RLHF(SFT + 奖励模型 + PPO)复杂但强大;DPO使用单一偏好损失,跳过奖励模型和强化学习,更简单稳定。包含对比表格及IPO/KTO等变体。

RLHFDPO
11分钟
高级其他

AI驱动的先进时间序列预测:N-BEATS、PatchTST与基础模型

从经典ARIMA到神经网络与基础模型方法的生产级预测

进阶时间序列预测:经典(ARIMA/Prophet)到深度(N-BEATS/N-HiTS/TFT)到时序基础模型(TimeGPT/Chronos/Moirai),方法选型、指标与回测。

time-seriesforecasting
35分钟
高级其他

机器人基础模型:RT-2、OpenVLA 与 Physical Intelligence

视觉-语言-动作模型如何实现通用机器人控制

机器人基础模型与 VLA(视觉-语言-动作):核心概念、代表性公开研究(RT-2、Open X-Embodiment、π0 等)、数据与泛化挑战。

robotics-AIfoundation-models
32分钟
高级其他

AI模型融合:SLERP、TIES、DARE与模型汤技术

无需额外训练,组合多个微调模型以创建更优模型

模型合并把多个微调模型融合成一个,无需重训。基于 mergekit:linear/SLERP/TIES/DARE/task-arithmetic 等方法原理、真实 YAML 配置与适用场景。

model-mergingSLERP
28分钟