教程中心
AI Agent 从入门到实战:概念理解、MCP 使用、平台实操、工作流自动化
246
教程总数
44
入门教程
20
实操教程
按主题浏览
高级概念理解
AI 模型评测与安全红宝书:基准、越狱与对齐实践
从 GeneBench-Pro 到 CJS 框架,系统梳理模型评测基准、安全攻击与对齐技术的全景与深度实践
本文系统介绍 AI 模型评测与安全领域的核心议题,涵盖三大支柱:评测基准(GeneBench-Pro、EnterpriseClawBench、LiveClawBench 等)、安全攻击(prompt injection、越狱、搜索内容操纵、压缩攻击、多智能体异常检测)及对齐技术(有益特质强化学习、自适应多准则激活引导)。通过分析最新研究成果与真实案例,揭示当前模型在科研推理、企业任务、运维场景中的能力边界与脆弱性,并提供可操作的评测方法论与防御策略,帮助开发者和研究者构建更安全、更可靠的 AI 系统。
evaluationbenchmark
30分钟高级概念理解
世界模型与具身智能:从预测到动作的统一框架
梳理世界模型(WAM、WVM、LoopWM)与具身智能(VLA、Skill)的最新进展,以及如何评估和落地
本文系统梳理世界模型与具身智能的最新进展,从概念辨析、技术路线到评估体系,构建从预测到动作的统一框架。内容涵盖世界动作模型(WAM)、世界价值模型(WVM)、循环世界模型(LoopWM)等前沿架构,以及VLA、具身技能等具身智能方向。深入探讨了世界模型的评估阶梯(L0-L7)、具身原生的预训练范式、Real2Sim数据生成、闭环数据采集等关键议题,并分析了当前面临的开放挑战与未来趋势。
world-modelembodied-ai
30分钟