EN
返回资讯列表
模型

世界模型进展:多家机构发布新成果,从生成到行动加速落地

2026年WAIC期间及前后,多家机构密集发布世界模型相关成果,涵盖基座模型、具身智能、数字内容、产业应用等方向,标志着世界模型从学术概念加速走向产业落地。

昆仑万维:全模态模型矩阵,提出“世界模型元年”

昆仑万维在WAIC上集中发布横跨物理世界、基座层、数字内容层的全模态模型矩阵。CEO方汉提出2026年是“世界模型元年”。

  • Riemann-1.0:具身动作模型,采用“世界动作模型”路线,将机器人动作生成与环境预测纳入统一框架。在LIBERO基准上成功率达99.0%,RoboCasa-365达62.6%,RoboTwin2.0达94.3%。加入人类第一视角数据预训练后,长程已见场景成功率提升28.15%,未见场景提升16.97%。
  • Matrix-Game 3.5:实时交互世界模型,支持持续交互与长期空间记忆,可生成结构自洽的开放世界。
  • Mureka V9.5与O3:将认知与推理能力落地音乐创作。

极佳视界:通用世界模型产品矩阵,覆盖内容创作到具身智能

极佳视界在WAIC展出“世界模型-具身基模-原生本体-泛化场景”四位一体体系:

  • 世界生成模型:一粟YiSu(内容创作)、DriveDreamer(自动驾驶仿真)、GigaWorld(具身智能训练与验证)。
  • 世界行动模型:GigaBrain(通用具身大脑)、GigaWorld-Policy(直接输出动作)。
  • 本体产品:拾光S1(家庭场景)、Maker H01(智能制造),展示长时程真实世界操作。

杨立昆团队:AdaJEPA——测试时自适应世界模型

杨立昆团队提出AdaJEPA,首次在MPC规划闭环内实现JEPA世界模型的测试时自适应。核心创新:

  • 利用自身交互产生的状态转移做自监督微调,无需外部标注。
  • 每轮重规划仅单次梯度更新,仅微调编码器与预测器少量顶层,单轮增加0.01~0.03秒延迟。
  • 在PushT、PointMaze基准上,分布外任务规划成功率大幅提升,训练数据稀缺时提升最显著。

灵博世界2.0:开源无限交互世界模型

LingBot-World-Infinity(14B主模型+1.3B蒸馏模型)实现四大创新:

  • MoBA混合注意力+流匹配预训练:连续稳定生成1小时无画质衰减。
  • 一致性蒸馏+分布匹配蒸馏:支持720P/60fps实时交互。
  • 多粒度分层数据引擎:融合实拍、游戏合成、网络视频,分段时序标注。
  • 导演-领航双智能体调度:支持近战、施法、天气切换等多元交互及多人联机。

达摩院:RynnWorld-Teleop与RynnWorld-4D

阿里巴巴达摩院发布两项工作:

  • RynnWorld-Teleop:数字遥操作方案,用生成式世界模型替代真实机器人。操作员手势驱动实时视频生成,自动获得关节级动作标签。真机实验实现零样本Sim2Real迁移,合成数据叠加真实数据可稳定提升成功率。代码与模型已开源。
  • RynnWorld-4D:四维具身世界模型,采用RGB+深度+光流(RGB-DF)表征,同步生成未来RGB视频、深度图与光流。构建2.544亿帧Rynn4DDataset 1.0。配套策略头RynnWorld-4D-Policy实现9Hz等效闭环控制,在双臂灵巧操作任务上取得SOTA。

中数睿智:因果世界模型落地35家央国企

中数睿智发布“AI for Reasoning”因果智能体系及《因果世界模型技术体系蓝皮书》。核心特点:

  • 基于“元因果”概念,动态构建因果图,支持干预与反事实推演。
  • 在油气钻井井控场景,将预警窗口提前约15-20分钟,根因定位准确率约94%,过滤40%以上无效误报。
  • 已应用于35家以上大型央国企,覆盖800余个场景,累计安全运行超15000小时。
2026年7月19日来源:综合整理