模型
世界模型进展:多家机构发布新成果,从生成到行动加速落地
2026年WAIC期间及前后,多家机构密集发布世界模型相关成果,涵盖基座模型、具身智能、数字内容、产业应用等方向,标志着世界模型从学术概念加速走向产业落地。
昆仑万维:全模态模型矩阵,提出“世界模型元年”
昆仑万维在WAIC上集中发布横跨物理世界、基座层、数字内容层的全模态模型矩阵。CEO方汉提出2026年是“世界模型元年”。
- Riemann-1.0:具身动作模型,采用“世界动作模型”路线,将机器人动作生成与环境预测纳入统一框架。在LIBERO基准上成功率达99.0%,RoboCasa-365达62.6%,RoboTwin2.0达94.3%。加入人类第一视角数据预训练后,长程已见场景成功率提升28.15%,未见场景提升16.97%。
- Matrix-Game 3.5:实时交互世界模型,支持持续交互与长期空间记忆,可生成结构自洽的开放世界。
- Mureka V9.5与O3:将认知与推理能力落地音乐创作。
极佳视界:通用世界模型产品矩阵,覆盖内容创作到具身智能
极佳视界在WAIC展出“世界模型-具身基模-原生本体-泛化场景”四位一体体系:
- 世界生成模型:一粟YiSu(内容创作)、DriveDreamer(自动驾驶仿真)、GigaWorld(具身智能训练与验证)。
- 世界行动模型:GigaBrain(通用具身大脑)、GigaWorld-Policy(直接输出动作)。
- 本体产品:拾光S1(家庭场景)、Maker H01(智能制造),展示长时程真实世界操作。
杨立昆团队:AdaJEPA——测试时自适应世界模型
杨立昆团队提出AdaJEPA,首次在MPC规划闭环内实现JEPA世界模型的测试时自适应。核心创新:
- 利用自身交互产生的状态转移做自监督微调,无需外部标注。
- 每轮重规划仅单次梯度更新,仅微调编码器与预测器少量顶层,单轮增加0.01~0.03秒延迟。
- 在PushT、PointMaze基准上,分布外任务规划成功率大幅提升,训练数据稀缺时提升最显著。
灵博世界2.0:开源无限交互世界模型
LingBot-World-Infinity(14B主模型+1.3B蒸馏模型)实现四大创新:
- MoBA混合注意力+流匹配预训练:连续稳定生成1小时无画质衰减。
- 一致性蒸馏+分布匹配蒸馏:支持720P/60fps实时交互。
- 多粒度分层数据引擎:融合实拍、游戏合成、网络视频,分段时序标注。
- 导演-领航双智能体调度:支持近战、施法、天气切换等多元交互及多人联机。
达摩院:RynnWorld-Teleop与RynnWorld-4D
阿里巴巴达摩院发布两项工作:
- RynnWorld-Teleop:数字遥操作方案,用生成式世界模型替代真实机器人。操作员手势驱动实时视频生成,自动获得关节级动作标签。真机实验实现零样本Sim2Real迁移,合成数据叠加真实数据可稳定提升成功率。代码与模型已开源。
- RynnWorld-4D:四维具身世界模型,采用RGB+深度+光流(RGB-DF)表征,同步生成未来RGB视频、深度图与光流。构建2.544亿帧Rynn4DDataset 1.0。配套策略头RynnWorld-4D-Policy实现9Hz等效闭环控制,在双臂灵巧操作任务上取得SOTA。
中数睿智:因果世界模型落地35家央国企
中数睿智发布“AI for Reasoning”因果智能体系及《因果世界模型技术体系蓝皮书》。核心特点:
- 基于“元因果”概念,动态构建因果图,支持干预与反事实推演。
- 在油气钻井井控场景,将预警窗口提前约15-20分钟,根因定位准确率约94%,过滤40%以上无效误报。
- 已应用于35家以上大型央国企,覆盖800余个场景,累计安全运行超15000小时。
2026年7月19日来源:综合整理
相关资讯
全球首个隐空间世界模型MWA发布,登顶具身智能权威榜单
6月29日 · 综合整理
蚂蚁灵波开源LingBot-VLA 2.0与LingBot-Vision:跨20种机器人本体的VLA大脑与空间原生视觉基模
7月8日 · 综合整理
无界动力发布全球首个长时序双向物理因果链隐空间世界模型MWA
7月2日 · 综合整理
前阿里千问负责人林俊旸创立AI实验室,首轮估值20亿美元,腾讯红杉高榕入局
6月16日 · 综合整理
物理AI:机器人公司竞相构建具身智能
5月23日 · TechCrunch
WAIC 现场:6 台机器人 15 小时自主拼装 8 万块积木长城,具身大模型 DM0.5 成幕后核心
7月17日 · 综合整理