EN
返回资讯列表
模型

商汤连发两款多模态基座模型,推动视觉AI从“搭积木”走向原生统一

在2026年世界人工智能大会(WAIC)前后,商汤科技连续发布两款多模态基座模型:面向长程任务的交付级智能体基座日日新SenseNova U1 Pro,以及开源视觉大模型SenseNova-Vision。前者基于NEO-unify原生统一架构,实现理解、生成与行动的统一,支持8K原生超清输出、图文交错思维和长程Agentic闭环,可完成从信息搜集到视觉交付的全链路任务;后者将目标检测、分割、深度估计等经典视觉任务统一表述为多模态生成问题,摒弃传统任务专用头,在共享表征空间内端到端建模,并在结构化理解上刷新SOTA,同时接近顶尖专家模型性能。两款模型分别从上层视觉创作交付和底层物理世界感知两个维度,指向商汤构建“全感知-全生成”统一多模态基座的长期目标。

2026年7月21日来源:综合整理