模型
商汤连发两款多模态基座模型,推动视觉AI从“搭积木”走向原生统一
在2026年世界人工智能大会(WAIC)前后,商汤科技连续发布两款多模态基座模型:面向长程任务的交付级智能体基座日日新SenseNova U1 Pro,以及开源视觉大模型SenseNova-Vision。前者基于NEO-unify原生统一架构,实现理解、生成与行动的统一,支持8K原生超清输出、图文交错思维和长程Agentic闭环,可完成从信息搜集到视觉交付的全链路任务;后者将目标检测、分割、深度估计等经典视觉任务统一表述为多模态生成问题,摒弃传统任务专用头,在共享表征空间内端到端建模,并在结构化理解上刷新SOTA,同时接近顶尖专家模型性能。两款模型分别从上层视觉创作交付和底层物理世界感知两个维度,指向商汤构建“全感知-全生成”统一多模态基座的长期目标。
2026年7月21日来源:综合整理
相关资讯
DeepSeek识图功能全量上线:能批改作业但认错自家创始人
6月18日 · 综合整理
蚂蚁灵波发布空间原生视觉基模LingBot-Vision,以边界建模提升机器人空间感知
7月7日 · 综合整理
蚂蚁灵波开源LingBot-VLA 2.0与LingBot-Vision:跨20种机器人本体的VLA大脑与空间原生视觉基模
7月8日 · 综合整理
谷歌发布Nano Banana 2 Lite与Gemini Omni Flash:4秒出图、10秒成片,轻量创作模型组合上线
7月1日 · 综合整理
智源悟界·RoboBrain Orca:从预测下一个词到预测世界状态,探索多模态世界模型
7月8日 · 综合整理
商汤开源视觉大统一模型SenseNova-Vision,单模型覆盖四大视觉任务
7月14日 · 综合整理