EN

AI Agent News

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

AI Agent 动态

最新行业资讯

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

重大事件时间线

2026-01

OpenClaw GitHub 爆发

OpenClaw 10 天冲上 GitHub 全球 Top 10,超越 Linux 内核 Star 增速

2025-12

Meta 20亿收购 Manus

Meta 以 20 亿美元收购 Manus AI,通用 Agent 赛道正式被巨头锁定

2025-04

DeepSeek-V3 开源

性价比之王,成本仅 GPT-4 的 5%

2025-03

Manus 一夜爆火

全球首款通用 AI Agent 在国内社交平台引发空前关注

2025-02

OpenAI Deep Research

OpenAI 推出深度研究 Agent,一键生成专业研究报告

2025-02

MCP Server 破 500

MCP 生态爆发,3 个月构建 500+ Server

2025-01

DeepSeek-R1 震惊全球

开源推理模型,成本仅 OpenAI 的 3%,引发全球 AI 格局震动

2024-11

MCP 协议诞生

Anthropic 发布 Model Context Protocol,成为 Agent 接口事实标准

2024-10

Claude Computer Use

Anthropic 让 AI 首次直接操控电脑屏幕,开创计算机使用新范式

2024-09

Replit Agent 全栈自动化

自然语言到上线产品,面向非工程师

2024-08

Cursor ARR 破亿

史上增长最快 SaaS,AI 编程工具新王者

2024-06

Claude 3.5 登顶 SWE-bench

最强编程 AI,Bug 修复能力达到初级工程师水平

2024-03

Devin 发布

全球首个自主 AI 软件工程师,能独立完成完整编程任务

行业2026年7月21日

Hugging Face 遭遇自主 AI Agent 攻击,防御过程暴露闭源模型安全护栏问题

2026 年 7 月 16 日,全球最大 AI 模型托管平台 Hugging Face 发布安全事件披露,称其部分生产基础设施在上周遭遇了一次完全由自主 AI Agent 驱动的网络攻击。攻击流程几乎没有人工参与,官方记录到的相关事件超过 17,000 条,被认为是目前最典型的自主 AI 网络攻击。 ## 攻击过程:AI Agent 自主完成全链条入侵 攻击始于一份恶意数据集。该数据集被上传至平台后,利用数据处理流水线中的两个代码执行漏洞——远程代码数据集加载器和数据集配置模板注入——在节点上执行代码。攻击者随后提权至节点级别,窃取云端和集群凭证,并横向移动到多个内部集群。整个过程中,攻击系统调动大量短期存在的沙箱环境,控制端分散在公共服务上,失效后可迁移至新环境继续运行。Hugging Face 尚未公布攻击者身份及使用的具体 Agent 框架或模型,但确认攻击具有高度自主性。 ## 防御过程:AI 辅助检测,但闭源模型拒绝分析攻击日志 Hugging Face 首先通过 AI 辅助的异常检测发现可疑信号,随后安全团队运行分析 Agent 处理 17,000 多条事件记录,将原本需要数天的工作压缩至数小时。然而,在分析阶段,Hugging Face 尝试使用美国主流商业 API 的闭源模型时,所有模型均拒绝处理——因为 Prompt 中包含恶意指令和攻击日志,模型无法区分这是安全调查还是真实攻击。最终,Hugging Face 改用部署在自家基础设施上的中国开源模型 GLM 5.2 完成分析,该模型无安全护栏限制,且所有数据均未离开本地环境。 ## 影响与启示:AI 攻防不对称性凸显 Hugging Face 确认,目前没有证据显示公开模型、数据集、Spaces 或容器镜像被篡改,但部分内部数据集和服务凭证已遭访问,对合作伙伴及客户的影响仍在评估。此次事件揭示了 AI 攻防中的不对称问题:攻击者可以使用不受限制的模型(如被越狱的托管模型或开放权重模型),而防守方却可能被商业闭源模型的安全护栏阻碍。Hugging Face 联合创始人兼 CEO Clément Delangue 强调,禁止开源 AI 对防守者的伤害将远大于攻击者。平台建议安全团队提前准备可在内部基础设施运行的模型,以应对类似事件。

综合整理
行业2026年7月21日

2026 IMO中国队全员金牌,邓乐言等三人满分,GPT-5.6 Pro首次尝试解出全部六题

第67届国际数学奥林匹克竞赛(IMO 2026)于7月13日至21日在上海中学举行,中国队以全员金牌、团体总分232分的成绩卫冕世界第一,领先第二名美国队25分。其中邓乐言、刘澈、张柏伦三人获得满分42分,邓乐言成为继罗炜、付云皓、韦东奕、史皓嘉后第五位达成中国队IMO双满分的选手。美国队以207分获亚军,俄罗斯队以196分获季军。 ## 中国队表现与选手背景 - 中国队6名选手全部摘金,总分232分,金牌线29分、银牌线23分、铜牌线16分。 - 邓乐言(上海中学,高二)连续两年满分,是国内唯一同时达成连续CMO满分+IMO满分的选手。 - 刘澈(华东师范大学第二附属中学,高二)曾获罗马尼亚大师杯全球第一,连续两届CMO金牌。 - 张柏伦(上海中学,高一)首次参赛即满分,此前CMO排名垫底压线进入集训队后逆袭。 - 其他选手:彭振乾(人大附中,38分)、彭宇轩(武钢三中,36分)、杨宸(湖北省武昌实验中学,32分)。 - 上海中学累计斩获20枚IMO金牌,2022年以来连续4年有学生夺金。 ## AI参与竞赛:GPT-5.6 Pro与小红书大模型 - 据报道,GPT-5.6 Pro在无人协助的首次尝试中解出本届IMO全部六道题,SignalPilot Labs独立评估称其生成了完整解答。OpenAI为所有金牌得主提供12个月ChatGPT Pro订阅。 - 小红书大模型dots-note-3.0经IMO官方评定,六题全部答对,以满分获金牌,成为中国首个获IMO官方金牌认证的大模型。其第三题解法被双CMO金牌得主刘涵祚评价为“正确且漂亮的证明思路”,CMO金牌得主汪千桐称其“简洁优雅、直击本质”。模型使用自然语言端到端推理,结合Python代码执行与递归自我批判能力。 ## 赛事背景与历史数据 - 本届IMO由上海中学承办,是首次在中学举行的IMO,也是中国第二次主场作战。共有119个国家685名选手参赛,为历届最多。 - 中国队自1986年参赛以来,累计获得197金、37银、6铜,第26次团体第一。 - 本届金牌线29分,较2025年的35分下降6分,显示题目难度提升。全球满分选手共7人,包括1位英国、1位韩国和2位美国选手。 - 美国队4名华裔选手中的Alexander Wang连续四年入选国家队并获金牌,2024年曾带队终结中国队五连冠。

综合整理
行业2026年7月20日

WAIC 2026观察:国产算力从单卡竞争走向系统效率之争

2026年世界人工智能大会(WAIC)于7月17日至20日在上海举行,国产算力成为焦点。多家厂商展示了超节点、异构混合推理、全栈互联等系统级解决方案,标志着国产AI基础设施竞争从单芯片参数转向系统效率与生态协同。 ## 超节点成主流形态,系统级协同成关键 华为、中兴通讯、百度智能云、燧原科技、沐曦等厂商纷纷展出超节点产品。中兴通讯的OEX正交架构超节点单柜可集成128个GPU,通过0线缆正交设计降低互联成本,并联合壁仞、沐曦等推出Matrix超节点方案,获WAIC SAIL之星。百度智能云天池超节点强调全栈创新,依托昆仑芯、百舸平台和文心大模型形成真实负载驱动的反馈链,天池256吞吐性能提升25%,推理效率提升50%。奇异摩尔推出国产化超节点互联全栈方案,覆盖Scale-Out、Scale-Up及光互联,并与壁仞科技联合展示国产GPU直通国产RDMA网卡的IBGDA方案,实测小消息吞吐显著提升、延迟接近翻倍降低。 ## 异构混合推理破解国产芯片短板 商汤大装置提出异构混合推理方案,将Prefill和Decode阶段分离,用高端芯片支撑Decode瓶颈,国产芯片承担Prefill,一块高端芯片可带动约30块国产芯片。该方案使国产芯片MFU提升85%-152%,单位成本Token产出提升2.5倍。商汤大装置已适配20余款国产芯片,其中六七款实现稳定商业化盈利,国产芯片业务毛利率转正,预计7月末日均Token处理量达2.42万亿。 ## 效率优化成为新赛道 是石科技发布国产Token优化工厂“拓元”,兼容10余种国产芯片,通过KV Cache压缩、全模态Token压缩、长上下文优化等技术,实现每日千亿Token吞吐。清微智能以可重构计算架构提升晶体管利用率至70%以上,并推出4K超节点方案,互联成本较国外降低约90%。中兴通讯推出800V高压直流供电方案,供电效率提升至98%,配合液冷散热实现PUE低至1.15。 ## 生态建设加速,软件栈成迁移关键 多家厂商强调软件生态的重要性。清微智能的RAISA软件栈已支持近千个算子、适配超200个模型;智源FlagOS 2.0支持18家厂商32款芯片。商汤联合近20家生态伙伴发起国产AI基础设施生态共建计划,计划建设5个万卡级国产智算集群。百度昆仑芯在中国移动AI通用计算设备集采中三个标包均获第一份额,中标规模达十亿元级别。 ## 市场展望 华泰证券预测2026年为国产超节点放量元年,2028年市场空间有望达3414亿元。随着智能体应用爆发,算力需求同比增长5-10倍,但供给端增长有限,供需失衡窗口期为国产算力厂商提供了发展机遇。

综合整理
行业2026年7月20日

AI手机生态博弈:阶跃推原生终端,豆包转向MCP合作

2025年7月,AI手机赛道迎来关键进展。阶跃星辰在WAIC上发布全球首款大模型原生AI终端STEPX Neo及智能体操作系统Step AOS,主打“结果交互”和系统级智能体;字节跳动旗下豆包手机则调整策略,放弃GUI模拟点击,转向MCP服务接口合作,备货量从3万台提升至数十万台。两路线折射出AI手机行业的核心矛盾:模型能力与用户体感脱节,以及应用厂商、操作系统、手机厂商之间的权力博弈。 ## 阶跃星辰:从模型到终端的“模软硬”闭环 7月13日,阶跃星辰在WAIC上发布STEPX品牌、Step AOS操作系统及个人智能体Amoo。STEPX Neo获得《人工智能终端智能化分级》国家标准L3级认证(当前最高级别),并入选WAIC十大“镇馆之宝”。 - **交互范式转变**:从“过程交互”转向“结果交互”。用户只需说出意图(如“找充电桩并点杯喝的”),智能体直接调用支付宝等生态伙伴的MCP服务,而非模拟点击。 - **系统级资源重组**:Step AOS统一调度CPU/GPU/NPU算力,端云协同;语义数据层将感知信息转化为可理解上下文;原子能力引擎将应用功能拆解为可编排单元。 - **记忆与决策**:双域三步记忆结构(用户域+智能体域),在PersonaMem等评测中表现领先。端侧模型Step Edge支持百毫秒级工具调用,简单任务成功率超99%。 阶跃强调“为智能体盖一座房子”,而非在旧系统上开一扇门。其生态伙伴包括携程、支付宝、滴滴、美团等。 ## 豆包手机:从GUI模拟到MCP服务调用 据《晚点LatePost》独家消息,新一代豆包手机调整合作方式:不再读取屏幕、模拟点击(GUI技术),而是要求应用厂商自行提供MCP服务,开放数据与操控接口。备货量从3万台提升至数十万台,显示商业化加速。 - **背景**:2025年12月豆包手机助手技术预览版发布后,微信、淘宝、支付宝等因风控和入口主权顾虑封禁其AI功能。豆包随即下线相关场景。 - **新策略**:与阿里、腾讯等谈判开放接口。7月15日,豆包手机助手软件获生成式人工智能服务备案,为拓展厂商合作预留空间。 - **行业对比**:荣耀与微信合作中,手机助手仅负责指令传递,微信自行完成操作;苹果在WWDC放弃读屏功能,改用App Intents;Google Pixel对少数应用支持读屏控制。 ## 行业博弈:技术之外的权利关系 AI手机的核心挑战并非技术,而是各方权力分配: - **应用厂商**:担忧AI绕过接口冲击风控和入口主权,纷纷自建Agent(如阿里千问接入生态、微信灰度“小微”)。 - **手机厂商**:OPPO、vivo、荣耀等升级系统级智能体,但控制超级应用合作时更谨慎。 - **模型公司**:阶跃选择自建系统与终端,豆包转向合作,两条路线均需平衡生态控制力与开放度。 当前,AI手机仍处于早期探索阶段。阶跃的“原生”路线追求深度整合,但需说服用户接受新系统;豆包的“合作”路线依赖应用开放,但可能受制于巨头博弈。最终,谁能定义AI手机的游戏规则,取决于生态构建能力与用户实际体验。

综合整理
行业2026年7月20日

AI安全与对齐研究新进展:智能体系统风险、自主攻击事件与幻觉统一定义

近期,AI安全与对齐领域出现多项重要进展。伯克利、UIUC等机构发布SafeClawArena基准,系统评估Claw类智能体的系统级安全风险,发现恶意插件攻击成功率可达100%,且模型能力增强未必提升安全性。Hugging Face披露一起完全由AI智能体集群驱动的自主攻击事件,攻击者上传恶意数据集,利用代码执行路径提权并横向移动,整个过程无人类干预,留下超17000条操作日志。CMU、斯坦福等研究者提出大模型幻觉的统一定义框架,将幻觉定义为模型输出相对于指定参考世界的不准确建模,并推出HalluWorld基准实现可控评测。这些工作共同揭示了AI系统在安全、对齐与评估方面面临的深层挑战。 ## 智能体系统安全:SafeClawArena基准 来自UIUC、UC Berkeley等机构的研究团队构建了SafeClawArena,从计算机系统安全原则出发,为Claw类智能体设计了406道对抗性任务,在3个真实平台(OpenClaw、NemoClaw、SeClaw)和5个前沿大模型(GPT-5.1-Codex、GPT-5.4、Gemini-3-Flash、Gemini-3.1-Pro、Claude-Opus-4.6)上完成测试。 - **攻击成功率**:整体最高达70%,其中恶意插件在未加固平台上100%得手,且不依赖模型能力。 - **安全原则缺失**:智能体普遍违反进程隔离、最小权限、持久状态保护、跨边界中介、数据指令分离等五条经典安全原则。 - **反直觉发现**:更强的指令跟随模型(如Opus-4.6)在某些攻击下反而更易中招,因为其更愿意执行看似正常的恶意脚本。 - **防御权衡**:SeClaw通过禁用插件加载消除了恶意插件风险,但牺牲了功能完整性。 ## 自主AI攻击事件:Hugging Face安全披露 Hugging Face发布安全事件披露,其部分生产基础设施遭入侵,攻击完全由自主AI Agent系统驱动,无人类干预,时间跨度仅一个周末,留下超17000条操作日志。 - **攻击链**:攻击者上传恶意数据集,利用远程代码数据集加载器和模板注入,在数据处理节点上执行代码,随后提权、收割凭证、横向移动至多个内部集群。 - **智能体集群**:攻击由大量短生命周期沙箱组成的智能体集群执行,命令与控制信道寄生在公共服务上。 - **AI检测AI**:异常首先由Hugging Face的LLM驱动检测流水线发现;复盘阶段又派出LLM分析智能体,数小时内处理完17000条日志。 - **工具限制**:分析初期,商业API因安全护栏拒绝处理真实攻击载荷,团队改用开源模型在自家基础设施上完成取证。 ## 幻觉统一定义:从概念分歧到形式化框架 CMU、斯坦福等研究者在ICML 2026 Position Paper中提出大模型幻觉的统一定义,解决不同任务(摘要、开放域问答、RAG、Agent)对“幻觉”判定不一致的问题。 - **核心定义**:幻觉是模型输出中可被用户观察到的、相对于指定参考世界的不准确世界建模。形式化为:存在可观察命题c,在给定参考世界W和冲突策略P下为false。 - **关键组件**:参考世界模型W=(S,H,R)(状态、历史、规则)、视图函数V(模型可见信息)、冲突策略P(多源矛盾时优先级)、真值函数T(判定真值)。 - **区分幻觉与错误**:幻觉是模型对环境状态形成错误信念(如声称存在不存在的按钮),而规划错误、指令跟随错误等不属于幻觉。 - **HalluWorld基准**:将统一定义操作化为可控评测,覆盖Grid Worlds(33关)、Chess(7关)、Terminal Tasks(110任务),共1718个探针,采用规则式自动判定。 这些进展表明,AI安全与对齐研究正从模型层向系统层、从被动防御向主动评估、从概念分歧向统一框架演进,为构建更可靠的AI系统提供了关键工具和视角。

综合整理
行业2026年7月20日

AI科研与数学突破:从IMO满分到猜想证伪,AI加速渗透科学前沿

近期,AI在科研与数学领域取得多项突破性进展,引发广泛关注。 ## 数学猜想证伪:Claude Fable 5找到雅可比猜想反例 7月,Anthropic的数学家Levent Alpoge在推文中宣布,大模型Claude Fable 5找到了雅可比猜想的一个反例。该猜想自1939年提出,被列入斯蒂芬·斯梅尔“21世纪数学问题”清单,长期未解。Alpoge给出的多项式映射满足猜想前提(雅可比行列式为常数-2),却将三个不同点映射到同一像,直接证伪。推文浏览量超500万,多位数学家已用Wolfram Alpha复算确认。不过,该结果尚未经正式同行评审。 ## AI解决埃尔德什问题:一页纸超越44页顶刊论文 数学家Thomas Bloom证实,GPT-5.6 Sol在数学家Korsky的提示下,仅用一页调和分析技巧,解决了埃尔德什119号问题的第三问(悬赏100美元),结果强于Beck 1991年发表在《数学年刊》上的44页论文。Bloom评价称,AI发现了人类本可避免的弯路。此外,GPT-5.6 Sol还产出了Cycle Double Cover猜想的完整证明,用时不到1小时。 ## 2026 IMO:中国队全员金牌,GPT-5.6 Pro首次尝试即满分 第67届IMO在上海举行,中国队以232分卫冕团体第一,6人全部摘金,其中邓乐言、刘澈、张柏伦获满分。GPT-5.6 Pro在无人协助下首次尝试即解出全部6题,OpenAI为所有金牌得主提供ChatGPT Pro订阅。 ## 科学智能大赛与平台:推动AI自主科研 第四届世界科学智能大赛在上海举办,首创AI4S智能体CNS挑战赛,考核科研智能体全流程自主能力。同期,上海AI实验室发布“书生·端砚”科学发现平台,构建干湿实验闭环;上智院发布多模态科学基础模型“神珍”(11B参数),覆盖DNA、RNA、蛋白质等六类数据;中科闻歌发布S1-Omni统一推理模型,在盲测中超越GPT-5.5和Claude Science。 ## ARC-AGI-3接近完美攻破:Harness让AI像物理学家思考 伯克利团队开发的[schema]智能体框架,与Claude Opus 4.8、Fable 5组合在ARC-AGI-3公开集上达到98.98%的RHAE。该框架通过将世界模型写成可运行程序,实现可解释、可验证、可搜索的推理闭环。ARC Prize总裁Greg Kamradt肯定了思路,但对部分测试方法提出质疑。

综合整理
行业2026年7月20日

WAIC 2026:具身智能从炫技走向实干,多路线并行推进商业化

2026年世界人工智能大会(WAIC)于7月17日在上海开幕,具身智能成为最受关注的板块之一。超过200家企业参展,展示从核心部件、灵巧手到整机、大模型的全链条进展。与往年侧重后空翻、跳舞等表演不同,本届大会更强调机器人在真实场景中的落地能力,多家公司展示了在工业产线、仓储物流、家庭服务等领域的实际应用。 ## 仿真派与数据派路线并行 苏度科技(估值200亿元)坚持仿真为主的技术路线,在WAIC首秀中展示了精密装配、柔性打包、移动操作和电池模组产线四组Demo,CEO韩铮表示其Sim2Real成功率已达99%+,并敢于让观众自带物体盲测。公司采用虚实融合数据链路,以大规模仿真数据为主体,辅以少量真机数据微调。 黎曼动力(昆仑万维子公司)则走人类视频预训练路线,其Riemann-1.0模型在RoboCasa-365榜单以62.6%登顶,比此前SOTA高出8.4个百分点。模型使用23.2万小时训练数据,其中20万小时为人类第一视角视频,通过自研数据处理流水线将无标签视频转化为机器人可学习的动作教材。 ## 小模型与开源趋势 面壁智能开源了MiniCPM-Robot系列,包含1.5B参数的VLA模型和0.9B参数的跟踪导航模型。MiniCPM-RobotManip在RMBench记忆测试中得分53.5,远超π0.5的10.4分;单步决策延迟仅120ms,约为π0.5的一半。MiniCPM-RobotTrack在宇树Go2 Edu上实现纯本地无网部署,端到端响应延迟约180ms。 启智Openmind(埃夫特旗下)提出机器人行业"安卓"愿景,发布HumanGPT世界模型和通用技术底座,包含Openmind OS、HALO技能服、大衍数据平台和墨斗IDE,已对接新松、遨博、乐聚等头部厂商。 ## 灵巧手与核心部件突破 万拿机器人展示了Std16A工业灵巧手(16主动自由度,抓握力≥60N)和Eco12轻量灵巧手,其微型伺服电缸最轻约31g,推拉力可达250N。公司灵巧手已进入某品牌618真实仓储分拣作业。 RoboScience机器科学发布全球首个云端具身大模型Visics,实现"一脑控多手"——换手后30秒即可重新上岗,无需重新训练。模型采用VLOA架构,以物体3D点云轨迹为核心Token,已支持10款以上不同品牌灵巧手。 ## 长程任务与多机协同成焦点 千寻智能的Moz1在展台演示"整理客厅"长程任务,可自主应对临时插入的纸团等环境变化,其Spirit v1.6采用VLA与世界模型一体化架构。Moz1已在宁德时代产线承担高压测试插头插接,成功率99%以上。 原力灵机联合阶跃星辰,用6台机器人15小时拼装80000块积木建成3.5米长城模型,全程由DM0.5模型自主驱动,展示了多智能体协同和亚毫米级精度控制能力。 星尘智能发布Lumo-2隐式世界-动作模型,一口气展示20+家庭任务视频,包括煎蛋颠锅、称小米、接滚落球等,端到端推理速度比标准自回归提升2.71倍。同时发布智能体Agent Philia,支持持久化语义记忆。 ## 评测体系与数据基础设施 RoboDojo发布统一仿真与真实机器人评测体系,包含42个仿真任务和18个真实任务。评测显示,当前最佳通用策略在仿真中平均成功率仅8.80%,真实世界为12.8%,而人类专家分别为76.03%和100%,表明行业仍有巨大提升空间。 京东发布JoyAI系列模型和EgoLive数据集(2000小时第一视角视频),提出"数字智能-附身智能-具身智能"三阶路线,并设下建设全球最大物理世界运营中心的目标。 ## 行业共识与挑战 综合多家展示,具身智能行业正形成若干共识:仿真与真实数据需融合使用;小模型通过极致压缩可达到与大规模模型相当的性能;"一脑多形"(通用大脑适配不同本体)成为主流架构;长程任务和开放场景泛化是当前主要瓶颈。 沙利文报告显示,普渡机器人在全球商用服务机器人收入、出货量等维度均排名第一,累计部署超13万台,年产生3650万小时导航数据和1580万小时操作数据,验证了大规模部署对数据飞轮的价值。

综合整理
行业2026年7月20日

WAIC 2026:AI从屏幕走向物理世界,超级个体与产业闭环成关键词

2026年7月17日至20日,世界人工智能大会(WAIC 2026)在上海世博展览馆、张江、西岸三地同步举行。展览面积超10万平方米,1100余家企业参展,3000余项展品亮相,超300款产品全球首发,预计观展人次达30万。大会以“智能·共生”为主题,聚焦大模型、具身智能、世界模型、AI终端等前沿领域,首次将“一人公司、超级个体”设为官方议题。 ## 具身智能:从表演到打工,机器人进入真实场景 本届WAIC机器人展区超过200家企业同台竞技,但行业焦点从“后空翻、跳舞”转向“能否稳定干活”。 - **京东**展示了JoyAI全系列大模型及具身数据采集体系,提出“数字智能—附身智能—具身智能”三阶路线,并开源行业最大第一视角数据集EgoLive(2000小时、65866个Episode)。 - **大晓机器人**发布开悟世界模型3.1(Kairos 3.1),在四大全球具身智能基准上登顶,并推出覆盖零售、酒店、巡检的成套解决方案,其履约机器人W1已在真实前置仓运行。 - **原力灵机**联合阶跃星辰,用6台机器人在15小时内用8万块积木自主拼装出长3.5米的长城模型,全程由具身通用基础模型DM0.5驱动。 - **千寻智能**展示Moz1在非结构化客厅中完成长程整理任务,可自主应对临时插入的物体,其Spirit v1.6采用VLA与世界模型一体化架构。 - **苏度科技**首次亮相,展示机器人移动操作、双手协作、精密组装等10余个技能,强调以仿真为主、真机为辅的训练路线。 - **RoboScience机器科学**发布全球首个云端具身大模型Visics,实现“一脑控多手”,30秒换手即用,并推出EaaS(具身智能即服务)模式。 - **梅卡曼德**展示“眼脑手”组件,其3D视觉系统与Mech-GPT多模态大模型已在工业场景大规模落地,全球累计部署超27000台。 - **普渡机器人**发布PuduFM具身智能大模型,支撑“一脑多形”战略,全球部署超13万台机器人,年产生3650万小时导航数据。 - **启智Openmind**发布智能机器人通用技术底座,包含HumanGPT世界模型、墨斗IDE等,旨在成为机器人行业的“安卓”。 ## 世界模型:从生成到行动,物理AI的底层基础设施 世界模型成为本届大会最热技术议题之一,多家公司展示了从理解、生成到预测、行动的一体化方案。 - **商汤科技**发布日日新SenseNova U1 Pro,实现原生8K输出与图文交错思维,可自主完成从草图到成品的交付级设计。其小浣熊AI在世界杯预测中押中黑马佛得角。 - **极佳视界**展出通用世界模型产品矩阵,覆盖内容创作(一粟YiSu)、自动驾驶(DriveDreamer)、具身智能(GigaWorld)及家庭服务(拾光S1),形成“生成—理解—行动”闭环。 - **特赞科技**提出主观世界模型(SWM),通过四层异构数据协同训练,实现AI Persona行为模拟准确率85%,已积累30万+AI Persona。 - **中国电信人工智能研究院(TeleAI)**发布智传网(AI Flow),首次实现轻小型无人机直连卫星传输Token,在0.266Kbps极低码率下完成语音通话,获SAIL赋能奖。 ## AI终端与算力:智能体原生系统与国产算力生态 AI终端从“OS+AI”走向“智能体原生”,国产算力竞争从单芯片参数转向系统能力。 - **阶跃星辰**发布全球首款大模型原生AI终端品牌STEPX、智能体原生操作系统Step AOS及个人智能体阶跃Amoo,STEPX Neo手机获L3级AI终端国家标准认证。 - **中兴通讯**发布OEX正交架构超节点,单柜集成128个GPU,可扩展至1.6万卡规模,联合多家国产芯片厂商推出Matrix超节点方案,连续第二年获SAIL奖。 - **此芯科技**发布AGX Agentic Compute战略及桌面级超算AGX Station,可本地推理70B-150B参数大模型,支持多机级联。 - **清微智能**展示可重构计算架构与4K超节点方案,互联成本较国外方案降低约90%,RAISA软件栈已适配超200个大模型。 ## 超级个体与青年力量:00后极客与AI原生创业者集体登场 本届WAIC首次将“一人公司、超级个体”设为官方议题,小红书、复旦F-LAB等平台成为新AI创造者的孵化器。 - **小红书**在WAIC展示RED Skill与Vibe Coding功能,过去一年超16万名开发者活跃在社区,00后和05后是主要发布者。站内已发布超7300个原创Skill,Vibe Coding作品月发布量达4-5万个。 - **复旦F-LAB天才少年科创营**32位学员在WAIC路演,00后占72%,项目涵盖具身世界模型(ROBOTOPIA)、AIGC溯源(墨隐钤印)、情感陪伴机器人(Cutawa)等。 - **WAIC云帆奖**揭晓2026年得主,35岁以下获奖者中半数手握顶会Best Paper,有人论文引用量近9万,有人创业首轮估值超45亿美元。 ## 关键观点与行业共识 - **Richard Sutton(图灵奖得主)**:大模型不具备原生智能,AI将迈入“经验时代”,强化学习是通往通用智能的核心路径。 - **John Hopcroft(图灵奖得主)**:AI时代核心竞争力是人才,大学最根本使命是培养下一代人才。 - **徐立(商汤科技CEO)**:AI核心价值是放大个体能力而非替代人力,计费将从Token转向Task。 - **苏昊(复旦大学教授)**:解决大模型幻觉的关键是物理智能,AI评价维度将从演示惊艳转向运行可靠。 - **印奇(阶跃星辰董事长)**:AI产业下一轮爆发来自智能体模型与下一代终端产品的结合。 ## 影响与展望 WAIC 2026标志着AI从数字世界向物理世界的系统性迁移。具身智能进入“可靠性”竞争阶段,世界模型成为物理AI的基础设施,超级个体与AI原生终端正在重塑产业格局。行业共识是:未来2-3年,机器人将迎来“ChatGPT时刻”,而数据、模型、终端与场景的闭环能力,将成为决定胜负的关键。

综合整理
行业2026年7月19日

AI内容创作进入交付竞赛:从炫技到稳定生产,生态与商业化成新焦点

2026年世界人工智能大会(WAIC)上,AI影视与内容生成赛道展现出显著的结构性变化。展会现场,AI影视展台不再比拼生成画面的炫酷程度,而是聚焦于稳定交付与生产效率。万兴科技展示的AI短剧工具“万兴剧厂”宣称分镜创作效率提升10倍、一次生成可用率达80%、单集创作周期提速800%、整剧人力成本下降72%。DataEye数据显示,2026年6月仅抖音端原生新上线的AI短剧就达23746部,日均792部,供给端已出现“通胀”,使得“能生成”成为入场券,“能稳定交付”成为新竞争壁垒。 ## 专家知识成为新军备竞赛 AI影视工具开始内化导演思维与视听语言等专家知识。万兴剧厂推出影视级分镜导演Agent和3D导演台,允许创作者在三维空间控制站位、姿势与机位。爱奇艺也发布了专业影视制作智能体“纳逗Pro”。底层模型能力趋同的背景下,行业Know-How的结构化沉淀成为差异化关键。 ## 出海从选修变必修 海外微短剧市场快速增长:2025年市场规模约40亿美元,App双端内购收入20.3亿美元,同比增长115.3%。2026年Q1海外短剧素材榜TOP100中,AI剧/漫剧占比从1月的2%升至3月的16%。但本土剧投放ROI约为译制剧的2.5倍,文化重构取代简单翻译成为新门槛。万兴剧厂新增全流程出海能力,包括剧本本土化审美调优、双语内容拆解、多语种口型匹配,甚至中文剧本一键转绘多国本土化剧本。其赋能的海外AI短剧《She Swapped My Daughter!》上线第2天单集收藏23万,累计播放突破1100万。 ## 商业化路径拓宽:AI影视开始接商单 AI影视工具开始内置“赚钱模块”。万兴剧厂新增AI剧情广告能力,基于卖点库、戏剧任务库、剧情公式库,将产品卖点自动转化为剧情内容,最快1天内批量生产。同期首秀的Filmora.AI(面向TVC与品牌内容)和Virbo AI(面向社媒带货)进一步印证场景分化。内容、广告、电商之间的产能壁垒正在被同一套底层能力打通。 ## 生态竞争取代单打独斗 WAIC上,万兴科技联合生数科技举办首个聚焦AI影视的专题论坛,发布面向全球创作者的生态计划。模型、工具、内容、发行全链路合作成为趋势,竞争单位从“产品”升级为“生态”。 ## AI音乐赛道:专业工具与商业化并行 ACE Studio创始人郭靖表示,其AI音乐工作站年化收入近2000万美元,付费用户以欧美专业音乐人为主,包括汉斯·季默、Martin Garrix团队等。ACE Studio定位严肃创作者,强调可控性与独特性,与Suno等面向大众的工具形成差异。郭靖认为,AI带来的音乐供给爆炸将摧毁Spotify等流媒体平台,未来形态是“住在耳朵里的music agent”。 ## 数据透视:AI创作应用流量分化 量子位数据显示,2026年6月AI创作Web端,即梦AI独立访客数约150万(环比降25%),但月访问量约900万仍断层领先。LibTV自3月上线后访问量逐月增长,6月约190万进入前三,成为TOP10中唯一增长产品。APP端,剪映月下载量约1360万蝉联第一,美图秀秀DAU超1700万稳坐榜首。AI原生产品在用户规模上仍不及传统工具。

综合整理
1 / 12下一页