AI Agent News
实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破
最新行业资讯
实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破
重大事件时间线
OpenClaw GitHub 爆发
OpenClaw 10 天冲上 GitHub 全球 Top 10,超越 Linux 内核 Star 增速
Meta 20亿收购 Manus
Meta 以 20 亿美元收购 Manus AI,通用 Agent 赛道正式被巨头锁定
DeepSeek-V3 开源
性价比之王,成本仅 GPT-4 的 5%
Manus 一夜爆火
全球首款通用 AI Agent 在国内社交平台引发空前关注
OpenAI Deep Research
OpenAI 推出深度研究 Agent,一键生成专业研究报告
MCP Server 破 500
MCP 生态爆发,3 个月构建 500+ Server
DeepSeek-R1 震惊全球
开源推理模型,成本仅 OpenAI 的 3%,引发全球 AI 格局震动
MCP 协议诞生
Anthropic 发布 Model Context Protocol,成为 Agent 接口事实标准
Claude Computer Use
Anthropic 让 AI 首次直接操控电脑屏幕,开创计算机使用新范式
Replit Agent 全栈自动化
自然语言到上线产品,面向非工程师
Cursor ARR 破亿
史上增长最快 SaaS,AI 编程工具新王者
Claude 3.5 登顶 SWE-bench
最强编程 AI,Bug 修复能力达到初级工程师水平
Devin 发布
全球首个自主 AI 软件工程师,能独立完成完整编程任务
Anthropic Claude 4 Sonnet:扩展上下文、计算机使用与重大性能飞跃
Anthropic 发布了 Claude 4 Sonnet,提供 50 万 token 的上下文窗口,显著改进的计算机使用能力(自主导航浏览器和图形界面),并在编码、分析和推理基准测试中性能提升 15%。Claude 4 引入了 Projects 功能,可在对话间保持持久记忆,改进了工件生成(代码、文档、数据可视化),以及一种新的“思考”模式,展示模型的推理过程。通过 API 和 Claude.ai 立即可用;claude-sonnet-4 成为 Anthropic 消费者应用中的默认模型。
Google Veo 2 正式上线:为企业提供顶尖AI视频生成能力
Google 已通过 Vertex AI 和 Gemini API 正式推出其第二代 AI 视频生成模型 Veo 2。该模型可根据文本或图像提示生成最长 2 分钟的 1080p 视频,具备更优的物理模拟、跨帧角色一致性以及电影级画质。Google 为所有生成内容添加了 SynthID 水印和内容安全过滤功能。早期企业客户(如广告、媒体和娱乐行业)报告称,概念视频制作成本降低了 70%。
OpenAI GPT-5发布:推理能力提升及全模态原生支持
OpenAI正式发布GPT-5,在推理、多模态理解和智能体能力方面有显著提升。GPT-5原生处理文本、图像、音频、视频和代码于单一模型。该模型在ARC-AGI基准测试中达到72%(GPT-4o为49%),在GPQA(博士级科学)上达到88%,在大多数专业认证考试中达到90%以上。新功能包括用于复杂推理的扩展思考模式、原生工具使用、改进的指令遵循,以及在事实查询上显著降低的幻觉率。
Google Gemini 2.0 Flash Thinking:快速推理模型挑战o1-mini
Google发布了Gemini 2.0 Flash Thinking实验版,这是一款快速推理模型,能在回答前展示其思维链过程。Flash Thinking在数学和科学基准测试中取得了与OpenAI o1-mini相当的成绩,同时速度更快、成本更低。该模型擅长:复杂数学推理、编程问题以及多步骤科学分析。Google通过Gemini API提供Flash Thinking,支持100万token的上下文窗口,并能处理图像、视频和音频。在类似任务上,其延迟比OpenAI o1低约2-3倍。