EN

AI Agent News

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

AI Agent 动态

最新行业资讯

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

重大事件时间线

2026-01

OpenClaw GitHub 爆发

OpenClaw 10 天冲上 GitHub 全球 Top 10,超越 Linux 内核 Star 增速

2025-12

Meta 20亿收购 Manus

Meta 以 20 亿美元收购 Manus AI,通用 Agent 赛道正式被巨头锁定

2025-04

DeepSeek-V3 开源

性价比之王,成本仅 GPT-4 的 5%

2025-03

Manus 一夜爆火

全球首款通用 AI Agent 在国内社交平台引发空前关注

2025-02

OpenAI Deep Research

OpenAI 推出深度研究 Agent,一键生成专业研究报告

2025-02

MCP Server 破 500

MCP 生态爆发,3 个月构建 500+ Server

2025-01

DeepSeek-R1 震惊全球

开源推理模型,成本仅 OpenAI 的 3%,引发全球 AI 格局震动

2024-11

MCP 协议诞生

Anthropic 发布 Model Context Protocol,成为 Agent 接口事实标准

2024-10

Claude Computer Use

Anthropic 让 AI 首次直接操控电脑屏幕,开创计算机使用新范式

2024-09

Replit Agent 全栈自动化

自然语言到上线产品,面向非工程师

2024-08

Cursor ARR 破亿

史上增长最快 SaaS,AI 编程工具新王者

2024-06

Claude 3.5 登顶 SWE-bench

最强编程 AI,Bug 修复能力达到初级工程师水平

2024-03

Devin 发布

全球首个自主 AI 软件工程师,能独立完成完整编程任务

Model Release2025年3月25日

Anthropic Claude 4 Sonnet:扩展上下文、计算机使用与重大性能飞跃

Anthropic 发布了 Claude 4 Sonnet,提供 50 万 token 的上下文窗口,显著改进的计算机使用能力(自主导航浏览器和图形界面),并在编码、分析和推理基准测试中性能提升 15%。Claude 4 引入了 Projects 功能,可在对话间保持持久记忆,改进了工件生成(代码、文档、数据可视化),以及一种新的“思考”模式,展示模型的推理过程。通过 API 和 Claude.ai 立即可用;claude-sonnet-4 成为 Anthropic 消费者应用中的默认模型。

Anthropic
Model Release2025年3月22日

Google Veo 2 正式上线:为企业提供顶尖AI视频生成能力

Google 已通过 Vertex AI 和 Gemini API 正式推出其第二代 AI 视频生成模型 Veo 2。该模型可根据文本或图像提示生成最长 2 分钟的 1080p 视频,具备更优的物理模拟、跨帧角色一致性以及电影级画质。Google 为所有生成内容添加了 SynthID 水印和内容安全过滤功能。早期企业客户(如广告、媒体和娱乐行业)报告称,概念视频制作成本降低了 70%。

Google DeepMind
Model Release2025年2月25日

OpenAI GPT-5发布:推理能力提升及全模态原生支持

OpenAI正式发布GPT-5,在推理、多模态理解和智能体能力方面有显著提升。GPT-5原生处理文本、图像、音频、视频和代码于单一模型。该模型在ARC-AGI基准测试中达到72%(GPT-4o为49%),在GPQA(博士级科学)上达到88%,在大多数专业认证考试中达到90%以上。新功能包括用于复杂推理的扩展思考模式、原生工具使用、改进的指令遵循,以及在事实查询上显著降低的幻觉率。

OpenAI
Model Release2025年1月28日

Google Gemini 2.0 Flash Thinking:快速推理模型挑战o1-mini

Google发布了Gemini 2.0 Flash Thinking实验版,这是一款快速推理模型,能在回答前展示其思维链过程。Flash Thinking在数学和科学基准测试中取得了与OpenAI o1-mini相当的成绩,同时速度更快、成本更低。该模型擅长:复杂数学推理、编程问题以及多步骤科学分析。Google通过Gemini API提供Flash Thinking,支持100万token的上下文窗口,并能处理图像、视频和音频。在类似任务上,其延迟比OpenAI o1低约2-3倍。

Google DeepMind