EN

AI Agent News

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

AI Agent 动态

最新行业资讯

实时追踪 AI Agent 赛道的重大事件、融资动向、模型发布和技术突破

重大事件时间线

2026-01

OpenClaw GitHub 爆发

OpenClaw 10 天冲上 GitHub 全球 Top 10,超越 Linux 内核 Star 增速

2025-12

Meta 20亿收购 Manus

Meta 以 20 亿美元收购 Manus AI,通用 Agent 赛道正式被巨头锁定

2025-04

DeepSeek-V3 开源

性价比之王,成本仅 GPT-4 的 5%

2025-03

Manus 一夜爆火

全球首款通用 AI Agent 在国内社交平台引发空前关注

2025-02

OpenAI Deep Research

OpenAI 推出深度研究 Agent,一键生成专业研究报告

2025-02

MCP Server 破 500

MCP 生态爆发,3 个月构建 500+ Server

2025-01

DeepSeek-R1 震惊全球

开源推理模型,成本仅 OpenAI 的 3%,引发全球 AI 格局震动

2024-11

MCP 协议诞生

Anthropic 发布 Model Context Protocol,成为 Agent 接口事实标准

2024-10

Claude Computer Use

Anthropic 让 AI 首次直接操控电脑屏幕,开创计算机使用新范式

2024-09

Replit Agent 全栈自动化

自然语言到上线产品,面向非工程师

2024-08

Cursor ARR 破亿

史上增长最快 SaaS,AI 编程工具新王者

2024-06

Claude 3.5 登顶 SWE-bench

最强编程 AI,Bug 修复能力达到初级工程师水平

2024-03

Devin 发布

全球首个自主 AI 软件工程师,能独立完成完整编程任务

AI Research2026年5月27日

新AI智能体基准测试显示在现实任务上取得快速进展

WebArena和OSWorld基准测试显示,AI智能体在复杂的网页导航和桌面任务中完成率超过40%,仅12个月的研究进展就带来了显著提升。

WebArena
AI Research2026年5月27日

AI安全研究突破:新可解释性方法问世

Anthropic研究人员发布了可解释性研究的突破性成果,使人们能够更清晰地理解神经网络如何表征概念,推动了AI对齐与安全科学的发展。

Anthropic Research
AI Research2026年5月26日

合成数据生成成为关键AI训练技术

AI实验室日益依赖合成数据来补充稀缺的真实世界训练数据,Scale AI和Gretel AI等公司报告称对高质量合成数据集的需求呈爆炸式增长。

VentureBeat
AI Research2026年5月23日

物理AI:机器人公司竞相构建具身智能

继英伟达投资物理AI后,Figure、1X和Apptronik等机器人公司加速开发具备高级AI推理能力和灵活性的通用机器人。

TechCrunch
AI Research2026年5月22日

研究:AI编程助手将开发者生产力提升55%

麻省理工学院和斯坦福大学的最新研究表明,使用AI编码工具的开发者完成任务的平均速度提高了55%,在代码生成和测试编写任务中收益最大。

arXiv
AI Research2025年5月26日

AI检测工具与AI写作工具:日益升级的军备竞赛

AI内容检测工具对最新一代AI文本的准确率仅为60%,而谷歌和Anthropic的水印技术面临移除攻击。学术界正在争论可靠检测在理论上是否可能实现。

Research Reports
AI Research2025年5月3日

2025年AI科学发现:从天气预报到材料设计

谷歌DeepMind的GNNCast现以0.1度分辨率提供10天天气预报,性能超越传统数值天气预报模型,计算成本仅为后者的千分之一。同时,微软研究院的MatterGen按需生成电池材料的新型晶体结构。共同趋势是:AI正在取代科学工作流中的计算模拟——而非辅助。麻省理工学院研究人员报告,AI辅助材料发现的速度比实验室筛选快100倍。

Google DeepMind
AI Research2025年3月15日

Google DeepMind Gemini 2.0 展示突破性网络安全研究能力

Google DeepMind 展示了 Gemini 2.0 的网络安全能力,包括在开源项目中自动发现漏洞、无需沙箱的恶意软件分析以及解决 CTF(夺旗)挑战。在基准测试中,Gemini 2.0 在一次受控研究活动中发现了主要开源项目中的 7 个零日漏洞。该模型现已通过 Google 的 Project Zero 和漏洞研究资助计划向安全研究人员开放。

Google DeepMind