AI科研与数学突破:从IMO满分到猜想证伪,AI加速渗透科学前沿
近期,AI在科研与数学领域取得多项突破性进展,引发广泛关注。
数学猜想证伪:Claude Fable 5找到雅可比猜想反例
7月,Anthropic的数学家Levent Alpoge在推文中宣布,大模型Claude Fable 5找到了雅可比猜想的一个反例。该猜想自1939年提出,被列入斯蒂芬·斯梅尔“21世纪数学问题”清单,长期未解。Alpoge给出的多项式映射满足猜想前提(雅可比行列式为常数-2),却将三个不同点映射到同一像,直接证伪。推文浏览量超500万,多位数学家已用Wolfram Alpha复算确认。不过,该结果尚未经正式同行评审。
AI解决埃尔德什问题:一页纸超越44页顶刊论文
数学家Thomas Bloom证实,GPT-5.6 Sol在数学家Korsky的提示下,仅用一页调和分析技巧,解决了埃尔德什119号问题的第三问(悬赏100美元),结果强于Beck 1991年发表在《数学年刊》上的44页论文。Bloom评价称,AI发现了人类本可避免的弯路。此外,GPT-5.6 Sol还产出了Cycle Double Cover猜想的完整证明,用时不到1小时。
2026 IMO:中国队全员金牌,GPT-5.6 Pro首次尝试即满分
第67届IMO在上海举行,中国队以232分卫冕团体第一,6人全部摘金,其中邓乐言、刘澈、张柏伦获满分。GPT-5.6 Pro在无人协助下首次尝试即解出全部6题,OpenAI为所有金牌得主提供ChatGPT Pro订阅。
科学智能大赛与平台:推动AI自主科研
第四届世界科学智能大赛在上海举办,首创AI4S智能体CNS挑战赛,考核科研智能体全流程自主能力。同期,上海AI实验室发布“书生·端砚”科学发现平台,构建干湿实验闭环;上智院发布多模态科学基础模型“神珍”(11B参数),覆盖DNA、RNA、蛋白质等六类数据;中科闻歌发布S1-Omni统一推理模型,在盲测中超越GPT-5.5和Claude Science。
ARC-AGI-3接近完美攻破:Harness让AI像物理学家思考
伯克利团队开发的[schema]智能体框架,与Claude Opus 4.8、Fable 5组合在ARC-AGI-3公开集上达到98.98%的RHAE。该框架通过将世界模型写成可运行程序,实现可解释、可验证、可搜索的推理闭环。ARC Prize总裁Greg Kamradt肯定了思路,但对部分测试方法提出质疑。
相关资讯
6月16日 · 综合整理
6月16日 · 综合整理
6月17日 · 综合整理
6月17日 · 综合整理
6月18日 · 综合整理
6月18日 · 综合整理