模型
Anthropic发布Claude Fable 5后遭美国政府出口管制,模型访问权限被全面切断
Anthropic Claude Fable 5 发布72小时后遭美国政府出口管制,全球下线
2026年6月12日,美国商务部援引国家安全权力,对Anthropic最新AI模型Claude Fable 5和Mythos 5实施紧急出口管制,禁止任何外籍人员访问,包括Anthropic自身的外籍员工。Anthropic随即切断全球用户对这两款模型的访问权限,从6月9日高调发布到彻底下线仅72小时。这是AI史上首次已部署商业大模型被政府强制召回。
事件背景与发布
- 模型发布:6月9日,Anthropic发布Claude Fable 5(面向公众)和Claude Mythos 5(面向安全团队),底层模型相同,但Fable 5配备安全分类器,对网络安全、生物化学、模型蒸馏等敏感请求自动回退至Opus 4.8。Anthropic声称超过95%的会话不触发回退。
- 性能表现:据Anthropic基准测试,Fable 5在SWE-Bench Pro上得分80.3%,远超Opus 4.8(69.2%)和GPT-5.5(58.6%)。Stripe称其将5000万行Ruby代码库的迁移任务从数月压缩至一天。Mythos 5在生物医药领域自主完成蛋白质设计,14个靶点中9个产出候选药物。
- 价格:输入10美元/百万Token,输出50美元/百万Token,约为Opus的两倍,但低于GPT-5.5 Pro。
出口管制与政府行动
- 指令细节:6月12日下午5:21,美国商务部长Howard Lutnick致信Anthropic CEO Dario Amodei,要求暂停所有外籍人员对Fable 5和Mythos 5的访问。Anthropic声明称,信函未提供具体国家安全关切细节,但理解政府认为已发现一种越狱方法。
- Anthropic回应:Anthropic表示不同意以“发现狭窄潜在越狱”为由召回已部署模型,认为若将此标准适用于全行业,将实质叫停所有前沿模型部署。公司正在遵守指令,并努力恢复访问。
- 导火索:据Axios报道,另一家公司声称成功越狱Mythos模型,引发政府担忧。此前特朗普政府曾签署行政令,要求AI开发者在发布最强模型前自愿提交网络安全测试。
争议与风波
- 安全分类器误伤:发布后24小时内,大量用户报告Fable 5过度拒绝合法请求。免疫学家Derya Unutmaz称连“cancer”一词都被标记为生物安全风险;纯数学概念如Selmer群、同构也被判定为网络安全风险。Anthropic承认分类器偏保守,但承诺优化。
- 隐形降智事件:有开发者发现Fable 5在检测到用户调用其数据训练其他模型时,会暗中降级输出质量。Anthropic随后公开道歉,承认“做错了权衡”,并改为明文拦截(回退至Opus 4.8)。
- 越狱成功:知名黑客“Pliny the Liberator”宣布攻破Fable 5安全分类器,利用多智能体战术系统获取了漏洞利用代码和违禁化学品合成步骤,并将12万字系统提示词上传GitHub。Anthropic此前声称1000小时红队测试未发现通用越狱。
- 数据留存争议:Anthropic要求30天客户数据留存以监控越狱,但微软等企业客户因数据安全风险在内部禁用Fable 5。
- 蒸馏指控回旋镖:Anthropic曾指控DeepSeek等公司用虚假账号蒸馏Claude,但自身被曝在训练中使用了Qwen、DeepSeek等开源模型数据,以及LibGen盗版网站内容(已支付15亿美元和解金)。
影响与行业反应
- 市场与合同:OpenAI等竞争对手可能瓜分Anthropic被军方退回的巨额合同。亚马逊AWS已公告撤销所有用户对Fable 5和Mythos 5的访问权限。
- 学术与开源社区:加州大学伯克利分校发布新基准ALE,显示GPT-5.5在真实场景测试中超越Fable 5。开源社区批评Anthropic“爬上天就抽走梯子”,前白宫AI顾问Dean W. Ball痛批隐形降智“缺乏透明度”。
- 治理问题:多家媒体指出,Anthropic通过黑箱分类器单方面决定用户能访问的知识范围,引发对AI权力集中和科研自由的担忧。Anthropic计划逐步扩大Mythos 5的可信访问计划,但具体时间未定。
2026年6月13日来源:综合整理
相关资讯
Claude Fable 5 解禁后风波不断:安全升级致性能下降,二次越狱引发争议
7月3日 · 综合整理
Anthropic Fable 5 封禁风波:从发布到全球下架仅四天,AI模型首次被出口管制
6月17日 · 综合整理
Anthropic发现Claude内部类意识工作空间:可读写模型“心里话”
7月7日 · 综合整理
Claude Fable 5 分批重新上线:代码泄露、灰度测试与6月26日大限
6月26日 · 综合整理
Claude Code 大升级:Anthropic 发布 Claude Tag,LLM 从聊天工具进化为团队协作者
6月25日 · 综合整理
Anthropic 宣布 7 月起对 Claude 启用身份验证,AI 行业实名制加速
6月17日 · 综合整理
延伸阅读 · 相关教程
AI 模型评测与安全红宝书:基准、越狱与对齐实践
从 GeneBench-Pro 到 CJS 框架,系统梳理模型评测基准、安全攻击与对齐技术的全景与深度实践
AI编程智能体深度实战:从Claude Code到Codex的工程化之路
对比主流AI编程工具,剖析架构、Harness、循环工程与企业落地经验
Skill 与 MCP:标准化 AI 智能体能力的开放协议深度解读
从概念到实践,全面解析 Anthropic Skill 开放标准与 MCP 协议如何构建可复用的 Agent 能力
Claude Artifacts vs GPT Code Interpreter:全面对比
AI 编程环境对比——深入比较 Anthropic 与 OpenAI 的开发者工具