Fable 5 恢复全球访问:出口管制解除背后的人工智能安全博弈

Fable 5 恢复全球访问:出口管制解除背后的人工智能安全博弈

_

Anthropic 旗下 Claude Fable 5 在经历近三周限制后,于 7 月 1 日起恢复全球访问。6 月 12 日,美国政府对 Fable 5 及同系列 Mythos 5 实施出口管制,原因是一项安全漏洞:亚马逊研究团队发现,通过特定提示方式可绕过 Fable 5 的安全防护,让模型识别软件漏洞并在个别情况下生成漏洞利用代码。

出口管制与安全事件始末

Anthropic 在 6 月 9 日发布 Fable 5,两周后即因出口管制暂停所有用户访问。调查证实,Fable 5 在报告中展现的漏洞识别与代码生成能力并非独有——Claude Opus 4.8、GPT-5.5、Kimi K2.7 等多款模型同样能完成相同操作,且部分能力属于日常防御性网络安全工作的常规操作。Anthropic 强调,该绕行技术并未暴露 Mythos 级别的独特网络攻击能力。

Anthropic 随后与美国商务部人工智能标准与创新中心(CAISI)及亚马逊等合作伙伴协作,训练了改进版安全分类器。该分类器针对报告中描述的绕过行为实施拦截,测试显示拦截率超过 99%。CAISI 研究人员已验证新旧两版防护均达到极高强度。新分类器的代价是误报率有所上升,常规编码与调试任务中可能触发更多安全提示,Anthropic 表示将持续优化。

全球恢复与行业安全框架

6 月 26 日美国政府批准后,Fable 5 自 7 月 1 日起在 Claude Platform、Claude.ai、Claude Code、Claude Cowork 向全球用户开放,Pro、Max、Team 及部分 Enterprise 计划用户在 7 月 7 日前可免费使用达 50% 的周限额。AWS、谷歌云、微软 Foundry 等平台的访问也在逐步恢复。

Anthropic 将此次事件视为推动行业协作的契机,联合亚马逊、微软、谷歌等 Project Glasswing 合作伙伴,共同开发针对 AI 模型绕行(jailbreak)评估与修复的行业通用框架,以统一判断标准、加快响应速度并改善政府沟通。

编注:信源为 Anthropic 官方博客,材料侧重事件时间线与技术修复细节,提及与亚马逊、谷歌、微软的协作框架及政府测试流程。


arXiv从康奈尔独立:学术预印本平台迎25年来最大组织变革 2026-07-01
霍尔木兹海峡三条航线并存,阿联酋石油出口量创历史新高 2026-07-01