政府以「越狱」风险下令关闭 Anthropic 最强模型
6 月 11 日下午 5 点 21 分,美国政府向 Anthropic 下达出口管制指令,要求暂停所有外国人(包括 Anthropic 外籍员工)对 Claude Fable 5 和 Mythos 5 的访问权限。官方理由是政府掌握了「越狱」该模型的方法。Anthropic 随即选择一刀切全量下线这两个模型,对所有客户禁用——无论国籍。这是 AI 历史上首次已部署数亿用户的商业大模型被政府强制召回。官方声明未提供具体安全顾虑细节,仅称政府证人口头演示了一种「窄化、非通用」的绕过方案,涉及的漏洞相对简单且存在于其他公开模型(包括 OpenAI GPT-5.5)中。Anthropic 表示不同意「发现一个潜在越狱就值得召回数亿用户部署的商业模型」,但仍遵守指令,并承诺在 24 小时内披露更多细节。其他 Claude 模型暂不受影响。
We disagree that the finding of a narrow potential jailbreak should be cause for recalling a commercial model deployed to hundreds of millions of people.
Anthropic 官方声明
在服从美国政府禁令的同时,Anthropic 对这一决定的必要性提出罕见的直言质疑
事件关键细节与悬念
①
政府决策黑箱
政府信函未提供具体国家安全顾虑,仅称了解到一种越狱方法。Anthropic 评估该方法为「口头证人」演示、技术水平相对简单、存在于业界多个模型中(含 GPT-5.5),却未动摇政府决定。
②
遵从与抗辩同步
Anthropic 迅速执行禁令(确保「合规」),但同时对禁令正当性发声。这与其「安全优先」的企业定位形成张力——主张严格安全的公司,反而因被视为威胁而遭管制。
③
Fable 5 生命周期极短
6 月 9 日发布 → 6 月 11 日被禁,仅 72 小时。虽「其他 Claude 模型」暂不受影响,但新产品从部署到强制离线的速度创行业纪录,对 AI 企业的商业规划与投资者信心的冲击不言而喻。