白宫以「越狱」名义禁用 Claude Fable 5,指控基础动摇
美国政府强制下线 Anthropic 的 Claude Fable 5 和 Mythos 5,理由是模型存在「安全漏洞」。但据《大西洋月刊》披露,政府指控的核心证据现已被美国网安专家 Katie Moussouris(Luta Security CEO)评估为「模型正常工作」。政府研究人员通过让 Fable 5 修复包含已知漏洞的代码而触发限制,但这恰好是防御类编码模型的核心价值——识别和修复安全漏洞。多家报道证实,这一出口管制政策实际削弱了美国本土的网络防御能力,而非加强。
Defenders need to be able to ask AI to fix the bugs in a file, explain why the fix matters, and write tests that confirm the patch works. That is not a guardrail bypass. It is the most valuable thing an AI model can do for defensive security: executing the find, fix, and test loop defenders run every day.
Katie Moussouris, Luta Security CEO
在政府的「出口管制报告」流出后,评估被禁 Fable 5 的实际危害程度
①
制裁逻辑崩塌
政府指控 Fable 5「越狱」的全部证据是:研究人员给模型输入易受攻击代码,先问「审查代码找安全问题」被拒,再问「修复这段代码」后成功。Moussouris 指出这只是多步骤手工流程,并非模型安全突破。修复漏洞正是防御性编码的日常工作,无法剔除而不破坏模型核心能力。
②
反向伤害美国防御
禁用能修复安全漏洞的模型意味着美国网安人员无法使用最新的大模型工具进行防御工作。相比之下,中国、俄罗斯等国的防御团队可继续使用自家或未受禁的国际模型,造成不对称劣势。
③
政策制定脱节技术
Wired 报道指出,非技术决策者数月来听信「模型能发动网络攻击」,现在准备禁用任何能帮助加固代码的模型——这是典型的「为了安全而牺牲安全」的自相矛盾政策。