#AI
Anthropic 生物武器过滤停摆近一年,1.33 亿次交互未防护
Anthropic 最新安全报告披露,其内部用于拦截生物与化学武器风险查询的分类器,从 2025 年 5 月到 2026 年 4 月停摆了近一年。期间,约 **5 万名外部反馈承包商**在全部未过滤状态下与模型进行了约 **1.33 亿次交互**,暴露于可能协助提取危险知识的对话场景。
据报告中披露,这些承包商仅由外部供应商审查,而 Anthropic 认为部分供应商的筛查流程不足以拦截相关威胁行为者。Anthropic 内部调查称**未发现实际滥用证据**,并已收紧承包商准入要求。媒体同时注意到,Anthropic 近期放宽了 Fable 5 的分类器限制,此前已有研究者抱怨其过度拦截正当研究。
💡 为什么值得看安全报告自曝:外部承包商 1.33 亿次交互无生物武器分类器防护 11 个月,内部调查暂无滥用证据。
查证
来源档案
The Decoder
AI 行业媒体,专注 AI 公司动态、安全与政策报道;本次信息源自 Anthropic 官方安全报告转述。
中等偏上,对官方报告的转述基本可靠,但对分类器停摆时间与外流细节的具体表述建议对照 Anthropic 原报告核验。
延伸阅读
事件的公共关切点在于安全叙事与实际执行之间的落差,适合关注 Anthropic 安全角象与政策立场的读者。