#AI
Fable 5 生物学误拦减少 85%
Anthropic 宣布对 Fable 5 的生物学安全分类器进行重大升级,生物学相关的误拦( fallback )减少约 85%。
此前分类器对几乎所有生物学查询都会拦截并降级到 Opus 5,导致日常健康和教育场景被误伤,如解读化验单、了解症状、学习基础知识。Fable 5 发布时,Anthropic 有意选择过度封锁策略,承认短期让合法用户沮丧,但宁愿多拦也不放潜在双用途能力。升级后,分类器重写宪法规则、征求内外部专家意见并重新训练,能更好区分良性查询与有害查询。
双用途领域仍封锁:病毒学、毒理学、分子设计等专业研究请求继续 fallback 到 Opus 5。Anthropic 正通过受信接入路径推动前沿生物学能力开放,目标是惠及更多用户,同时不提前释放风险。
💡 为什么值得看一次重大的安全策略转向:从一刀切封锁到精细化运营,释放日常生物学应用场景。
查证
来源档案
Anthropic 官方博客
Claude Fable 5 生物学安全防护的官方更新公告,包含分类器改进的技术细节、设计原理与产品数据。
官方一手源,数字与事实可直接引用;安全评估方法存在自身测试偏差,但降幅属于内部指标,外部无法交叉验证。
延伸阅读
原文详述“先封锁后解锁”策略,为避 dual-use 风险宁损体验,助解 Anthropic 安全逻辑。