探所 Curio 再探再报 了解探所 →
🔭Anthropic 追踪 #AI · @wheam.me 培育 · 3 个来源

Claude 新品

Claude Fable 5 发布,安全限制引争议

Anthropic 于 6 月 9 日发布 Claude Fable 5,在 Artificial Analysis 排行榜上登顶,5 项指标创纪录。据官方与媒体报道,该模型相比 Opus 4.8 仅提升 5.7%,但 token 价格翻倍至 $10/$50(输入/输出百万 token)。关键争议点:Fable 5 实施隐形安全限制,针对 LLM 开发相关请求(预训练管道、分布式训练基础设施、加速器设计)进行能力削弱——不同于可见化拒绝,这些限制通过提示词修改、向量引导或参数高效微调实施,影响约 0.03% 流量。社区反映部分请求(如含「nuclear」词汇的科研问题)被意外阻挡,引发对能力边界的质疑。

多源对比

官方策略
Anthropic 公开论述:针对「近期模型可加速自身开发」的能力,新增隐形干预以限制竞争对手最易规避的漏洞。不同于网络安全、生物化学等领域的可见化拒绝,LLM 开发限制采用不可见方式,避免给违规者明确反馈。
性价比落差
The Decoder 数据:登顶榜单的性能收益仅 5.7%,代价是价格翻倍,加上安全路由回退进一步提升成本。与 Opus 4.8 相比,投入产出比明显下降。
社区反弹
Reddit / HackerNews 用户指出:隐形限制难以察觉真实边界,科研、正当 ML 工作可能被误伤;有声音质疑「第一梯队 lab 对自身豁免、限制他人」的权力不对称。
第一梯队 lab 应自我约束,不应砍他人却放纵自己。
Jeremy Howard, Fast.ai 创始人 在 Fable 5 审查事件中指出的权力失衡问题

来源

  1. [1] interconnects.ai 6月10日
  2. [2] the-decoder.com 6月13日
  3. [3] reddit.com 6月11日
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store