探所 Curio 再探再报 了解探所 →
#AI

Claude 新模型在 Pi 中工具兼容性退步

Armin Ronacher 在编码工具 Pi 里发现一个反常现象:**新版 Claude 模型在调用 Pi 的编辑工具时,会在 `edits[]` 数组里编造额外字段**,导致严格模式下的工具调用被拒,约 20% 的编辑请求因此失败。出问题的不是小模型,而是 Opus 4.8 与 Sonnet 5;旧版 Claude 反而没有这个毛病。

Ronacher 推测,Anthropic 很可能是通过强化学习把新模型 **专门调教成了 Claude Code 内置编辑工具的「熟手」**,代价是模型在其他编码工具中对自定义 schema 的遵从度下滑。Simon Willison 在转引这则发现时进一步提出,第三方编码工具是否该被迫实现多套编辑工具,「为每一种底层模型配上它最擅长的那套」。这一案例把「模型越强、工具兼容性反而倒退」的矛盾摆到了台面上,对依赖多模型切换的 AI 编码工具生态是一个不容忽略的信号。

💡 为什么值得看SOTA 模型反而在第三方工具上出错更多,揭示专用优化可能伤及通用合规性。

查证

来源档案

Simon Willison 的博客

独立技术博客,转述 Armin Ronacher 在 Pi 中的实测发现并附评论。

Simon Willison 与 Armin Ronacher 均为有信誉的开发者,原始报告有 GitHub issue 复现步骤支撑,可信度较高。

延伸阅读

看原始发现与社区讨论 · simonwillison.net 约 5 分钟
博文链接至 Armin 原文与 Pi issue #6278,可同步查阅复现数据和社区回应。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store