#AI
Claude 新模型在 Pi 中工具兼容性退步
Armin Ronacher 在编码工具 Pi 里发现一个反常现象:**新版 Claude 模型在调用 Pi 的编辑工具时,会在 `edits[]` 数组里编造额外字段**,导致严格模式下的工具调用被拒,约 20% 的编辑请求因此失败。出问题的不是小模型,而是 Opus 4.8 与 Sonnet 5;旧版 Claude 反而没有这个毛病。
Ronacher 推测,Anthropic 很可能是通过强化学习把新模型 **专门调教成了 Claude Code 内置编辑工具的「熟手」**,代价是模型在其他编码工具中对自定义 schema 的遵从度下滑。Simon Willison 在转引这则发现时进一步提出,第三方编码工具是否该被迫实现多套编辑工具,「为每一种底层模型配上它最擅长的那套」。这一案例把「模型越强、工具兼容性反而倒退」的矛盾摆到了台面上,对依赖多模型切换的 AI 编码工具生态是一个不容忽略的信号。
💡 为什么值得看SOTA 模型反而在第三方工具上出错更多,揭示专用优化可能伤及通用合规性。
查证
来源档案
Simon Willison 的博客
独立技术博客,转述 Armin Ronacher 在 Pi 中的实测发现并附评论。
Simon Willison 与 Armin Ronacher 均为有信誉的开发者,原始报告有 GitHub issue 复现步骤支撑,可信度较高。
延伸阅读
博文链接至 Armin 原文与 Pi issue #6278,可同步查阅复现数据和社区回应。