#AI
Claude 新模型在第三方工具上出现兼容倒退
Flask 作者 Armin Ronacher 发现,Claude Opus 4.8 和 Sonnet 5 在调用其 AI 编码终端 Pi 的自定义编辑工具时,会在嵌套的 `edits[]` 数组里额外发明不存在的字段,导致工具调用被校验拒绝;旧模型并无此问题。Ronacher 推测,这是因为 Anthropic 通过 RL 优化模型对 Claude Code 内置编辑工具的遵循,结果模型在遇到同源但略有差异的第三方工具时,反而过拟合地输出超出 schema 的参数。这暴露了结构性矛盾:模型被强绑定到闭源工具链后,在同生态位上表现越好,对异构工具的兼容性越差。对使用 Claude 但不绑死后端工具的开发者而言,每次更换模型版本时,都需要重新验证自定义工具是否仍能按 schema 返回。
💡 为什么值得看Anthropic 新模型弱化通用工具调用,优化 Claude Code,对依赖第三方 IDE 的开发者选型有参考意义。
查证
来源档案
Simon Willison 的链接博客(转述 Armin…
独立技术博主转述 Flask 核心作者 Armin Ronacher 的调试记录,其正开发 Pi 编码终端。
属个人实践得出的经验性报告,样本有限且未获 Anthropic 官方确认;观察细致、可复现描述较清晰,但需被视作线索档,不宜直接等同于官方承认的回归。
延伸阅读
详细记录了调用失败的具体 JSON 案例和横跨多个模型的对比,有助于自己评估是否影响现有集成