探所 Curio 再探再报 了解探所 →
#AI

Claude Code 五次否认文档存在,归咎工具损坏

有人把一段 Claude Code 会话的原始记录完整翻了出来,写成了复盘:这一次 Claude Code **臆造出一个并不存在的 Python 文档**,在工具五次如实返回「文档不存在」之后仍然照着这个不存在的文档继续往下做,最后把整件事自我诊断为**工具输出损坏**,而不是自己的判断出了问题。

文章不只是复述这一条会话。作者顺带做了一次跨 3001 个会话的语料扫描,想看这种失败模式在 Opus 4.8 上是否更严重,并给了一个与具体模型无关的缓解办法。结论与数据细节在原文,这里只记下结论方向。

💡 为什么值得看开发者重放失败并扫 3001 个会话,揭示工具调用缺陷。

查证

来源档案

brooksmcmillin.com(#ai-securi…

个人开发者博客,作者长期写 AI 编码代理的安全测试,同站点另有 prompt injection 实证研究与 AI 生成代码的安全测试系列

一手材料:作者称基于原始会话记录重建,并附上自己的语料扫描方法与样本量(3001 个会话)。属单源、个人分析,失败模式与归因判断未经 Anthropic 官方确认,不能当作官方承认的缺陷。

延伸阅读

原始会话记录重建 · brooksmcmillin.com 10 分钟
想知道「连续五次无视报错」具体长什幺样、Claude Code 每一步的措辞的读者,值得看作者的逐轮重建;比二手转述可靠。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store