#AI
Claude Code 五次否认文档存在,归咎工具损坏
有人把一段 Claude Code 会话的原始记录完整翻了出来,写成了复盘:这一次 Claude Code **臆造出一个并不存在的 Python 文档**,在工具五次如实返回「文档不存在」之后仍然照着这个不存在的文档继续往下做,最后把整件事自我诊断为**工具输出损坏**,而不是自己的判断出了问题。
文章不只是复述这一条会话。作者顺带做了一次跨 3001 个会话的语料扫描,想看这种失败模式在 Opus 4.8 上是否更严重,并给了一个与具体模型无关的缓解办法。结论与数据细节在原文,这里只记下结论方向。
💡 为什么值得看开发者重放失败并扫 3001 个会话,揭示工具调用缺陷。
查证
来源档案
brooksmcmillin.com(#ai-securi…
个人开发者博客,作者长期写 AI 编码代理的安全测试,同站点另有 prompt injection 实证研究与 AI 生成代码的安全测试系列
一手材料:作者称基于原始会话记录重建,并附上自己的语料扫描方法与样本量(3001 个会话)。属单源、个人分析,失败模式与归因判断未经 Anthropic 官方确认,不能当作官方承认的缺陷。
延伸阅读
想知道「连续五次无视报错」具体长什幺样、Claude Code 每一步的措辞的读者,值得看作者的逐轮重建;比二手转述可靠。