探所 Curio 再探再报 了解探所 →
#AI

Claude 新模型给生成文本加水印

Anthropic 宣布,8 月 2 日及以后发布的新 Claude 模型将从上线起为生成内容加入**机器可读的隐形水印**。这套标记只针对 Claude 原生输出,不识别其他大模型的内容。

水印不是文末的「本文由 AI 生成」声明,而是编织进底层选词规律——同一位置多个候选词,水印会让模型优先选择「暗号本」上指定的那个,几十处乃至几千处贴合才算命中。因此下载、复制粘贴都无法去除。但上线约 24 小时,开发者就在 GitHub 放出名为 **watermarks-remover** 的破解工具,思路是用另一个无水印模型做大规模改写与同义词替换。

💡 为什么值得看8 月 2 日后 Claude 模型加隐形水印,开发者 24 小时内破解。

查证

来源档案

36 氪(转自微信公众号「荔观 Lab」)

中文科技媒体的转载评论文章,非官方公告,也非对 Anthropic 官方声明的直接引用原文

事件主体(水印上线、破解工具)可信,但属于单个二手媒体口径,Anthropic 官方原始公告与 GitHub 破解仓库未在证据中直接呈现;具体日期、上线范围等细节需以官方为准

延伸阅读

水印机制原理 · 36kr.com 5 分钟
文章用「选择题 + 暗号本」的比喻讲清了选词层面水印如何嵌入,适合想理解技术原理但不想读论文的读者
AI 原创 vs 辅助 · 36kr.com 5 分钟
文章后半段讨论水印无法区分「AI 原创」与「AI 辅助润色」,这是检测滥用误伤的核心争议点
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store