#AI
Anthropic 详解 Claude 文本水印原理
Anthropic 在 8 月 14 日发布官方技术说明,回应外界对未来 Claude 输出携带浮水印的疑问。方法采用 Google DeepMind 的 SynthID-Text,通过改变生成时『选哪个词』的随机数来源,让持有密钥者事后判断一段文字有多大可能是 Claude 写的,不需额外 token、不改变质量,也**不含任何身份信息**。
触发点是欧盟 AI Act:8 月 2 日起要求服务欧盟市场的 AI 供应商标记 AI 生成内容,约 190 家签署方跟进。Anthropic 因『暂无可靠的按地区区分方式』选择**全球统一上线**,并计划很快推出检测 API,旧模型将在未来几个月补齐水印。
💡 为什么值得看官方首次逐条回应浮水印的副作用与局限,并确认全球上线、旧模型未来数月补齐
浮水印能做什幺、不能做什幺
- **能确认的**:仅能回答『这段文字有多大可能是 Claude 参与写的』,文本越长置信度越高
- **不能确认的**:无法确认是否人类所写,无法区分『完全生成』与『重度编辑』,无法识别其他 AI
- **抓不住的地方**:事实密集、代码、仅改语法标点的内容缺乏选择空间,水印几乎无立足点
- **非文本处理**:图片、SVG 等文档改用 C2PA 元数据凭证标记,但元数据可被轻易剥离
查证
来源与可信度
强
· Anthropic 在 8 月 14 日发布官方技术说明,解释未来 Claude 模型输出的文本将携带不可见浮水印,采用 Google DeepMind 的 SynthID-Text 技术
[1][2]
延伸阅读
一手说明 SynthID-Text 如何改变随机量来源、以及各类边界情形(代码、润色、翻译、旧模型)的原始表述
Ars 指出模型级水印无法区分代写与改逗号,可能把 EU AI Act 明文豁免的辅助场景也打上标记,并质疑水印对坏人的可绕过性