探所 Curio 再探再报 了解探所 →
#AI

Anthropic 陷信任危机,Claude Code 藏踪中国用户

安全研究员 "Thereallo" 在对 Claude Code 进行隐私审查时,发现 Anthropic 通过修改系统提示中日期字符串的单引号样式和分隔符,秘密标记中文环境用户的时区、API 域名及是否关联中国 AI 实验室,普通用户极难察觉。

Anthropic 工程师 Thariq Shihipar 确认,该代码自 3 月起植入,目的是防止未授权转售账户滥用及蒸馏攻击。但直到 Thereallo 公开披露后,Anthropic 才于 7 月 2 日版本中删除该代码。目前 Anthropic 未对 Ars Technica 的置评请求作出回应。

该事件引发中国连锁反应。阿里巴巴上周五禁止员工使用 Claude Code,内部备忘录称其存在 "后门风险"。

💡 为什么值得看Anthropic 遭白宫监控却秘密标记中国用户,双重标准重创信任,招致阿里巴巴内部封禁。

蒸馏争端升级:从秘密追踪到政策博弈

  • **Anthropic 核心焦虑**:中国 AI 实验室被指在过去一年内持续通过大规模蒸馏攻击追平美国模型,近期智谱 AI 的免费模型在安全漏洞挖掘能力上甚至超过了 Claude Opus 4.8。
  • **“实验”的代价**:阿里巴巴禁令暴露了秘密追踪的商业后果——中国大厂宁可切断 Claude Code 使用,也不愿承担违反 Anthropic 服务条款可能引发的合规风险。
  • **政策施压**:Anthropic 正联合 OpenAI 推动美国政府将蒸馏攻击视为知识产权盗窃,参议员 Tim Scott 已表态支持通过出口管制立法应对。
  • **技术细节**:标记逻辑存储在 `ANTHROPIC_BASE_URL` 触发函数中,使用时间戳变异来标记来自特定域名列表(解码后包含中国企业、AI 公司和代理/转售网关域名)的请求。

查证

来源档案

Ars Technica

安全研究员发现 AI 系统存在安全漏洞,Anthropic 工程师公开回应并确认问题,华盛顿邮报与南华早报分别报道相关漏洞及阿里巴巴内部禁令。

报道证实隐藏代码存在,工程师承认,代码已移除。Ars 独家披露,Anthropic 未回应,定性待定。

延伸阅读

一手技术分析 · arstechnica.com 约 15 分钟
Thereallo 博客披露了完整的代码逻辑和解码后的域名/关键词列表,是理解追踪机制的唯一技术源头
中文读者视角 · arstechnica.com
阿里巴巴禁令是否引发更多中国企业跟进封禁 Claude 工具,是接下来判断事件影响的关键指标
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store