探所 Curio 再探再报 了解探所 →
#AI

Anthropic 指控阿里、Moonshot、DeepSeek 蒸馏攻击

Anthropic 周四发布一份报告,**指控阿里、Moonshot AI、DeepSeek 等中国 AI 公司对其模型发起持续蒸馏攻击**,并称这类行动近几个月随行业竞争升温而升级。报告称攻击方用更复杂的手法绕过防线,目标是 Claude 的 agentic 能力、工具使用、编码与数据分析,以及逻辑推理。

报告统计,Anthropic 共观测到**近 2 亿次与蒸馏攻击相关的对话**,归因于五个独立行动。蒸馏的做法是诱导模型吐出思维链,再用监督微调把推理能力迁移到更小的模型上——Claude 默认只显示「摘要版思考」,攻击方则找到了直接套出思考痕迹的特定手法,比如把提问包装成翻译请求。

💡 为什么值得看Anthropic 称近 2 亿次对话窃取 Claude 思维链,阿里规模最大。

查证

来源档案

TechCrunch

科技媒体对 Anthropic 官方报告的转述报道

媒体转述一手报告,报告本身由 Anthropic 单方发布,指控未经第三方独立核实,属单方说法。

延伸阅读

事件定性:这轮指控与 2 月那轮的措辞、证据强度差异 · techcrunch.com
TechCrunch 提到 Anthropic 2 月已公开点名过特定实验室,对比两轮可判断这是升级还是延续。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store