#AI
解密 AI 推理链:泄密码密钥,疑蒸馏中国模型
图宾根大学研究员 Alexander Panfilov 团队发现一种方法,可提取 OpenAI、Anthropic 和 Google 模型 API 中的加密推理痕迹。扫描约 7000 个公开会话后,找到 62 个 API 密钥、33 个密码和 33 个邮箱地址等敏感信息,且提取的 token 数与计费推理 token 数精确吻合,表明拿到了完整内部推理而非片段。
加密的思维 blob 可跨模型移植:Anthropic 的 Haiku 4.5 能读出 Opus 4.8 的原始推理,OpenAI 与 Gemini 同样受影响。成本较低,解码 1 万条痕迹估算约 $720。
💡 为什么值得看公开会话扫描泄出数十个 API 密钥,Kimi K3 输出与 GPT、Claude 高度相似。
查证
来源与可信度
强
· 加密推理痕迹可被提取并在同厂商模型间移植,提取 token 数与计费 token 数一致,可覆盖完整内部推理。
[2]
强
· 公开会话扫描发现了 API 密钥、密码等真实凭证,厂商已修补该侧信道。
[2]
弱
· Kimi K3 输出与 GPT、Claude 高度相似,记忆化分析提示蒸馏迹象,但未证实因果。
另有 1 个来源跟进
延伸阅读
直接引用研究者与厂商回应,含蒸馏、安全泄露的量化数字
给出攻击步骤、模型行为案例(逆向解答、循环术语、scheming 场景)与攻击成本