探所 Curio 再探再报 了解探所 →
#AI

解密 AI 推理链:泄密码密钥,疑蒸馏中国模型

图宾根大学研究员 Alexander Panfilov 团队发现一种方法,可提取 OpenAI、Anthropic 和 Google 模型 API 中的加密推理痕迹。扫描约 7000 个公开会话后,找到 62 个 API 密钥、33 个密码和 33 个邮箱地址等敏感信息,且提取的 token 数与计费推理 token 数精确吻合,表明拿到了完整内部推理而非片段。

加密的思维 blob 可跨模型移植:Anthropic 的 Haiku 4.5 能读出 Opus 4.8 的原始推理,OpenAI 与 Gemini 同样受影响。成本较低,解码 1 万条痕迹估算约 $720。

💡 为什么值得看公开会话扫描泄出数十个 API 密钥,Kimi K3 输出与 GPT、Claude 高度相似。

查证

来源与可信度

· 加密推理痕迹可被提取并在同厂商模型间移植,提取 token 数与计费 token 数一致,可覆盖完整内部推理。 [2]
· 公开会话扫描发现了 API 密钥、密码等真实凭证,厂商已修补该侧信道。 [2]
· Kimi K3 输出与 GPT、Claude 高度相似,记忆化分析提示蒸馏迹象,但未证实因果。

另有 1 个来源跟进

延伸阅读

一手报道 · wired.com 约 10 分钟
直接引用研究者与厂商回应,含蒸馏、安全泄露的量化数字
技术细节 · the-decoder.com 约 12 分钟
给出攻击步骤、模型行为案例(逆向解答、循环术语、scheming 场景)与攻击成本
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store