探所 Curio 再探再报 了解探所 →
#AI

小米 MiMo-V2.6-Pro 登顶开源榜,Anthropic 指其蒸馏 Claude

小米发布 MiMo-V2.6 系列,旗舰 MiMo-V2.6-Pro 在 Artificial Analysis 智能指数得 46 分,为该口径下最强公开可用模型,领先 Kimi K3、Qwen。其每百万 token 输入 $0.435、输出 $0.87,单任务约 $0.13。

小米称提升来自扩展强化学习,Pro 训练不到 6 天、花费约 262 万美元,DeepSWE 分从 58.4 升到 72.6,并开源 RL 工具链。Anthropic 威胁情报报告则称,20 天内记录了超 40 万次对话,指小米借此把 MiMo 用户会话转给 Claude 提取训练数据。

💡 为什么值得看小米低成本开源模型登顶并压价,遭 Anthropic 点名蒸馏。

查证

来源档案

The Decoder

AI 领域科技媒体,本篇为综合报道,转述小米官方发布口径与 Artificial Analysis 评测数据,并引述 Anthropic 威胁情报报告。

单源媒体,性能与价格数字来自小米和 Artificial Analysis 口径,未经第二家独立核实;蒸馏指控出自 Anthropic 报告,按线索档对待。

延伸阅读

训练成本结构 · the-decoder.com
262 万美元、不到 6 天的 RL 跑出榜单首位,值得对照各家开源模型的实际训练开销。
蒸馏指控的证据链 · the-decoder.com
Anthropic 报告只给了流量记录,未说明小米更早的教师模型数据来源,这一缺口是关键。
开源 RL 工具链 · the-decoder.com
7000 个带自动评分器的任务对想自建 RL 后训练的团队有直接参考价值。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中