#AI
小米 MiMo-V2.6-Pro 登顶开源榜,Anthropic 指其蒸馏 Claude
小米发布 MiMo-V2.6 系列,旗舰 MiMo-V2.6-Pro 在 Artificial Analysis 智能指数得 46 分,为该口径下最强公开可用模型,领先 Kimi K3、Qwen。其每百万 token 输入 $0.435、输出 $0.87,单任务约 $0.13。
小米称提升来自扩展强化学习,Pro 训练不到 6 天、花费约 262 万美元,DeepSWE 分从 58.4 升到 72.6,并开源 RL 工具链。Anthropic 威胁情报报告则称,20 天内记录了超 40 万次对话,指小米借此把 MiMo 用户会话转给 Claude 提取训练数据。
💡 为什么值得看小米低成本开源模型登顶并压价,遭 Anthropic 点名蒸馏。
查证
来源档案
The Decoder
AI 领域科技媒体,本篇为综合报道,转述小米官方发布口径与 Artificial Analysis 评测数据,并引述 Anthropic 威胁情报报告。
单源媒体,性能与价格数字来自小米和 Artificial Analysis 口径,未经第二家独立核实;蒸馏指控出自 Anthropic 报告,按线索档对待。
延伸阅读
262 万美元、不到 6 天的 RL 跑出榜单首位,值得对照各家开源模型的实际训练开销。
Anthropic 报告只给了流量记录,未说明小米更早的教师模型数据来源,这一缺口是关键。
7000 个带自动评分器的任务对想自建 RL 后训练的团队有直接参考价值。