探所 Curio 再探再报 了解探所 →
#AI

Kimi K3 发布,基准反超 GPT-5.5

Moonshot AI 今日发布参数规模达 2.8 万亿的 Kimi K3 模型,为中国迄今最大模型。官方宣称其在编码与通用代理基准上超越 Claude Opus 4.8 与 GPT-5.5,但整体仍落后于 Claude Fable 5 和 GPT-5.6 Sol。

该模型基于自研 Mooncake 训练栈应对 GPU 短缺,推理成本约 0.94 美元/任务,略低于 Sol 的 1.04 美元,远高于早期中国开源模型,但仅为 Opus 4.8 的一半,价格优势仍在。

OpenAI 战略主管 Dean W. Ball 称模型“token 极耗”,警告开源权重模型泛滥会导致“AI 共产主义”,暗示美方将通过软性监管制造不确定性。

💡 为什么值得看中国大模型逼近 OpenAI 前沿,算力封锁效应再受质疑,出口管制与开源监管争论升温

查证

来源与可信度

· K3 模型参数 2.8 万亿,为官方公布 [2]
· 性能超越 Opus 4.8 与 GPT-5.5 来自 Moonshot 自身基准测试,独立评测待验证 [1]
· 推理成本 0.94 美元/任务来源于 Artificial Analysis 第三方估算,不代表实际使用成本 [2]
孤证 · Ball 的“AI 共产主义”论调仅 The Decoder 引述 [2]

延伸阅读

中文读者 · cnbc.com 约 8 分钟
CNBC 原文给出完整市场反应与投行观点,适合快速掌握冲击面
深度分析 · the-decoder.com 约 12 分钟
The Decoder 详细拆解算力悖论、培训与推理成本,包含多位专家对立观点
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store