探所 Curio 再探再报 了解探所 →
#AI

月之暗面发 Kimi K3,2.8T 参数开放权重

月之暗面发布旗舰模型 Kimi K3,总参数量 2.8 万亿,支持 100 万 token 上下文,即日上线 Kimi.com 与 API。官方将其定位为「首个开放三万亿参数级模型」,对标 DeepSeek V4 Pro 的 1.6T,开放权重预计 7 月 27 日发布。

定价打破行规:输入 $3 / 输出 $15(每百万 token),与 Anthropic Claude Sonnet 5 对齐,成为迄今定价最高的中国 AI 模型。Simon Willison 实测生成 SVG 任务,消耗 95 输入 token 和 16,658 输出 token,一次简单任务成本约 25 美分,印证新定价下真实开销。

💡 为什么值得看中国 AI 实验室发布 3 万亿参数开放权重模型,定价对标 Claude Sonnet,打破低价叙事。

核心评测数据与定价对比

  • **Artificial Analysis 指标**:知识工作长任务 Elo 1547(+732 vs K2.6),仅次 Fable 5;Agentic 任务 Elo 1668,胜 GLM-5.2 与 Opus 4.8;SaaS 工作流评测 53%,排名第一
  • **值得警惕**:幻觉率从 K2.6 的 39% 升至 **51%**,正确率同步提升(33%→46%),即「答对更多,编造也更多」
  • **定价对照**:K3 $3/$15 vs Sonnet 5 $3/$15 vs Fable 5 $10/$50 vs DeepSeek V4 Pro $0.04/任务 —— 中国模型低价时代在旗舰线正式终结

查证

来源与可信度

· K3 参数 2.8T、1M 上下文、定价 $3/$15,7 月 27 日开放权重。经官方与多方验证。 [2]
· Artificial Analysis 评测(Intelligence Index 57、任务成本 $0.94、幻觉率 51%)与 Kimi 官方 Benchmark 趋势一致,提供独立校验视角。 [1]
· Arena.ai 前端编码榜单第一为瞬时排名,随时间与更多模型参评可能变化,需持续观察 [1]

另有 1 个来源跟进

延伸阅读

最完整的独立实测 · simonwillison.net 约 12 分钟
Simon Willison 详述 K3 推理 token 消耗、鹈鹕 Benchmark 方法论与定价体感,附完整 Benchmark 解读
技术架构与商业化全景 · the-decoder.com 约 10 分钟
The Decoder 覆盖 MoE 架构细节、Visual-in-the-Loop 闭环系统、Kimi Hosted Agent 等待名单
移除原表,保留结论。 · simonwillison.net 约 5 分钟
Simon 文末链接至 Kimi 全量自评 Benchmark 表,含 35 项测试与多模型对照
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store