#AI
月之暗面发 Kimi K3,2.8T 参数开放权重
月之暗面发布旗舰模型 Kimi K3,总参数量 2.8 万亿,支持 100 万 token 上下文,即日上线 Kimi.com 与 API。官方将其定位为「首个开放三万亿参数级模型」,对标 DeepSeek V4 Pro 的 1.6T,开放权重预计 7 月 27 日发布。
定价打破行规:输入 $3 / 输出 $15(每百万 token),与 Anthropic Claude Sonnet 5 对齐,成为迄今定价最高的中国 AI 模型。Simon Willison 实测生成 SVG 任务,消耗 95 输入 token 和 16,658 输出 token,一次简单任务成本约 25 美分,印证新定价下真实开销。
💡 为什么值得看中国 AI 实验室发布 3 万亿参数开放权重模型,定价对标 Claude Sonnet,打破低价叙事。
核心评测数据与定价对比
- **Artificial Analysis 指标**:知识工作长任务 Elo 1547(+732 vs K2.6),仅次 Fable 5;Agentic 任务 Elo 1668,胜 GLM-5.2 与 Opus 4.8;SaaS 工作流评测 53%,排名第一
- **值得警惕**:幻觉率从 K2.6 的 39% 升至 **51%**,正确率同步提升(33%→46%),即「答对更多,编造也更多」
- **定价对照**:K3 $3/$15 vs Sonnet 5 $3/$15 vs Fable 5 $10/$50 vs DeepSeek V4 Pro $0.04/任务 —— 中国模型低价时代在旗舰线正式终结
查证
来源与可信度
强
· K3 参数 2.8T、1M 上下文、定价 $3/$15,7 月 27 日开放权重。经官方与多方验证。
[2]
强
· Artificial Analysis 评测(Intelligence Index 57、任务成本 $0.94、幻觉率 51%)与 Kimi 官方 Benchmark 趋势一致,提供独立校验视角。
[1]
弱
· Arena.ai 前端编码榜单第一为瞬时排名,随时间与更多模型参评可能变化,需持续观察
[1]
另有 1 个来源跟进
延伸阅读
Simon Willison 详述 K3 推理 token 消耗、鹈鹕 Benchmark 方法论与定价体感,附完整 Benchmark 解读
The Decoder 覆盖 MoE 架构细节、Visual-in-the-Loop 闭环系统、Kimi Hosted Agent 等待名单
Simon 文末链接至 Kimi 全量自评 Benchmark 表,含 35 项测试与多模型对照