探所 Curio 再探再报 了解探所 →
#AI

Kimi K3 发布,性能超 Opus 重燃开源闭源之争

Moonshot AI 于 7 月 17 日正式发布 Kimi K3,一个 2.8 万亿参数的开放权重模型,为中国规模最大 AI 模型。官方基准显示,K3 在编程与通用 Agent 任务上超越 Claude Opus 4.8 和 GPT-5.5,虽仍略逊于 Claude Fable 5 和 GPT-5.6 Sol,但已稳定第一梯队。模型计划于 7 月 27 日开放权重,成为首个中国开放 3T 级模型。

成本方面,K3 单任务平均成本约 $0.94,为 GPT-5.6 Sol 的九成、Opus 4.8 的一半;团队仅约 300 人,依赖自研 Mooncake 训练栈与架构创新压缩算力需求。

💡 为什么值得看中国开源模型再次追近西方闭源前沿,成本仅一半,引发算力优势、出口管制与开放权重的政策辩论。

查证

来源与可信度

· Moonshot 基准、Artificial Analysis 及 Arena.ai 等评测显示,K3 性能超越 Opus 4.8 与 GPT-5.5,媒体已引用。 [2]
· 成本分析显示 $0.94/任务,长期部署性价比待验证。
· Dean Ball 与 Moorhead 的评论均为单方观点,不构成市场共识,反映 OpenAI 的战略焦虑与平衡叙事。 [2]

另有 2 个来源跟进

延伸阅读

主流财经视角 · cnbc.com 约 10 分钟
CNBC 提供华尔街分析师、企业高管多方评论,便于把握商业与政策全貌
技术深度分析 · the-decoder.com 约 15 分钟
The Decoder 详述算力优势瓦解、出口管制失效与开源政治辩论,含 SemiAnalysis 与 Google DeepMind 观点。
开发者趣闻 · simonwillison.net 约 2 分钟
Simon Willison 捕捉到 Kimi K3 拒绝泄露系统提示的片段,体现模型安全调校与人格设计
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store