特辑
前沿模型竞赛特辑:Fable 5 认怂入池 × Kimi K3 开源 × OpenAI 出评分卡
本周前沿模型战局出现结构性转折。月之暗面发布 2.8 万亿参数开源模型 Kimi K3,在 Code Arena 上直接超过 Claude Fable 5 和 GPT-5.6,API 价格不到 Fable 5 的三分之一。压力之下,Anthropic 紧急撤回 Fable 5 的订阅下架计划,宣布从 7 月 20 日起永久留在 Max/Team Premium 计划。OpenAI 同日推出 AI ROI 评分卡「Useful Intelligence per Dollar」,试图用指标框架锁定企业采购话语权。PPIO 则从算力侧揭示了一个底层逻辑:中国日均 Token 调用量两年增长 1000 倍,推理正在取代训练成为主引擎。
Kimi K3 开源发布:2.8 万亿参数,Code Arena 登顶
①
参数规模
总参 2.8 万亿,KDA 混合线性注意力,全球首个开源 3 万亿级模型,原生支持视觉理解与 100 万 Token 上下文。
②
性能表现
在 Code Arena 超越 Claude Fable 5 与 GPT-5.6 Sol。API 价格仅 Fable 5 的三分之一:缓存命中 2 元,标准输入 20 元,输出 100 元。
③
自主芯片验证
K3 用开源 EDA 工具,在 48 小时内设计并验证了 Nano 芯片,验证了长程 Agent 能力。
Claude Fable 5 从下架到永久入池:Anthropic 三次延期的认怂路线
①
决策反转
Anthropic 原计划 7 月 7 日将 Fable 5 从订阅计划下架,仅保留 API 付费通道,遭用户强烈反弹后两度延期。
②
最终方案
7 月 20 日起,Fable 5 永久纳入 Max 和 Team Premium 计划,额度为标准 50%。Pro 用户获一次性$100 补偿后按 API 计费。
③
竞争压力
Simon Willison 及业内分析认为,GPT-5.6 Sol 定价战与 Kimi K3 发布是 Anthropic 认怂的关键推手。
OpenAI 推 AI ROI 评分卡:用「有用智能每美元」抢企业话语权
①
核心框架
OpenAI CFO 发布「Useful Intelligence per Dollar」评分卡,含四项指标:有用工作量、单次成功任务成本、可靠性、规模回报。
②
定价逻辑
强调最低 Token 单价不等于最低单次成功成本,旗舰模型 Sol 一次通过可能比 Luna 多次重试更便宜。
③
战略信号
在 Fable 5 和 Kimi K3 价格夹击下,OpenAI 试图用可量化的企业 ROI 框架锁定采购决策话语权。
PPIO Token 工厂:日均 1.2 万亿 Token 的推理基建新范式
①
Token 爆发
中国日均 Token 调用量已突破 140 万亿(两年增 1000 倍),推理正取代训练成为算力消耗主引擎。
②
智能 Token 工厂
PPIO 推出智能模型网关,通过混合模型(2-3 款模型互相 PK)在某些任务上已超越 GPT-5.6 的单模型性能。
③
Agent 优先架构
Agent 生产力 = Token 智能密度 × Agent Loop 时长。云的第一用户正从人转向 AI Agent。