#AI
GPT-5.6 发布三档新模型,定价与 Fable 5 正面交锋
7 月 9 日,OpenAI 正式上线 GPT-5.6 系列,包含 Sol(旗舰)、Terra(均衡)和 Luna(轻量)三档模型,均标配 100 万 token 上下文窗口和 128k 最大输出。
核心看点是 OpenAI 对 Claude 系列发起效率对标。Agents’ Last Exam 中,Sol 以 53.6 分领先 Fable 5 达 13.1 分,中等推理强度下优势保持 11.4 分,成本仅约四分之一。Terra 和 Luna 分别以约十六分之一的成本反超 Fable 5。但 Fable 5 在 SWE-Bench Pro 上以 80% 对 64.6% 大幅领先 Sol,OpenAI 随即指该基准约 30% 的题目存在缺陷。
💡 为什么值得看OpenAI 最便宜档位以十六分之一成本反超 Fable 5,挑战 Anthropic 定价模型。
查证
来源与可信度
强
· OpenAI 公告与独立评测确认 GPT-5.6 三档定价、基准成绩及发布时间。
[2]
强
· Fable 5 在 SWE-Bench Pro 上领先 Sol,Simon Willison 与量子位报道一致,但量子位未提 OpenAI 对基准缺陷的质疑。
[2]
弱
· 单一评测者主观判断 Sol 未超越 Fable 5 编码表现,需更多第三方测试验证。
[1]
延伸阅读
Simon Willison 全文逐项拆解了定价、基准造假争议和新 API 能力,是理解此次发布技术细节的最佳入口
量子位提供了社区反应和 Anthropic 重置额度的竞争侧写,弥补了英文原文缺少的市场博弈视角