探所 Curio 再探再报 了解探所 →
#AI

GPT-5.6 发布三档新模型,定价与 Fable 5 正面交锋

7 月 9 日,OpenAI 正式上线 GPT-5.6 系列,包含 Sol(旗舰)、Terra(均衡)和 Luna(轻量)三档模型,均标配 100 万 token 上下文窗口和 128k 最大输出。

核心看点是 OpenAI 对 Claude 系列发起效率对标。Agents’ Last Exam 中,Sol 以 53.6 分领先 Fable 5 达 13.1 分,中等推理强度下优势保持 11.4 分,成本仅约四分之一。Terra 和 Luna 分别以约十六分之一的成本反超 Fable 5。但 Fable 5 在 SWE-Bench Pro 上以 80% 对 64.6% 大幅领先 Sol,OpenAI 随即指该基准约 30% 的题目存在缺陷。

💡 为什么值得看OpenAI 最便宜档位以十六分之一成本反超 Fable 5,挑战 Anthropic 定价模型。

查证

来源与可信度

· OpenAI 公告与独立评测确认 GPT-5.6 三档定价、基准成绩及发布时间。 [2]
· Fable 5 在 SWE-Bench Pro 上领先 Sol,Simon Willison 与量子位报道一致,但量子位未提 OpenAI 对基准缺陷的质疑。 [2]
· 单一评测者主观判断 Sol 未超越 Fable 5 编码表现,需更多第三方测试验证。 [1]

延伸阅读

只读一篇 · simonwillison.net 约 10 分钟
Simon Willison 全文逐项拆解了定价、基准造假争议和新 API 能力,是理解此次发布技术细节的最佳入口
中文读者 · qbitai.com 约 5 分钟
量子位提供了社区反应和 Anthropic 重置额度的竞争侧写,弥补了英文原文缺少的市场博弈视角
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store