探所 Curio 再探再报 了解探所 →
#AI

GPT-5.6 Sol 推 Ultrafast,14 倍提速

OpenAI 在 8 月 13 日预览了 **Ultrafast** 模式,给 GPT-5.6 Sol 增加一个新 API 服务档位,底层推理由 **Cerebras** 提供。官方给的数字是**最高 750 output token/秒,比标准处理快至 14 倍**。

这次先向一小批客户开放限量预览,后续再扩大范围。Cerebras 方面强调速度提升不带来质量折损,智能水平与标准档一致。对 agent 类工作负载来说,这个吞吐量意味着「等模型回话」这一瓶颈开始松动。

💡 为什么值得看前沿模型由 Cerebras 芯片承接推理,把 750 token/秒的速度与旗舰智能绑在一起。

查证

来源档案

OpenAI 官方博客

OpenAI 官网一手公告,宣布新 API 档位的预览

接近确认档——官方一手源直接发布产品信息,数字为官方口径;但「无质量折损」为合作方 Cerebras 主张,具体评测数据见 Cerebras 官方博客

延伸阅读

Cerebras 官方基准 · openai.com 约 6 分钟
Cerebras 博客给出了 HLE 评测对比(11 小时对 78 小时)和与其他模型的相对速度,想核实「无质量折损」该看这里
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store