#AI
GPT-5.6 Sol 推 Ultrafast,14 倍提速
OpenAI 在 8 月 13 日预览了 **Ultrafast** 模式,给 GPT-5.6 Sol 增加一个新 API 服务档位,底层推理由 **Cerebras** 提供。官方给的数字是**最高 750 output token/秒,比标准处理快至 14 倍**。
这次先向一小批客户开放限量预览,后续再扩大范围。Cerebras 方面强调速度提升不带来质量折损,智能水平与标准档一致。对 agent 类工作负载来说,这个吞吐量意味着「等模型回话」这一瓶颈开始松动。
💡 为什么值得看前沿模型由 Cerebras 芯片承接推理,把 750 token/秒的速度与旗舰智能绑在一起。
查证
来源档案
OpenAI 官方博客
OpenAI 官网一手公告,宣布新 API 档位的预览
接近确认档——官方一手源直接发布产品信息,数字为官方口径;但「无质量折损」为合作方 Cerebras 主张,具体评测数据见 Cerebras 官方博客
延伸阅读
Cerebras 博客给出了 HLE 评测对比(11 小时对 78 小时)和与其他模型的相对速度,想核实「无质量折损」该看这里