探所 Curio 再探再报 了解探所 →
#AI

OpenAI 把 GPT-Live-1 开进 API,每分钟 0.05 美元

OpenAI 9 月 10 日把 **GPT-Live-1** 开放给 API 开发者 —— 就是那个两个月前先在 ChatGPT 语音里上线的全双工模型。它在一个模型里同时处理听和说,可以被随时打断、能扛背景噪声和长时间通话;遇到需要推理或调用工具的请求,它把任务交给开发者配置好的后端模型,自己继续维持对话节奏。

计费也按这个结构拆成两层:**语音前端每分钟 0.05 美元、按秒计费**,后端调用的模型和工具按各自价格另算。OpenAI 公布的搭配建议是排班、下单这类高频任务配 Luna,复杂客服配 GPT-6 Astra,代码相关对话接 Codex,第三方模型也可以挂在后面。

💡 为什么值得看语音层单模型加后端推理委托,改变了语音 agent 架构与计费,工程成本需重算。

接口、额度与尚未公开的部分

  • **接口**:模型名 gpt-live-1,走新的 Live 接口(v1/live/sessions),不走原来的 Realtime
  • **知识截止**:官方材料标注知识截止到 2025 年 7 月 31 日。
  • **并发上限**:按账户等级从 25 路到 500 路不等。
  • **音色与语种**:生成音频带 SynthID 水印;音色只有一小组可选,定制音色要找销售;
  • **测试口径**:Tau3 成绩是搭配后端 GPT-6 Astra(medium reasoning)测出的;

做中文电话客服的团队暂时没有官方语种清单可依,只能自己先跑一轮测试再决定要不要换。

查证

来源与可信度

· OpenAI 于 9 月 10 日把全双工语音模型 GPT-Live-1 开放给 API 开发者。 [1][2]
· GPT-Live-1 语音前端每分钟 0.05 美元、按秒计费,后端模型与工具按各自价格另算。 [1][2]
· GPT-Live-1 在单个模型内同时处理听与说,把推理和工具调用委托给开发者配置的后端模型。 [1][2]

延伸阅读

看官方定价与评测原文 · openai.com 10 分钟
开发前要确认的是费用结构和 Full Duplex Bench 的具体口径:官方原文给了每分钟 0.05 美元的前端价,以及相对 GPT-Realtime-2.1 提升 30 个百分点的说法,这两处是二手汇总里最容易走形的地方。
看逐项对比与客户表态 · news.cocoloop.cn 5 分钟
中文汇总把 Tau3、工具调用、轮次切换延迟逐项列了出来,并整理了 Yelp、Speak、Fin、Cognition 四家早期客户的表态,适合拿来做选型时的参照系。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store