#AI
OpenAI 发布 GPT Transcribe 语音识别系列
OpenAI 为 API 推出两款新语音识别模型: GPT Transcribe 适用于预录音频, GPT Live Transcribe 面向低延迟实时流式场景。相比一年前的 GPT-4o Transcribe,新产品在准确率和成本上同步改进。
在 AA-WER 基准测试中, GPT Transcribe 字错率为 3.31%,比前代改善 0.7 个百分点。定价下调 25% 至每分钟 $0.0045。模型支持通过文本提示词、关键词和多语言输入约束转录范围。
💡 为什么值得看字错率降至 3.31%,价格降 25%,但对手 ElevenLabs 仅 2.3%
查证
来源档案
The Decoder
德国 AI 垂直媒体,综合 OpenAI 官方公告与第三方基准评测平台 Artificial Analysis 的数据进行了报道。
有 OpenAI 官方发布事实支撑,性能数据来自独立评测机构,定价来自官方模型页面,核心信息可信。
延伸阅读
OpenAI 转录指南提供了完整提示词用法与限制,便于与十一实验室横向对比。