#AI
Meta 发布 Muse Voice 实时转写模型
Meta 的 Superintelligence Labs 发布了首个实时音频感知模型 **Muse Voice Transcribe**,把语音转写、说话人区分、句边界检测集成进同一个模型,无需额外系统。
模型以 **80 毫秒**切块处理音频,每处理一块决定继续听还是输出下一词;等待越久准确率越高但延迟越大,Meta 用强化学习训练出按难度动态调整的策略——简单词快速出,难词多听一会。
💡 为什么值得看Meta 以 $0.18/小时入场,压低实时转写价格,冲击竞品市场。
查证
来源档案
The Decoder
AI 行业报道媒体,综合 Meta 官方公告与 Artificial Analysis 独立评测撰写
单源报道,数据与评测引用均有出处,但未提供 Meta 官方公告原文链接直接核验;模型命名与细节描述具体,可信度中等偏上
延伸阅读
Meta 以 $0.18/小时入场,直接压低实时转写市场均价,可对比 OpenAI GPT-Realtime-Whisper 七月降价的跟进节奏
Meta 明确这是个人 AI agent 监听现实对话的基础组件,配合其相机眼镜产品线,值得看其与德国监管讨论的关联