探所 Curio 再探再报 了解探所 →
#AI

Google 给 Gemini 3.8 Live 加上实时虚拟形象

Google 于 9 月 24 日发布 Gemini 3.8 Live with Live Avatar,把低延迟流式视频生成接到实时对话模型,即日起在 Gemini Enterprise 上线,面向客服等企业场景。

Live Avatar 可一边对话一边后台调用工具,口型表情随语音适配,支持 97 种语言;企业可由参考图生成自定义形象,仅限白名单,输出嵌入 SynthID 水印。

💡 为什么值得看实时对话加低延迟视频形象,企业客服与导览最直接受益,定制形象仍需白名单。

查证

来源档案

Google 官方博客

厂商官方产品发布博客,由 Gemini Audio Team 的研究科学家与工程师署名。

功能范围、语言数量、白名单限制、SynthID 水印均属官方一手口径,可按已发生处理。博客只给了演示描述,没有延迟、并发或定价等可量化指标。

延伸阅读

异步工具调用演示 · deepmind.google 3 分钟
酒店入住那段演示展示了对话与后台工具调用并行,是判断 agent 可用性的关键细节。
定制形象的开放条件 · deepmind.google 5 分钟
自定义 avatar 目前只走企业白名单,想用它做品牌形象的需要先弄清申请路径与模型卡中的身份保护条款。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中