#商业
xAI 为 Imagine Video 1.5 加上参考图与语音
xAI 给旗下视频模型 grok-imagine-video-1.5 补上了参考能力:现在可以传入图像和语音作为参考,**同一个角色的人脸与嗓音能在不同镜头里保持一致**,也可以只用一段文字提示直接生成视频,不再需要先给一张起始图。官方同时把原生 1080p 加入文本生成视频和图像生成视频两条路径。
多参考是这次最实用的部分:每张参考图各锁一件事(人脸、产品或地点),**单次生成最多挂 7 个参考**,可以保留角色换场景、保留场景换角色,或两者都留只改动作。上线节奏上,图像参考与语音参考先对美国 SuperGrok Heavy 和 SuperGrok Plus 开放,数日内铺开到其余档位;文本生成视频与原生 1080p 已经普遍可用,而想在 API 里用语音参考仍需单独申请。
💡 为什么值得看同一模型锁定人脸嗓音、支持 7 个参考图、原生 1080p。
查证
来源档案
x.ai(官方公告)
xAI 官方产品公告页,面向用户的更新说明,含功能列表与上线范围
官方一手,功能与档位 / 平台范围描述可直接采信;但公告只给能力与可用性,未公布任何画质 / 一致性评测数据或第三方对比。
延伸阅读
公告把文本生成视频、原生 1080p、图像 / 语音参考的可用平台与档位写得最清楚,想确认自己所在地区与订阅档位能否用到,看这一页就够。