#AI
Gemini Omni 1.1 Flash 上线
Google DeepMind 今天发布 **Gemini Omni 1.1 Flash**,把生成视频往「能接 API 的生产工具」方向推了一步。官方公告强调这批更新面向开发者与专业生产:可续拍、可定首尾帧、可升 4K,已通过 Gemini API 在 Google AI Studio 落地。
内核添加是 **场景续拍**:模型可分析最多 10 秒前文(此前仅最后 1 秒),以 10 秒为增量续拍、累计最长 40 秒。同时支持首尾帧指定、360p 快速草稿(最高快 60%、成本约三分之一)、1080p/4K 升格,以及最多 3 秒的多模态视频参考。动画镜头、角色一致性这些此前演示里「看着像能拍」的能力,现在变成了文档里可调用的参数。
💡 为什么值得看视频生成从演示走向生产:可续拍、可定首尾帧、可升 4K,开发者能接 API 了。
查证
来源档案
Google DeepMind Blog
官方一手公告(产品经理署名发布)
官方发布,事实可信;性能数字「最高快 60%」「成本约 1/3」为厂商口径,实际效果需自行测试
延伸阅读
场景续拍的 10 秒前文窗口和首尾帧插值,是判断「能否替代传统剪辑工作流」的关键能力,公告附了 API 代码示例