探所 Curio 再探再报 了解探所 →
#AI

视频生成模型困于固定视角,缺三维自由度

当前视频生成模型虽然能根据提示词生成角色、动作和镜头,也支持图像续动生成以及姿态、轨迹等可控编辑,但输出仍被锁死在**固定视角的二维视频**上。模型缺乏三维空间自由度:无法绕物体旋转观察,也不能任意调整视角。

这带来的实际限制是,生成结果难以直接导入游戏引擎、机器人仿真或 VR/AR 系统,**交互式三维场景基本用不上**。源材料只给出这一判断,未展开具体的技术方案或实验数据。

💡 为什么值得看交互式三维场景无法使用视频模型输出,因无绕视与导入能力。

查证

来源档案

BAAI 链接聚合(link.baai.ac.cn)

北京智源人工智能研究院的链接聚合平台,转发一篇观点性内容,非官方一手研究发布

作为单一来源,仅能支撑「存在这一观点」的判断,不构成对行业全貌的实证结论

延伸阅读

三维空间自由度缺口的完整论述 · link.baai.ac.cn
源材料对「无法绕物体旋转观察、不能任意调整视角」的逐条受限描述,值得想看问题全貌的读者打开原文核对
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store