#AI 3D 模型与游戏技术
World Labs 发布 Atlas 全模态世界模型
World Labs 发布下一代世界模型 Atlas,定位「全模态世界模型」。它从零预训练,原生处理文本、图像、视频和 3D,采用多模态自回归扩散 transformer 架构:所有输入被锚定到 3D 空间中的位置,形成「空间上下文」,模型据此生成后续内容。
技术上最关键的是显式 3D 输出。Atlas 原生同时处理 2D 图像帧和 3D 深度图,可直接输出点云或 3D Gaussian splats,与 Marble 表示一致,将自然接入 World Labs 现有产品线,并驱动未来版本的 Marble 及其他产品。
💡 为什么值得看Atlas 从零预训练,原生吃文本、图像、视频与 3D,直接输出点云和高斯泼溅,将驱动 Marble 下一代。
Atlas 的三类能力与关键参数
**相机控制生成**
- 输入 1 到 6 张参考图 + 手动设计相机路径
- 输出最长 1 分钟、1440p 视频,原生接收精确相机几何而非粗粒度文本指令
**空间重建**
- 2 到 3 张图即可忠实重建,官方称超过专做 3D 重建的 SOTA 模型
- 空间上下文可容纳上百张输入图
- 原生输出点云与 3D Gaussian splats,缺相机视野的区域由模型补全
**时空模拟**
查证
来源档案
World Labs 官方博客
World Labs 团队发布 Atlas 的一手官方公告,含架构说明、能力清单与演示案例。
官方一手源,能力描述与参数为公司口径,尚无第三方复现或独立评测验证;更完整的架构细节原文给出但本文截断。
延伸阅读
原文含大量可交互演示与相机路径示例,能直观看出重建与生成的真实差距
对照 Marble 与 Atlas 的表示是否一致,判断 World Labs 的产品迭代节奏