探所 Curio 再探再报 了解探所 →
#AI 3D 模型与游戏技术

World Labs 发布 Atlas 全模态世界模型

World Labs 发布下一代世界模型 Atlas,定位「全模态世界模型」。它从零预训练,原生处理文本、图像、视频和 3D,采用多模态自回归扩散 transformer 架构:所有输入被锚定到 3D 空间中的位置,形成「空间上下文」,模型据此生成后续内容。

技术上最关键的是显式 3D 输出。Atlas 原生同时处理 2D 图像帧和 3D 深度图,可直接输出点云或 3D Gaussian splats,与 Marble 表示一致,将自然接入 World Labs 现有产品线,并驱动未来版本的 Marble 及其他产品。

💡 为什么值得看Atlas 从零预训练,原生吃文本、图像、视频与 3D,直接输出点云和高斯泼溅,将驱动 Marble 下一代。

Atlas 的三类能力与关键参数

**相机控制生成**

  • 输入 1 到 6 张参考图 + 手动设计相机路径
  • 输出最长 1 分钟、1440p 视频,原生接收精确相机几何而非粗粒度文本指令

**空间重建**

  • 2 到 3 张图即可忠实重建,官方称超过专做 3D 重建的 SOTA 模型
  • 空间上下文可容纳上百张输入图
  • 原生输出点云与 3D Gaussian splats,缺相机视野的区域由模型补全

**时空模拟**

查证

来源档案

World Labs 官方博客

World Labs 团队发布 Atlas 的一手官方公告,含架构说明、能力清单与演示案例。

官方一手源,能力描述与参数为公司口径,尚无第三方复现或独立评测验证;更完整的架构细节原文给出但本文截断。

延伸阅读

只读一篇 · worldlabs.ai 约 10 分钟
原文含大量可交互演示与相机路径示例,能直观看出重建与生成的真实差距
换个视角 · worldlabs.ai 约 5 分钟
对照 Marble 与 Atlas 的表示是否一致,判断 World Labs 的产品迭代节奏
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store