Atlas by World Labs favicon

Atlas by World Labs

World Labs 推出的 Atlas 是一款专为空间智能设计的全能世界模型,能够通过文本、图像和视频等多模态输入,生成、重建并模拟 3D 环境。

动画和 3D 建模生成长达 1 分钟、分辨率达 1440p 的视频从稀疏的输入图像中重建 3D 场景为机器人和视觉特效应用模拟空间与时间根据文本或图像提示生成 360 度全景图
Atlas by World Labs product interface screenshot
预计月访问量
27.4万
数据月份:
收录于 AIToolly

Atlas by World Labs 是什么?产品概览

产品用途与官方定位

Atlas 是由 World Labs 开发的多模态自回归扩散 Transformer 模型。它旨在理解世界的表现、行为和演变,使用户能够生成一致的 3D 内容并模拟真实世界环境。

该模型通过将输入锚定在 3D 空间中来整合空间上下文,从而实现精确的摄像机控制和新视角的合成。其设计旨在随训练计算量的增加而扩展,为创意、机器人和模拟工作流提供高保真输出。

Atlas by World Labs 可以用来做什么?

有官方来源支持的使用场景

机器人模拟

通过重建物理空间并生成传感器数据(如 RGB 和深度),实现“从现实到模拟”的工作流,用于训练和测试机器人的导航与操作。

视觉特效与内容创作

允许创作者从多个角度重新构图视频、冻结时间,并利用精确的摄像机路径生成一致的长篇视频内容。

空间智能架构

Atlas 与标准的 LLM 和视频模型架构不同,采用了多模态自回归扩散 Transformer。这种设计将空间控制视为核心组件,通过显式的摄像机位姿和 3D 位置来限定所有输入和输出。

  • 对文本、图像、视频和深度图进行多模态处理。
  • 自回归生成,输出受前序序列元素的约束。
  • 基于扩散的去噪,用于对高维连续数据建模。
  • 针对现代硬件加速优化的 Transformer 骨干网络。

选择 Atlas by World Labs 前需要测试什么

用自己的素材和工作流完成验证

  • 验证特定重建或生成任务所需的输入图像数量,以确保最佳的场景忠实度。
  • 检查摄像机几何要求,确认与模型原生输入格式的兼容性,以实现精确的运动控制。

Atlas by World Labs 来源与核对时间

核对了哪些信息以及核对时间

最后核对

Atlas by World Labs 常见问题

基于已核对产品资料的回答

Atlas 可以处理哪些类型的数据?

Atlas 是一款多模态模型,原生支持文本、图像、视频、3D 深度图和摄像机位姿,从而形成一个共享的空间上下文。

Atlas 进行 3D 重建是否需要专业设备?

不需要,Atlas 可以仅凭一张到几十张普通的图像重建现实世界的空间,从而消除了对密集采集设备的需求。

Atlas 如何处理摄像机控制?

Atlas 将精确的摄像机几何结构作为原生输入类型,允许用户指定确切的摄像机位置和角度,而不是依赖模糊的文本指令。

Atlas 能否生成用于其他应用程序的 3D 资产?

可以,该模型可以输出显式的 3D 表示,包括点云和 3D 高斯泼溅,这些资产非常适合机器人、游戏和设计工作流。

Atlas 是否能够模拟机器人环境?

是的,Atlas 支持“从现实到模拟”的工作流,通过重建环境并生成机器人传感器在导航或操作过程中会观察到的 RGB 和深度数据。

继续查看同一分类中近期收录的其他工具。