World Labs Atlas

Atlas 是由李飞飞创立的 World Labs 于 2026 年 9 月 1 日发布的全新空间智能世界模型

LLM大模型 部分免费

Atlas 是由李飞飞创立的 World Labs 于 2026 年 9 月 1 日发布的全新空间智能世界模型。这是一款全模态(omni)基础模型,从零开始预训练,原生支持文本、图像、视频和 3D 四种模态的输入与生成。Atlas 采用多模态自回归扩散 Transformer 架构,将所有输入融合到统一的空间上下文中,实现对 3D 场景的一致性理解与外推生成,被视为 AI 从语言理解向物理世界建模跨越的关键里程碑。

核心功能

Atlas 提供四大核心能力:相机可控生成(Camera-Controlled Generation)——用户可通过 1 至 6 张参考图生成 1440p 分辨率、最长 1 分钟的视频,并精确控制相机位姿;空间重建(Spatial Reconstruction)——仅凭一张到数十张输入图像即可重建真实 3D 场景,性能超越当前专用 3D 重建模型;时空仿真(Space-Time Simulation)——支持视频重定向和 Real-to-Sim 工作流,可用于机器人策略训练;图像生成——支持文本生成图像、360 度全景及复杂文本渲染。

特色优势

Atlas 的核心优势在于其全模态原生设计——不同于在既有语言模型上外挂多模态模块的方案,Atlas 从预训练阶段就将四模态统一建模,能够深度理解空间关系而非简单拼接不同模型的输出。在 3D 一致性和相机可控性上实现突破,可生成在几何和光照上完全一致的视频序列。其 scaling 特性尤为突出:随训练算力增加性能持续提升,表明这是一个真正可扩展的空间智能基础模型。

应用场景

  • 电影动画与游戏开发:相机可控的 3D 视频生成大幅降低 3D 内容创作门槛
  • 虚拟现实与沉浸式体验:空间一致的场景重建与生成驱动 VR 内容生产
  • 机器人仿真训练:Real-to-Sim 工作流让机器人可以在仿真环境中高效学习真实世界物理规律
  • 建筑与室内设计:从单张图像快速生成可交互的 3D 空间
  • 具身智能研究:为自动驾驶、机器人操作等需要空间推理的 AI 系统提供训练数据

适用人群

3D 内容创作者、游戏和影视工作室、机器人研究人员、计算机视觉工程师,以及空间智能领域的研究者和开发者。

出品方背景

World Labs 由斯坦福大学 AI 教母李飞飞于 2023 年联合创立,最新估值约 50 亿美元,累计融资 12.3 亿美元,投资方包括 Autodesk(领投 2 亿美元)、AMD、NVIDIA、Fidelity、Andreessen Horowitz 等顶级机构。Atlas 将驱动 World Labs 旗下 Marble 产品的后续版本及其他空间智能产品。

官网链接

https://www.worldlabs.ai

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论