World Labs Atlas

# World Labs Atlas - 多模态世界模型 ## 产品简介 Atlas 是由李飞飞联合创立的人工智能公司

LLM大模型 部分免费

World Labs Atlas - 多模态世界模型

产品简介

Atlas 是由李飞飞联合创立的人工智能公司 World Labs 于 2026 年 9 月 1 日发布的全球首个多模态世界模型。作为一款从零开始预训练的 omni 模型,Atlas 原生支持文本、图像、视频、相机位姿与 3D 深度五类输入,能够在统一的空间上下文中完成世界生成、空间重建和时空模拟三大任务。李飞飞将 Atlas 定位为空间智能的核心基础设施,目标是让 AI 真正理解并建模三维物理世界。

核心功能

  • 相机控制生成:仅需 1~6 张参考图像,即可生成最长 1 分钟、1440p 分辨率的连续视频,支持像素级相机轨迹控制
  • 空间重建:基于 1 张到数十张输入图像,重建现实场景并输出点云、3D 高斯泼溅等显式 3D 表示
  • 时空模拟:输入视频即可转换观察视角,支持机器人 Real-to-Sim 工作流,用于训练数据生成
  • 文本生图:根据文本提示生成图像和 360 度全景图,支持复杂提示词和多种视觉风格
  • 跨视角合成:将两张无关图像放入共享三维空间,生成两者之间的平滑过渡世界
  • 稀疏视角 3D 重建:仅需 2~25 张普通游客照即可重建斯坦福主方庭等复杂场景

特色优势

  • 原生多模态架构:采用多模态自回归扩散 Transformer,所有输入统一锚定在三维空间上下文中
  • 超越专业模型:稀疏视角 3D 重建在 DTU、ETH3D、ScanNet 数据集上误差分数达 25.3‰,优于 Pi3X(28.7)和 Depth Anything 3(39.3)
  • 生成质量领先:相机控制生成任务中,Atlas 面对 MiniMax H3 胜率 75%、Gemini Omni Flash 胜率 81%、FLUX 3 胜率 93%
  • 可扩展性:性能随训练算力增长而提升,官方预计这一趋势将持续
  • 应用导向:已与部分早期合作伙伴推进落地,未来将作为 Marble 等产品的底层模型

应用场景

  • 影视与视觉特效:用少量照片还原完整 3D 场景,大幅降低特效制作成本
  • 机器人训练仿真:将真实场景快速转化为仿真环境,解决机器人训练数据不足问题
  • 建筑与室内设计:从多角度照片生成逼真设计方案和空间漫游
  • 游戏与虚拟现实:根据真实世界图像生成可交互的虚拟环境
  • 电子商务:从产品图像生成多角度展示和沉浸式购物体验
  • 文化遗产保护:对文物和历史建筑进行数字化 3D 重建

适用人群

  • AI 研究人员与机器人工程师
  • 影视特效团队与游戏开发者
  • 建筑师与室内设计师
  • 自动驾驶与具身智能开发者
  • 元宇宙与虚拟现实内容创作者

出品方

公司名称:World Labs,总部美国旧金山,创始人李飞飞(斯坦福 AI 实验室前主任),2026 年 2 月获 10 亿美元融资

更新动态

2026 年 9 月 1 日 Atlas 正式发布,向部分早期合作伙伴开放内测

官网链接

https://www.worldlabs.ai

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论