# 李飞飞World Labs发布Atlas多模态世界模型
时间:2026-09-02
地点:美国 旧金山 / 中国 北京
人物:李飞飞(AI教母、World Labs创始人)、Jim Fan(英伟达机器人主管)、Justin Johnson、Christoph Lassner、Ben Mildenhall(联合创始人)
事件详情:2026年9月2日,李飞飞联合创立的AI创企World Labs正式发布"全球首个多模态世界模型"——Atlas。Atlas是一款面向空间智能的全模态模型,从零开始预训练,可原生处理文本、图像、视频、相机位姿与3D深度信息,并在同一套模型中完成世界生成、空间重建和时空模拟。Atlas的核心创新在于"空间上下文"机制:将每一张输入图像与对应相机位置绑定,放入共享的三维空间,使其摆脱对自然语言运镜描述的依赖。用户只需1到6张图片,即可让Atlas按指定镜头轨迹生成最长达1分钟、1440p分辨率的视频;在稀疏视角下也能还原3D场景,仅凭2到25张斯坦福游客照就能重建主方庭细节,并在DTU等数据集上以25.3‰的误差优于多个专用3D重建模型。
背景:World Labs由李飞飞与Justin Johnson、Christoph Lassner、Ben Mildenhall于2024年共同创立,截至目前累计融资12.3亿美元,2026年2月完成10亿美元新融资,估值达50亿美元,投资方包括Autodesk(2亿)、AMD、英伟达、Fidelity、Andreessen Horowitz。此前公司已推出Marble(2025年11月)和World API(2026年1月)两款产品,Atlas将是未来Marble和其他产品的底层模型。
影响:Atlas的最大应用方向是具身智能与机器人。World Labs强调,开发者只需用普通手机扫描真实房间,Atlas即可重建为机器人可导航、可交互的3D环境,生成RGB和深度数据用于训练,业界估算若完全靠传统方式采集同等规模数据,成本可能达100万亿美元量级。盲测数据显示,Atlas对MiniMax H3胜率75%、对Gemini Omni Flash 81%、对FLUX 3 93%、对Seedance 2.5 94%;但公司未发布论文、模型卡、定价或独立第三方测试,被指尚需外部验证。
总结:Atlas把相机位姿作为原生输入,让AI模型从"生成视频"升级到"理解三维空间与时间",是World Labs创立以来最重要的一次基础模型发布,被李飞飞本人称为"里程碑式"成果;它将与Google DeepMind的Genie 3、英伟达Cosmos在空间智能赛道展开正面竞争,并直接影响机器人Real-to-Sim仿真训练的效率与成本结构。
参考来源:
1. https://new.qq.com/rain/a/20260902A07A6K00
2. https://www.toutiao.com/article/7680736872233976354
3. https://www.toutiao.com/article/7680791068879421967
4. https://www.163.com/dy/article/L5QJC5LG0511KIFE.html
5. https://coindesk.cc/world-labs-unveils-atlas-an-omni-world-model-for-spatial-intelligence-with-pixel-perfect-generation-108727.html
6. https://www.163.com/dy/article/L5QUTCNT0511AQHO.html
7. https://www.toutiao.com/article/7680845283764208179/
8. https://startupfortune.com/fei-fei-lis-world-labs-launches-atlas-to-build-walkable-ai-worlds
9. https://www.36kr.com/p/3965618760834313









