时间:2026 年 9 月 2 日,爱范儿等多家中文媒体于 15:31 同步报道;World Labs 当日在官方博客发布技术博客与产品介绍。
地点:美国旧金山 World Labs 总部,面向全球合作伙伴 Early Access 开放。
人物:李飞飞(Fei-Fei Li),斯坦福大学教授、ImageNet 创始人、World Labs 创始人兼 CEO,被业界誉为 "现代人工智能教母"。
事件详情:World Labs 正式推出下一代多模态世界模型 Atlas,定位为面向空间智能的 omni world model。Atlas 从零预训练,原生处理文本、图像、视频、相机位姿与 3D 深度信息,单一模型统一支持世界生成、空间重建与时空模拟。
核心能力:1. 相机控制生成(Camera-Controlled Generation),以相机位姿作为底层原生输入,1 到 6 张普通照片即可生成最长达 1 分钟、1440p 分辨率的视频片段,几张照片即可省掉几百个机位。2. 空间重建(Spatial Reconstruction),2 到 25 张稀疏视角照片还原高精度 3D 场景;斯坦福大学 Main Quad 案例中可重建草坪、拱廊与纪念教堂外墙全部细节。3. 时空模拟(Space-Time Simulation),支持 Real-to-Sim 机器人训练流程,机器人可在孪生空间内任意试错。4. 图像生成,可生成 360 度全景图,支持复杂 Prompt、文字渲染与写实、电影感、油画、漫画等多种风格。
技术架构:Multimodal Autoregressive Diffusion Transformer(多模态自回归扩散 Transformer),融合自回归与扩散两大主流范式,原生贯通文本、二维图像、相机位姿与 3D 深度,无缝接入现有大规模算力集群。
性能表现:在镜头运动控制的真人 Blind Test 中,Atlas 面对 MiniMax H3 胜率 75%、Gemini Omni Flash 81%、FLUX 3 93%、Seedance 2.5 94%;在 DTU、ETH3D、ScanNet 公开数据集稀疏视角重建误差 AbsRel×10⁻³ 测试中,Atlas 拿下 25.3 的分数,优于 Pi3X(28.7)、Depth Anything 3(39.3)与 MapAnything(47.7)。
影响:Atlas 将成为 World Labs 自家 Marble 平台及后续产品的底层模型,并开放 Early Access 给部分合作伙伴。业内估算传统方式收集足够规模机器人训练数据成本可达 100 万亿美元量级,Atlas 的 Real-to-Sim 路线有望大幅降低具身智能训练门槛,让机器人从 "理解像素" 走向 "理解空间与行动",与 LLM 形成互补的语言加空间双智能底座。
参考来源:
- https://www.worldlabs.ai/blog/atlas (World Labs 官方博客:Atlas 技术详情与产品介绍)
- https://www.ifanr.com/1678079 (爱范儿:李飞飞掀桌 多模态世界模型发布)
- https://www.ifanr.com/1678150 (爱范儿:把赛博朋克的超梦做出来了)
- https://www.worldlabs.ai/ (World Labs 官网首页)
- https://marble.worldlabs.ai/ (Marble 平台首页)
- https://tophub.today/c/tech (TOPHUB TODAY 科技热榜收录)









