时间:2026年8月13日(北京时间)
地点:深圳(腾讯混元实验室)
人物:腾讯混元 3D 团队
事件详情:2026 年 8 月 13 日,腾讯混元 3D 团队正式推出 3D 开放世界生成框架 WorldClaw,相关论文已于 8 月 5 日在 arXiv 公开。用户输入一句开放式文本描述,WorldClaw 即可生成可自由探索、可继续编辑的大规模 3D 世界。
WorldClaw 采用由粗到细的 Agentic 3D 世界生成方式:多个 Agent 协作完成用户意图分析、场景规划和全局地形构建,再根据各区域的功能与地形条件,逐区生成建筑、车辆、植被等内容,并将其转换为可单独编辑、替换和复用的 3D 资产。初始场景完成后,Agent 还会基于多视角渲染结果,持续检查并修正物体尺度、姿态、悬浮和穿模等问题。
腾讯混元展示了四季村落、热带海盗岛屿、沙漠战场等生成案例,并将 WorldClaw 与 SynCity、Marble、MajutsuCity、WorldGen 和 GPT-5.6 Sol 进行定性对比。结果显示,基于 WorldClaw 生成的复杂地形具有明显高差、连续边界和清晰的语义分区。
背景:生成式模型已能根据文本生成图像、视频和 3D 对象,但生成一段"看起来像世界"的画面,与构建一个可进入、可继续编辑和使用的 3D 世界并不相同。后者还需要连续一致的空间结构,以及可独立编辑、替换和扩展的建筑、道路、植被等场景元素。WorldClaw 的核心思路是从全局到区域:先规划整体布局、搭建全局地形,再根据不同区域的功能和地形条件生成局部内容,并通过真实 3D 地形的渲染结果引导后续对象生成。
影响:WorldClaw 把 AIGC 从"生成单个 3D 资产"推进到"生成可探索可编辑的 3D 世界",面向游戏开发、影视预可视化、虚拟仿真、具身智能训练等场景,可显著降低大规模场景搭建成本;同时,对象级独立编辑与 SAM3D 网格重建使生成结果具备生产可用性,有助于打通 AIGC 在工业管线中的最后一公里。
总结:腾讯混元 WorldClaw 用多 Agent 协作把"一句话生 3D 世界"变成现实,论文、项目页与 GitHub 代码同步开源,是国产多模态生成在 3D 场景级别的重要进展。
参考来源:
- 智东西:《腾讯3D世界生成框架来了:一句话生成世界,支持修改编辑》https://zhidx.com/p/584291.html
- 腾讯新闻:《腾讯3D世界生成框架来了:一句话生成世界,支持修改编辑》https://news.qq.com/rain/a/20260813A08YI100
- 网易新闻:《腾讯3D世界生成框架来了:一句话生成世界,支持修改编辑》https://c.m.163.com/news/a/L47ID89Q051180F7.html
- 手机网易:《腾讯3D世界生成框架来了:一句话生成世界,支持修改编辑》https://m.163.com/dy/article/L47ID89Q051180F7.html
- arXiv 论文:WorldClaw https://arxiv.org/abs/2608.05248
- 项目网页:Hunyuan3D-WorldClaw https://tencent-hunyuan.github.io/Hunyuan3D-WorldClaw/
- GitHub 代码仓库:Tencent-Hunyuan/Hunyuan3D-WorldClaw https://github.com/Tencent-Hunyuan/Hunyuan3D-WorldClaw









