时间:2026年8月30日
地点:北京 / 全球
人物:MirroS 团队、Qwen3.5 系列模型团队、MuJoCo 开源社区
事件详情:8月30日,AI 研究机构 MirroS 正式发布开源项目 Code-as-World,提出把物理场景表示为可执行代码而非像素或潜变量的全新范式。系统通过 5 轮上限的 agentic loop,对真实视频执行 propose-instantiate-execute-render-verify 流程,自动逆向恢复可在 MuJoCo 物理引擎中运行的 scene.json;并以这些带精确物理标签的可执行世界作为训练数据,配合 Qwen3.5-4B/9B 微调,发布 Code-as-World-VL-4B 与 Code-as-World-VL-9B 两个开源权重模型。在斯坦福 QuantiPhy 验证集 159 道物理推理题上,9B 版本取得 55.4 MRA,超过 Gemini-3.1 Flash 的 54.8,并领先最强开源基线约 15 分。
背景:当前主流视频生成、3D 重建与图像描述方法只能复原场景的部分信息,无法还原其背后的物理机制。MirroS 团队在技术报告中提出,模型预测下一帧像素合理,并不代表它掌握了质量、接触与重力等机制;真正的物理智能应体现在可干预、可重放、可验证的可执行代码世界中。与此同时,物理 AI 与世界模型已成为 2026 年 AI 投资与研究的主线,从英伟达 Cosmos 到各厂商具身基础模型,竞争核心正从"看起来像"转向"机制对"。
影响:Code-as-World-VL 4B/9B 双模型以 Apache 2.0 协议完全开源,支持 vLLM 部署并提供 OpenAI 兼容的 /v1 接口,单视频采样 16 帧、最大上下文 4608 即可在 BF16 精度下完成推理。这意味着任何机器人和具身智能团队都可基于这一框架,把真实视频秒级转换为带物理标签的训练数据,破解长期困扰业界的"仿真到现实"标注瓶颈;同时也拉低了 9B 量级视觉语言模型与 Gemini 3.1 Flash 等闭源旗舰之间在物理推理任务上的差距。
总结:Code-as-World 把"代码即世界"从一个哲学比喻变成了可开源、可部署、可复用的工程方案,以 9B 参数小模型跑赢闭源旗舰 Gemini-3.1 Flash 1.8 分,代表世界模型路线正在从"像素逼近"走向"机制发现"的关键拐点。
参考来源:
1. https://www.marktechpost.com/2026/08/29/mirros-code-as-world-executable-world-representations/
2. https://github.com/mirros-lab/code-as-world
3. https://korshunov.ai/en/article/21704-mirros-releases-code-as-world-to-convert-videos-into-executable-mujoco-physics
4. https://aipulselab.tech/news/meet-code-as-world-an-agentic-loop-that-rewrites-real-videos-into-executable-mujoco-physics-programs-3dd254
5. https://tradepoint.io/meet-code-as-world-an-agentic-loop-that-rewrites-real-videos-into-executable-mujoco-physics-programs
6. https://interestana.com/articles/meet-code-as-world-an-agentic-loop-that-rewrites-real-videos-into-executable-mujoco-physics-programs-00gsoo9t
7. https://ainewshubs.com/article/meet-code-as-world-an-agentic-loop-that-rewrites-real-videos-into-executable-mujoco-physics-programs
8. https://news.qq.com/rain/a/20260828A07M8T00









