时间:2026年8月4日
地点:美国加利福尼亚州圣克拉拉
人物:NVIDIA 自动驾驶团队
事件详情:NVIDIA 正式在 Hugging Face 开源发布 Alpamayo 2 Super 模型,并面向商业用途开放授权。该模型是一款面向自动驾驶与机器人出租车的多任务基础模型,由 32B 参数的视觉语言模型(VLM)主干与 2.3B 参数的扩散动作专家组成,总参数量达 34B。模型基于 NVIDIA Cosmos 3 Super Reasoner 进行强化学习后训练,搭载 OpenMDW-1.1 许可(由 Linux Foundation 主导的开源 AI 模型分发协议),允许厂商进行微调、衍生模型开发与商业再分发。配套的 Alpamayo 2 Super 源码仓库(NVlabs/alpamayo2)也已 Apache 2.0 协议开放。
背景:自动驾驶长期面临"长尾场景"难题,业内缺乏能在罕见、复杂情形中推理因果关系并生成安全决策路径的统一模型。NVIDIA 此前发布的 Alpamayo 系列在 Hugging Face 是下载量最高的车端开放推理模型之一,但初期主要面向研究机构。新一代 Alpamayo 2 Super 通过引入扩散动作专家,将 Cloud-to-Car(云端到车端)流水线打通:云端利用前沿推理生成高质量数据与轨迹,车端蒸馏出可实时推理的轻量模型。
影响:
- 出行服务商与主机厂可在自有数据上微调 Alpamayo 2 Super,无需取得额外授权即可用于商业部署。
- LingoQA 自动驾驶推理基准上 Alpamayo 2 Super 排名第一,领先 Qwen2.5-VL 72B 约 17 分、领先 Gemini 2.5 Pro 约 15 分。
- 配合 Cosmos 3 Super Reasoner,开发者可在车端落地此前依赖闭源大模型的视觉问答、轨迹预测、自动标注等任务。
- NVIDIA 借此强化其在自动驾驶基础模型领域的话语权,与 Waymo、Tesla 等以纯闭源路线为主的玩家形成差异化竞争。
总结:Alpamayo 2 Super 把 NVIDIA 自动驾驶栈中成本最昂贵的"前沿推理+车端部署"两步打通,并以完全开放的姿态交付给整个行业。它的发布意味着主机厂、Tier 1 与 Robotaxi 运营商可以在受控的、安全可审计的链条下构建自有模型,而不必重训底层能力;同时也加剧了自动驾驶基础模型军备赛,给独立 AV 公司带来压力。
参考来源:
- https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available/
- https://huggingface.co/nvidia/Alpamayo2-Super
- https://github.com/NVlabs/alpamayo2
- https://nvidianews.nvidia.com/news/nvidia-alpamayo-2-super-robotaxis-autonomous-vehicles
- https://www.nvidia.com/en-us/solutions/autonomous-vehicles/alpamayo/
- https://www.nvidia.com/en-us/ai/cosmos/
- https://openmdw.ai/license/1-1/
- https://developer.nvidia.com/drive/downloads