Gemini Robotics 2首发 全身控制人形

时间:2026年7月30日 地点:美国加州山景城(Google DeepMind 总部) 人物:Google DeepMind 机器人副总裁 Carolina Parada、机器人团队总监 Vijay Rao、首席研究科学家 谭捷(Tan Jie) 事件详情:2026年7月30日,Google DeepMind 正式发布新一代机器人基础模型系列 Gemini Robotics 2,包含三款组件,目标是构建从实验室走向产线和仓库的"通用物理智能层"。Gemini Robotics 2 是核心 VLA(视觉-语言-动作)模型,首次实现对整个人形机器人从头到脚的全身控制,可同时驱动 Apptronik Apollo 2 人形机器人搭配 SharpaWave 灵巧手,以及 Franka 双臂平台搭配 Robotiq 夹爪等多个不同形态的硬件。Gemini Robotics ER 2 担任高级大脑,负责将自然语言指令拆解成多步骤子任务,并支持多台机器人协同调度;Gemini Robotics On-Device 2 为端侧部署版本,可在本地运行,并能在不到 200 个示例、几小时内适配一套全新的双臂机器人。在演示中,Apollo 2 完成了"穿过房间→拿起洒水壶→绕过障碍→放入低层架子"的全流程全身操作。 背景:现有人形机器人普遍采用"双系统"架构:具身推理算法负责高级规划,VLA 模型再将计划转化成电机底层命令,导致上下半身操作与移动解耦,更换硬件本体时大量策略需要重新采集数据和训练。Gemini Robotics 2 同时把运动控制、推理规划、跨形态迁移三件事打包推出,意味着 DeepMind 希望用一套智能层降低机器人厂商各自造大脑的重复成本。该模型建立在 2025 年推出的 Gemini Robotics 基础上,延续了谷歌在 Everyday Robots 部门 2023 年关闭后于机器人领域的再度发力,并与 OpenAI、英伟达在通用机器人基础模型赛道展开正面竞争。 影响: - 同一份模型权重可驱动人形、双臂、移动机械臂等多形态硬件,大幅降低机器人厂商自研大脑的重复成本 - 多机器人协同与持续数分钟、涉及数百次决策的长程任务规划成为可能,提升仓储与家庭场景落地速度 - 端侧 On-Device 2 几小时少样本适配新机型,有助于把 AI 智能层下沉到工厂、户外等弱网络场景 - 与 OpenAI、英伟达的物理 AI 军备竞赛升级,机器人基础模型正式进入"全身智能+跨硬件生态"阶段 总结:从单臂桌面抓取到整台人形协调,Gemini Robotics 2 标志着机器人"大脑"从局部智能走向全身智能,并与 ER 2 推理大脑、On-Device 2 端侧小模型组成一套完整产品矩阵。92% 的拧灯泡成功率证明泛化能力大幅提升,但扎垃圾袋、封密封袋等复杂任务成功率仍偏低,多指灵巧操作距离人类水平尚有明显差距。下一阶段的关键,是看这套智能层能否被第三方机器人厂商广泛接入,并在产线与仓库里跑出真实业务价值。 参考来源: - https://the-decoder.com/google-deepmind-unveils-gemini-robotics-2-to-power-robots-of-all-shapes-from-tabletop-arms-to-humanoids/ - https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-intelligence-to-robots/ - https://news.qq.com/rain/a/20260731A04OGW00 - https://t.cj.sina.com.cn/articles/view/6105753431/16bee675701901dm6a - https://www.myzaker.com/article/6a6bff4a8e9f0909751002de - https://news.qq.com/rain/a/20260731A0416M00 - https://m.163.com/dy/article/L36OE0IU05119734.html - https://c.m.163.com/news/a/L35LH43S0512B07B.html