Google Gemini Robotics 2 发布:VLA 模型让机器人从桌面机械臂到全身人形全覆盖
Google Gemini Robotics 2 发布:VLA 模型让机器人从桌面机械臂到全身人形全覆盖
Gemini Robotics 2 来了——Google DeepMind 今天发布的这个 VLA(视觉-语言-动作)模型,说是迄今最先进的一代。
VLA 是什么?简单说就是把图像识别、语言理解和动作控制打包在一起,让机器人能在真实物理环境里干活。DeepMind 这次覆盖的范围很广——从桌面机械臂到全身人形机器人,Gemini Robotics 2 都能控制。
官方把它定位成”新一代自适应机器人的智能层”。核心能力有三块:全身运动控制、精细动作执行、多机器人协同。ER 2 版本则专注”具身推理”(embodied reasoning),就是让机器人理解物理世界、基于理解做决策,可以理解为更高层的大脑。
有意思的是,ER 2 并不是简单的参数升级——它替代的是今年四月才发布的 ER 1.6,属于一次正常的代际迭代。ER 2 已经在 Google AI Studio 上可以体验了,Gemini Robotics 2 则需要填 waitlist 申请 early access。
这件事为什么值得单独说?因为它代表着多模态模型从”能说会道”到”能动手”的延伸。GPT-5.6 Luna 在文本上打价格战的时候,Google 在物理世界上下了另一手棋——具身智能的军备竞赛,正在从云端蔓延到机器人身上。
ER 2 体验地址:Google AI Studio
Gemini Robotics 2 申请:waitlist
评论区
0 条评论
登录后可评论。