发生了什么
Google DeepMind 于7月30日正式发布 Gemini Robotics 2 系列模型,这是专为具身智能和人形机器人设计的全新AI系统。与此前仅控制机械臂的模型不同,Gemini Robotics 2 首次实现了对人形机器人全身的集中控制——包括行走、下蹲、伸手和双手协作,全部由单一学习策略驱动,无需分散传感器预编程。
三款模型分工协作
新系列包含三个互补模型:Gemini Robotics 2 负责将摄像头画面和自然语言指令转化为实时电机控制信号,实现全身协调运动;Gemini Robotics ER 2 作为具身推理模型,能够规划包含数百个步骤的长程任务,支持工具调用和外部云服务访问以澄清模糊指令;第三款模型 Gemini Robotics 2-VLA 则先向早期合作伙伴开放。其中 ER 2 即日起已通过 Gemini API 和 Google AI Studio 向开发者提供。
为什么重要
- 具身智能范式的关键突破:从"上半身操作"跃迁到"全身智能",单一模型统一控制腿、躯干、手臂和多指手,标志着机器人AI从专项任务向通用物理智能迈进。
- 多机协同与长程任务:ER 2 不仅控制单台机器人,还能协调多台机器人在共享空间中协作完成复杂任务——例如自动化处理包含数百个步骤的家务劳动。
- 开发者生态开放:ER 2 已面向开发者开放 API,这将加速第三方机器人和自动化应用的创新。
仍待观察
官方尚未公布具体架构细节、完整测试数据和适配硬件清单。此外,全身控制模型目前仅对早期合作伙伴开放,公开发可用时间表不明。企业读者应将此视为方向性进展而非即用产品,但具身智能赛道的竞争格局已因此次发布而提速。

