发生了什么
2026年7月30日,Google DeepMind正式发布新一代机器人AI模型Gemini Robotics 2。与此前仅控制机器人上半身的前代产品不同,新模型通过单一学习策略实现了从腿部、躯干、手臂到多指灵巧手的全身协调控制,使机器人在执行推理任务的同时能够行走、蹲伏和操控物体。
技术突破点
- 单一策略全身控制:一个模型统一管理下肢运动、躯干平衡与上肢精细操作,而非多个独立模块拼接
- 视觉-语言-动作融合:模型同时理解视觉场景、自然语言指令和物理动作规划,实现端到端任务执行
- 多机协同能力:新增三个子模型,支持多台机器人在同一环境中协作完成复杂操作
- 高级推理模块Gemini Robotics ER 2:作为机器人的「高级大脑」,可进行多步骤任务规划并与人类自然对话
为什么重要
Google DeepMind机器人业务负责人Carolina Parada称,这是迈向真正「物理AGI」的关键一步。此前机器人领域的演示多依赖预设程序执行单一任务,而Gemini Robotics 2展现的是通用化的物理智能——机器人能够理解动态环境、规划多步骤操作并实时适应变化。
对企业而言,这意味着制造、物流、仓储等劳动密集型行业正加速接近「通用机器人上岗」的临界点。一台能够自主行走、搬运、组装的机器人将重塑供应链的人力模型。不过,目前该技术仍处于研究阶段,距离大规模商用部署尚需解决安全性、可靠性和成本等工程挑战。
产业影响
- 人形机器人竞争加剧:特斯拉Optimus、Figure AI等厂商将面临来自Google的更强技术竞争
- 工业自动化升级:从固定工位的机械臂到移动式全身操控机器人,工厂产线灵活性大幅提升
- 开源生态受益:Google可能延续Gemini Robotics的开源策略,推动机器人AI民主化

