你的位置:首页>新闻中心 > Google DeepMind 发布 Gemini Robotics 2,面向全身控制的具身智能底座支持多机器人协同作业

Google DeepMind 发布 Gemini Robotics 2,面向全身控制的具身智能底座支持多机器人协同作业

【伦敦,2026 年 7 月 30 日】Google DeepMind 正式推出 Gemini Robotics 2,新一代面向全身机器人控制的具身智能系统,为通用人形机器人、双臂操作机器人提供端侧可部署的视觉语言动作模型,支持全身运动控制、精细灵巧操作以及多机器人协同完成复杂物理任务。Gemini Robotics 2 由三大核心模型构成:Gemini Robotics 2 VLA 模型,负责将视觉感知与自然语言指令直接转化为全身电机动作;Gemini ER2 具身推理模型,作为智能体理解物理世界、规划长时序任务;配套本地端侧推理引擎,支持模型在机器人本体本地运行,降低云端依赖,提升实时响应能力。

DeepMind 官方演示视频展示,搭载该系统的人形机器人可独立完成清理杂乱房间:自主下蹲、伸展肢体、拾取散落物品并归位;多台机器人组队协同分工,共同完成空间整理任务。这套系统最大亮点之一,是具备快速适配不同机器人本体的能力。开发者仅需数小时标定,即可将这套具身智能底座迁移到不同构型的机器人硬件,不用针对新机器人从头训练模型,大幅降低硬件适配成本。在传统机器人开发流程中,算法团队往往需要数月时间针对特定机器人本体调试运动控制与感知模型,硬件更换后基本要重新开发,制约具身智能技术快速扩散。

项目负责人介绍,Gemini Robotics 2 重点解决两大痛点:一是很多大模型只擅长文本推理,缺少对物理动力学的理解,下达动作指令后,机器人容易摔倒、碰撞物体;二是过往具身模型大多只能控制机械臂,难以实现全身协同,行走、平衡、手部操作无法统一调度。新模型将全身动力学、物体物理属性、空间感知融入推理过程,机器人在抓取、移动过程中,会预判物体重量、摩擦力,预判动作带来的重心变化,降低操作失误概率。模型支持本地推理,意味着机器人在断网环境下依然可以持续作业,对于工厂、地下空间、野外等网络不稳定场景尤为关键。

学术界对该成果给予高度关注,但同时提出理性判断。剑桥大学机器人实验室研究员表示,Gemini Robotics 2 在仿真与受控实验室环境表现亮眼,但真实世界充满不确定性,物体形变、光线剧烈变化、地面湿滑等干扰因素,依然会显著降低机器人可靠性。目前模型的多机协同还局限在简单任务,复杂任务下多机器人任务分配、冲突避让仍需要进一步优化。开源社区也在关注 Google 后续开放策略,是否开放权重、评估数据集,将深刻影响全球具身智能开发者生态。

放眼全球科技巨头赛道,谷歌 DeepMind 长期聚焦具身 AI 基础模型研发,不直接生产机器人硬件,定位为底层智能方案提供商;特斯拉、Figure 等企业采取硬件 + 模型一体化路线;而大量欧洲、亚洲机器人厂商则需要通用模型底座降低算法研发门槛。这种分工正在塑造全新的产业分工:一部分企业专注机器人本体、执行器、传感器硬件制造,另一部分科研机构与 AI 企业开发通用具身基础模型,形成软硬件解耦生态。

行业调研机构预测,通用具身基础模型市场将在 2028 年进入快速增长期,模型授权、开发工具、微调服务将形成独立赛道。Google DeepMind 表示,下一步将联合全球机器人厂商,在仓储分拣、实验室操作、设施运维场景开展大规模实地测试,持续优化模型在非结构化环境稳定性,并参与国际具身机器人安全标准制定,研究人机共融场景下的风险识别机制,推动具身智能从实验室走向真实工业与服务场景。

上一篇:Figure AI 发布 Helix 2.5 具身大模型,人形机器人实现陌生家庭环境零样本自主作业 下一篇:欧洲初创 Embodied AI 推出工业具身机器人劳动力方案,应对欧洲制造业人力短缺危机

展会介绍
联系我们
目标观众
日程安排
展会简介

展商服务
历届展商
上届回顾
为何参展
展位收费

观众服务
合作媒体
酒店住宿
特邀企业
展馆交通




 



联系方式:
地 址:上海市青浦区崧泽大道333号
电 话:021-5718 7692
传 真:021-8031 2427
邮 箱:Hrzl168@163.com
  2026深圳国际具身智能与人行机器人展览会 大会官网www.flexane.com