Google DeepMind发布 Gemini Robotics 2,推进机器人全身智能

Google DeepMind发布 Gemini Robotics 2,推进机器人全身智能

N
News Editor
2026-07-30 16:01:06
Google DeepMind于7月30日发布 Gemini Robotics 2 智能层,推出 Gemini Robotics 2、ER 2 和 On-Device 2 三个模型,覆盖全身控制、具身推理和本地端适配。官方称,新系统可让机器人在不可预测环境中自主适应,并把技能迁移到不同机体上。ER 2 已在 Google AI Studio 上线,VLA 与本地端模型目前仅向早期合作伙伴开放。

Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2,推出面向下一代机器人的新智能层。该公司表示,这套系统带来了全身控制、进阶灵巧操作和多机器人协作能力,目标是让机器人从预先编程的单一自动化设备,转向能够自主学习并处理物理世界复杂任务的通用 AI。

在这次发布中,DeepMind 将这项成果命名为《Gemini Robotics 2 带来机器人全身智能》。官方称,系统可以让机器人适应不可预测的环境,并把学到的技能快速迁移到不同的机器人机体上。

三款模型覆盖控制、推理和本地端运行

根据由 DeepMind 团队负责人 Carolina Parada 带领发布的公告,Gemini Robotics 2 包含三个核心模型,分工各不相同。

  • Gemini Robotics 2:这是视觉—语言—动作(VLA)模型,可把视觉和语言输入直接转换为电机控制,支持从脚到指尖的人形机器人完整控制,也提升了双手和夹爪的灵巧操作能力。
  • Gemini Robotics ER 2:这是一款“具身推理”视觉语言模型,负责与人类沟通、理解物理世界,并规划长达数分钟的多步骤任务,同时新增机器人团队协作功能。
  • Gemini Robotics On-Device 2:这是一款面向设备本地端运行的 VLA 模型。DeepMind 表示,它通常只需不到 200 个样例,就能在几小时内适配全新的机器人机体。

可将指令转化为人形机器人的全身动作

DeepMind 在展示中称,Gemini Robotics 2 首次实现了把意图转化为人形机器人的智能全身动作。以 Apptronik 的 Apollo 2 人形机器人为例,在接到“把浇水壶放到底层架子的绿色箱子里”的指令后,机器人能够自行走到桌前拿起水壶,再移动到架子旁完成放置。

在手部操作方面,搭载在 Apollo 2 上的 22 自由度五指 SharpaWave 手,可以完成打结、密封夹链袋等精细动作。对于标准两指平行夹爪平台,例如 Franka Duo,系统也能完成紧密包装等复杂任务。

ER 2 支持多机器人协作,并引入安全基准

在代理式推理能力上,DeepMind 表示,ER 2 可以处理包含数百个决策的复杂任务,并带有自我修正机制。该模型也支持多机器人协作,使不同类型的机器人共同完成单台设备难以承担的工作流。

安全仍是这次发布的重点之一。团队推出了新的基准 ASIMOV-Agentic,用于评估安全协调和不确定性处理。DeepMind 表示,ER 2 目前是在遵循安全约束和人类接近度方面最安全的机器人模型。

ER 2 已上线 AI Studio,其余模型先向合作伙伴开放

目前,Gemini Robotics ER 2 已在 Google AI Studio 提供,并在 Gemini Enterprise Agent Platform 进入私人预览阶段。至于 VLA 模型和本地端模型,现阶段仅向早期合作伙伴开放。

DeepMind 将这次更新称为迈向“解决物理世界 AGI”的重要里程碑,并表示未来机器人将能够与人类并肩工作,处理更复杂的挑战。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
650

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。