Copied


Google DeepMind发布Gemini Robotics 2,提升机器人智能

realtime news   Jul 30, 2026 15:54 1 Min Read


Google DeepMind宣布推出Gemini Robotics 2,这是一个升级版的AI模型套件,旨在增强机器人灵活性、适应性和协作能力。新平台基于原始Gemini Robotics模型的基础,目标是使机器人能够以更高的精确性和自主性执行复杂的多步骤任务。

与传统机器人通常局限于重复的预编程动作不同,Gemini Robotics 2引入了全身智能。这意味着机器人现在可以执行需要全身协调的任务——例如行走、蹲下或操作物体——并在短短几小时内适应新的硬件配置。这一举措标志着Google将人工智能融入现实环境的更广泛战略中的重要飞跃。

Gemini Robotics 2的关键功能

此次更新的核心包括三个先进模型:

  • Gemini Robotics 2 (VLA): 一个视觉-语言-动作模型,能够控制人形机器人和双臂系统,实现诸如打结或紧密包装物品等精细的动作任务。
  • Gemini Robotics ER 2: 专注于具身推理,这一模型使机器人能够规划多步骤任务,与人类协调并与其他机器人协作。
  • Gemini Robotics On-Device 2: 设计用于无需互联网连接的本地操作,该模型以最少的数据适应新的机器人硬件,提升了现实世界中的可用性。

其中最引人注目的能力之一是其对人形机器人(如Apptronik的Apollo 2)的控制能力。在测试中,机器人成功执行了一项复杂指令——将一个浇水壶放入货架上的特定箱子中——通过理解自然语言、导航环境并完成所需动作。

为什么这很重要

机器人技术长期以来在实现类似人类的适应性和灵活性方面面临障碍。Google的Gemini Robotics 2旨在解决这些限制,使机器人在工业和家庭用途中更具多样性。多机器人协作和本地处理等增强功能可能解锁新的应用领域,从仓库自动化到家庭中的机器人助手。

鉴于其快速的发展速度,Gemini Robotics已成为Google DeepMind推进具身AI的基石。此举与更广泛的行业趋势一致,因为像Boston Dynamics和Agile Robots这样的竞争对手也在将先进的AI功能集成到其系统中。值得注意的是,Agile Robots今年早些时候宣布与Google DeepMind建立合作关系,以实施Gemini模型,这表明该模型在机器人行业内的采用率正在增加。

安全性与行业影响

随着更高的自主性,安全问题也随之增加。Google通过ASIMOV-Agentic基准测试来应对这一挑战,用于测试和改进机器人执行物理任务时的安全性。例如,Gemini Robotics ER 2被编程为能够检测到人类的接近并停止操作,以防止事故发生,这是协作环境中的关键功能。

这一发布突显了Google在通用物理AI领域中争当领先者的雄心。通过超越狭隘的单任务自动化,Gemini Robotics 2将公司定位于捕捉新兴机器人市场的更大份额。

接下来的计划

Gemini Robotics 2已经向早期接入伙伴开放,而像ER 2这样的特定模型可以通过Google AI Studio和Gemini Enterprise Agent Platform进行预览。随着采用范围的扩大,这些进步预计将整合到更多类型的机器人平台中,从而推动物流、医疗和消费机器人等行业的创新。


Read More