Folia
← 返回头版

谷歌推出全身智能机器人模型Gemini Robotics 2

Google DeepMind推出了Gemini Robotics 2,一个主打"全身智能"的机器人通用模型1。该模型包含三个子模型:ER 2负责环境理解与任务规划,Robotics 2 VLA模型将视觉与语言转换为动作,On-Device 2则将动作模型本地化并可用少于200个样例在几小时内适配新机器人1。相比前代仅控制上半身的设计,新模型实现了机器人双腿、躯干、双臂和手指的协调控制,使其能够在移动中执行复杂操作1。

谷歌在实际应用测试中展示了该模型的性能。搭载五指灵巧手的Apollo 2机器人在从桌面、地面和货架取物的平均成功率分别达到68.4%、45.7%和76.3%1。在灵巧手任务中,拧下灯泡的成功率达92%,拧上灯泡36%,扎垃圾袋44%,使用簸箕32%,封自封袋40%1。搭载两指夹爪的机器人在通用抓放、工具配套和精密插入任务中的平均成功率分别为74.2%、78.9%和89.6%1。谷歌表示,同一模型已应用于搭载不同灵巧手的Apollo 2和使用两指夹爪的Franka Duo等多种机器人配置1。


评论