Folia
← 返回头版

Google推出Gemini Robotics 2实现机器人全身智能控制

Google推出了Gemini Robotics 2系统,这是一套新的AI模型组合,使机器人能够实现整体身体控制和复杂操作1。相比前版本仅支持上半身控制,新系统已扩展到支持从脚到指尖的全身运动2,包括行走、下蹲、伸展和操纵物体等动作2。演示中,Apptronik Apollo 2机器人展示了弯腰拾取浇水壶和从架子上取下特定物品的能力2。

该系统由三个核心模型组成:Gemini Robotics 2视觉语言动作模型、Gemini Robotics ER 2具身推理模型,以及Gemini Robotics On-Device 2本地运行优化模型1。其中,On-Device 2可在少于200个示例的情况下,通常仅需几小时内就能适应新的机器人体型1。新模型能够控制具有22度自由度的五指手和两指平行夹爪,完成打结或密封拉链袋等精细操作1。

系统还新增了多机器人协作功能,支持在几分钟内执行数百个决策点的多步骤任务1。Google同步引入了ASIMOV-Agentic安全基准测试,用于评估代理安全编排和不确定性解决能力1。目前,Gemini Robotics ER 2已在Google AI Studio上提供,而VLA和On-Device模型向早期访问合作伙伴开放1。


评论