
谷歌DeepMind的新人工智能模型可以控制机器人的整个身体
谷歌DeepMind表示,其最新版本的Gemini Robotics人工智能模型可以“控制整个类人机器人”。尽管之前的模型主要关注控制类人机器人的上半身,但根据周四的公告,Gemini Robotics 2现在支持从脚到指尖的“全身运动”。新模型将允许类人机器人执行更广泛的动作,使它们能够行走、蹲下、伸展和处理物体。谷歌分享的视频展示了Apptronik的Apollo 2机器人如何弯下身子拿起一个浇水壶,以及如何找到并从架子上取出特定物品。尽管谷歌DeepMind指出其机器人“在运动速度上还有很大的提升空间”,但它补充说此更新“是朝着完成更复杂的现实任务所需技能的重要一步,这些任务需要全身协调”。此外,Gemini Robotics 2支持更好的灵活性,因为它现在可以控制更复杂的五指手。这样,机器人就能够执行像封闭Ziploc袋、扎垃圾袋或拧松灯泡等任务。谷歌DeepMind还在更新Gemini Robotics ER(体现推理),这是一种视觉-语言模型,帮助机器人分析周围环境、处理指令和执行多步骤任务。Gemini Robotics ER 2在长时间内完成任务时表现更好,并且“现在能够理解任务的开始和结束”。谷歌DeepMind表示,这一更新还允许不同类型的多台机器人协同工作完成任务,一段视频展示了Apollo 2如何指示谷歌的双臂机器人在清理车库时将工具放入箱子中。该公司指出,Gemini Robotics ER 2是其迄今为止“最安全的机器人模型”,因其可以“更好地检测到人类的接近,触发安全工具呼叫,并在有人靠得太近时使机器人安全停下”。与此同时,谷歌DeepMind对其Gemini Robotics On-Device Model进行改进,该模型可以在没有互联网连接的情况下在机器人上本地运行。该模型现在可以更快地适应新的体现,包括那些具有“截然不同的形状、传感器和自由度”的模型。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡