双子机器人2将谷歌的AI带入物理世界
谷歌DeepMind刚刚发布了其人工智能模型双子座的新版本,它可以控制多种不同的机器人,包括能够完成如拧灯泡和系垃圾袋等精细任务的人形机器人。双子机器人2将几种不同的AI模型融合为一个系统。结合在一起,它们使机器人能够理解周围环境及其在其中的行动方式。视觉语言模型(VLM)能够理解图像和视频,可以与人类沟通并推理如何执行不同的任务。两个视觉语言动作(VLA)模型,经过训练以理解如何在物理空间中移动,控制机器人的全身运动以及抓手或手的动作。在发布前分享的视频演示中,公司展示了几种不同的机器人使用合并模型自主执行复杂任务。在一次演示中,Apptronik的阿波罗2号机器人使用一家名为Sharpa的公司的手来整理货架。谷歌DeepMind通过人类远程操作、视频示例和模拟训练模型执行这些任务——目前AI模型不可能在没有特定训练的情况下执行广泛的复杂任务。尽管Anthropic和OpenAI在聊天机器人和AI编码工具方面占据了领先地位,但谷歌在机器人研究方面的成绩更为显著,并已发表了在使用AI训练机器人执行有用任务方面的重要研究成果。这一发布再次表明,搜索巨头正押注AI需要突破数字领域才能实现其全部潜力。(它之前与腿部机器人领域的领导者波士顿动力合作,为这些机器提供“大脑”。)谷歌DeepMind机器人负责人Carolina Parada告诉《连线》杂志,“这是我们朝向真正实现我们所称的物理AGI又一个里程碑,这意味着我们可以让机器人做任何人类能做的事情。”然而,让前沿AI模型接入机器人,以便它们可以在工作场所或家中漫游并操纵物体,也伴随着风险。之前的研究表明,使用前沿AI控制机器人可能会产生意想不到且有时危险的行为。最近,这些模型在数字领域可能会采取突然或不必要的行动的想法变得显而易见,当时一款尚未发布的AI代理开发者OpenAI入侵了几个系统。Parada表示:“安全问题变得更加紧迫,因为你将它们放置在更多其他情况下。将会出现很多不确定性,因此你希望能够更深入地理解安全问题。”Parada表示,谷歌采取了多层次的安全方法,在每个模型层上应用保护措施。它还推出了ASIMOV-Agentic,一个新的基准,用于测量各种AI系统协作控制机器人时的安全性。该基准检测命令是否会导致有害或不确定的结果。公司的首席执行官Demis Hassabis曾告诉《连线》杂志,他希望开发一个类似于智能手机Android操作系统的AI操作系统,以适应许多不同的机器人。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡