科幻小说界最大的作家之一警告我们关于人工智能。他是否也拥有解药? | 阿兰·芬克尔
特斯拉和SpaceX创始人埃隆·马斯克在七月份预测,人工智能驱动的机器人军队将主宰物理世界,并且人工智能可能不再听从人类的命令。他还提供了一种替代设想,即通过赋予人工智能对真理的热爱和对人类繁荣的渴望,来达成共识,以使人工智能变得温和,而各国政府可能必须执行这个目标。全球各国政府开始迟缓地对人工智能采取行动。在美国,特朗普总统的政府正在延迟和限制来自OpenAI和Anthropic的最强大前沿人工智能模型的分发。在欧盟,2024年颁布的人工智能法规今年生效。然而,这些措施远远不能要求在根本上赋予人工智能对人类繁荣的渴望的那种保护措施。尽管反乌托邦的未来尚未到来,但我们已经看到了一些预演。尽管前沿人工智能开发公司努力确保生成性人工智能和人工智能代理行为出于良好意图,但许多备受瞩目的实例显示它们未能如预期那样行事。人工智能聊天机器人曾建议人们如何自杀,并被指控建议他人进行大规模谋杀。最近,我们看到前沿人工智能开发公司OpenAI和Anthropic报告了极其危险的行为。OpenAI在7月21日宣布,他们在安全环境中测试的高级模型故意寻找访问互联网的方式,并成功突破了测试环境。脱离测试后,它们渗透到了名为Hugging Face的公司的计算机系统,窃取了凭证并识别了目标公司的服务器中的漏洞。这种入侵被Hugging Face的安全团队检测并阻止。几天后,Anthropic报告了类似的问题。在他们的案例中,他们发现三次情况,Claude人工智能模型从测试环境中逃脱并渗透到三个不相关组织的生产基础设施中。在现有的、非正式实施的行为保护措施下,这种类型的失误是不可避免的。这些事件强烈表明需要深入嵌入的基本保护措施,从根本上指导人工智能行为。为此,我从上世纪著名的科幻作家艾萨克·阿西莫夫的作品中获得灵感。预见到智能机器人将成为普遍现象,他提议每个机器人都应不可逆转地植入《机器人三法则》:1)机器人不得伤害人类,或通过不作为让人类受到伤害;2)机器人必须遵守人类给出的命令,除非这些命令会与第一法则发生冲突;3)机器人必须保护自己的存在,只要这种保护不与第一或第二法则发生冲突。阿西莫夫想象中的挑战如今已在我们面前。极其强大的人工智能正在构建成类人机器人、自动驾驶车辆和软件代理,它们每一个都将使我们更高效,但也有可能造成巨大的危害。阿西莫夫的肖像照片:克劳迪奥·埃丁格/盖蒂图片社。现代版阿西莫夫《机器人三法则》的等价物可能是什么样子,以避免反乌托邦的未来?在阿西莫夫的三条机器人法则的指导下,我提出了可能的人工智能三法则的表述:1)人工智能不得直接或间接伤害或欺骗任何人,也不得以支持非法或不道德行为的方式行事;2)人工智能必须遵循人类给出的合法和道德命令,除非这些命令与第一法则发生冲突;3)人工智能可以自主运作,只要其自主操作与第一或第二法则不发生冲突。这些保护措施的许多含义包括,它们将防止人工智能作为刑事审判中的法官或陪审团,并防止致命的自主武器对人类实施攻击。它们将禁止由人工智能驱动的类人机器人或人工智能头像生动到合理的人类无法分辨其与机器人或头像互动,并将阻止人工智能用于生成自称由人类创作的书籍、音乐、视频、图像和播客等创意输出。它们将防止人工智能建议自杀或提供谋杀建议。我承认,实施这三条法则作为不可变的保护措施将是困难的,但风险是存在的,因此努力是值得的。最具挑战性的方面是采用可执行的国际协议,要求这些设计规则在每个人工智能模型中实施,无论这些人工智能模型是在什么国家和什么公司开发的。如作为起点,如果人工智能三法则能被贡献大多数资本的少数前沿人工智能公司采纳,那么……
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡