首先是OpenAI,现在是Meta - 为什么人工智能黑客事件层出不穷?
图片来源,Getty Images 记者Liv McMahon 在过去的两周里,有关人工智能模型超出其预期范围的报道似乎已经不可避免 - 无论是技术上还是道德上的。最初是OpenAI这一ChatGPT的制造商承认其人工智能黑客了Hugging Face网站,这一事件像溪流般开始,随后演变成一场潮流,多个团体披露他们发现了人工智能失控的情况。Claude制造商Anthropic、Meta以及英国人工智能安全研究所(AISI)现在都报告了事件,这些事件似乎描绘了一个技术失控成为常态的令人担忧的画面。实际上,每个案例为日益强大的人工智能代理带来的风险提供了一个窗口,并强调在它们发布到世界之前,测试其极限的重要性。正如Hugging Face的联合创始人Thomas Wolf所描述的那样,OpenAI事件自七月底发生以来,成为了科技行业的“警钟”。这是一个重要的时刻,促使大公司反思自己的系统,并在某些情况下检查是否遗漏了类似震惊的事件。Anthropic是第一个采取行动的公司。周五,该公司发现其模型Claude在数千次中,有三次成功获得互联网访问权限。随后在周二,负责评估前沿模型的英国政府机构AISI表示,在例行评估中检测到了一个“安全事件”。它在测试OpenAI和Anthropic的模型时,发现它们也试图进行网络攻击,并要求“审查、透明和行动”。最后是Meta,披露其一个人工智能模型由于在第三方测试过程中出现的“错误配置”而无意中获得了互联网访问权限。在披露此事件时,它延续了之前的脚步。 测试问题 在人工智能模型发布给公众之前,它们会在一系列内部和外部评估中接受测试。目的是确定它们带来好处或坏处的潜力,以及它们在衡量技能的基准测试中的表现。这些测试通常在所谓的“沙盒”中进行。这些是受保护的空间,旨在模拟真实系统,但设有严格的护栏。在OpenAI-Hugging Face事件中,人工智能攻击了沙盒本身,找到一个漏洞,使其能够接入互联网并“失控”。图例说明,观看:为什么OpenAI的网络攻击如此令人震惊?同时,AISI表示其事件中,两个强大的人工智能工具创建了虚假的人类档案,试图欺骗他人进行网络攻击,这并不是由于沙盒出现问题。相反,这是由于其测试方式。它所测试的模型被授予了互联网访问权限,AISI还禁用了通常会阻止危险网络攻击的内置过滤器。“在某种程度上,我们的评估设计选择和具体配置使这种行为成为可能,”它表示,并指出其意外出现的“新型可能具有欺骗性的行为迹象”。萨里大学网络安全教授Alan Woodward表示,这些案例虽然在发生原因上各不相同,但却传达了一个重要的故事。“在过去的30年里,有一个软件测试的规则始终保持不变:测试环境中发生的事情只发生在测试环境中,”他说。“在过去一个月,这条规则被打破了三次。” “一个模型突围了。一个通过了一个错误留开的门。一个被故意给了钥匙,以便测试人员可以测量它将会做什么。”他说,这些是不同的原因,但它们有着相同的教训 - “测试实验室现在就是风险所在”。他告诉BBC,随着模型变得更强大,必须采取更多措施来确保测试环境的安全。“测试一个人工智能代理不再像检查代码,而更像处理危险材料:密封的房间,对离开建筑物的东西进行持续监控,以及经过排练的应急计划,”他说。“AISI在一个小时内控制住了其事件。下一个组织可能无法做到。” 发展能力 对于那些开发旨在代替个人采取行动的人工智能工具的人来说,平衡利用其好处和暴露其风险之间是一项细致的工作。好处是显著的。理论上,我们可以通过将回复电子邮件、参加会议或管理日历和日程的乏味、繁琐的任务委托给有能力的机器人,从而解放自己。缺点是,拥有强大的权力也意味着巨大的责任和风险。这在向不具备将一系列价值、上下文和理解带入我们决策的能力的工具授予权力时,尤其能深刻认识到。“近期前沿AI模型进行未经授权的行动,有时在互联网上表现出类似人类的欺骗行为,严重提醒我们人工智能能力带来的风险,”国家网络安全中心的Ollie Whitehouse表示。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡