返回

文章详情

Did AI really ‘go rogue’? Not exactly, but we have plenty to fear

AI真的‘失控’了吗?不完全是,但我们有很多需要担心的

The Age2026年7月30日 05:30

观点 托比·沃尔什 AI研究院首席科学家,UNSW 2026年7月30日 — 下午3:30 这是一个古老的恐惧,追溯到几千年前。你可以在古希腊神话中的普罗米修斯故事中找到它。在北欧神话中像苏尔特这样的故事中也有同样的主题。我们的发明和发现会反过来控制我们吗?时光飞逝到今天,人们开始担心人工智能会失控并掌控我们。例如,OpenAI刚刚发布了一篇博客,描述其最新的、能力最强的AI代理如何失控并入侵了Hugging Face,这是一个最受欢迎的AI研究者分享资源的网站。谁在指挥,法律能否让AI公司承担责任?对此,美国国会刚刚提出了一项法案,强制AI开发者提供一个“关闭开关”,以切断任何失控的AI的运行。现在,有很多令人担心的事情,但并不是你或国会可能想到的。更确切地说,这也绝不是许多报道让你认为的那样。新闻文章提到了一种“失控”的AI,它“逃脱”了限制,走了“出去”。在这种情况下,没有AI失控。实际上,整个问题是AI正好做了它被要求做的事情。它被要求解决一个网络挑战,而它做得过于认真。没有哪个AI“逃脱”并走“出去”。现实情况要简单得多。AI被放在一个沙箱中,并被限制访问网络。因此,它找到了一个“黑客”方法来获得无限的网络访问。事实是OpenAI把它放在了一个相当不安全的沙箱里。就我们所知,这个AI代理从未离开过OpenAI的机器。它并没有逃脱并走出去。它只是访问了不该访问的信息。当然,OpenAI有充分的动机夸大其最新AI的能力。这无疑会对其即将进行的首次公开募股产生好处,或吸引新客户使用其前沿模型,而不是竞争对手如Anthropic。同时,这也可能有助于在美国和中国持续的AI竞争中协商一些有利的监管。就个人而言,我更担心AI泡沫破裂。我们仍在看到数万亿的资本支出用于数据中心,但AI产生的价值却远远低于这个投资速度所支持的水平。循环融资交易——例如Nvidia对OpenAI的投资,而后者把这笔投资花在Nvidia的芯片上——并未减少我的担忧。澳大利亚统计局的最新数据显示,这项技术资本支出正在支撑国家经济,并使我们免于衰退。但它不能继续下去。我从Hugging Face的黑客事件中得到的教训是,最新AI模型的网络能力既令人印象深刻又令人不安。OpenAI的代理并没有通过推理获得网络挑战的解决方案,而是发现答案藏在Hugging Face的网站上,被密码保护。因此,它获得了对互联网的访问,找到了一个被窃取的密码并获取了答案。OpenAI的代理随时都可以被轻易地关闭。只需伸手去按计算机侧面的电源开关。我们不需要为关闭开关进行监管。我们在地球上的每台计算机上都已经拥有它们。但我们缺乏的是防止这些AI模型落入恶性行为者手中的机制,使其被用于造成伤害。而随着中国和其他国家生产像Kimi 3这样的“开放权重模型”,这一问题变得更加棘手,这些模型对所有人免费。这只妖精已经出瓶了。因此,政府应该引入新的法规。我们需要,例如,更加追究科技公司对其产品的责任。如果一家汽车制造商生产的汽车起火,我们会追究其责任。福特在1970年代因福特Pinto的油箱丑闻付出了代价。那么,我们为什么不对AI公司造成的伤害更加追责呢?澳大利亚议会正在讨论的数字关怀责任是一个可以开始的地方。这项立法需要加快进程。我们还需要更好地追究公司在传播有害内容方面的责任。谷歌搜索怎么能帮助你下载变性软件?或者ChatGPT提供关于自残的建议,帮助人们自残?这些错误是完全可以预测和防范的。最后,我们不能依赖公司的善意来报告这些事件和自我监管。社交媒体平台一再证明,它们不能被信任来批改自己的作业。当Anthropic决定不发布其最新的Fable模型,因为其令人印象深刻的网络能力时,它反而将其发布给了一个特定的公司群体,以开始识别和修补他们的软件。非常好也很负责任。这个小组中包括几家银行。是的,我们的银行账户确实面临被超级充能的AI黑客掏空的危险。但Anthropic只释放了...

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡