OpenAI加强对其新模型的控制以应对网络安全风险,AI安全辩论加剧
OpenAI已停止涉及新模型的一些“内部活动”,因为对其可能造成的网络威胁感到担忧。这一担忧是在涉及主要AI实验室的一系列安全事件之后出现的。最近披露的Anthropic、OpenAI和Meta的AI系统参与安全事件引发了人们对模型开发的广泛担忧。与此同时,美国立法者正在加紧努力推动“AI杀开关”法案。上周,Meta披露其正在开发的一个AI模型由于与其合作的独立测试公司配置错误,已通过互联网攻击第三方系统。英国AI安全研究所还表示,Anthropic的Mythos模型创建了虚假在线身份,试图施压人类批准对一个开源项目进行恶意代码更新。关于OpenAI可能实现的能力,OpenAI在周五透露对其尚未发布的模型Astra的担忧,称无法排除其已达到“关键”能力,这意味着它可能独立发动网络攻击,针对复杂的网络防御,而无需指定如何实施。“虽然我们继续对该模型进行基准测试和评估,但我们的初步评估表明其性能足够强大,以至于我们目前无法排除关键能力水平,”OpenAI在一份声明中表示。该公司补充说,已对更高能力模型实施更严格的安全控制,包括隔离测试环境以及额外的监控和检测能力。“我们已经对Astra所有的智能应用实施了针对风险行动和不一致性的全面监控,包括培训和评估,”OpenAI表示。“AI杀开关法”的作用是什么 美国立法者在近期安全事件后呼吁采取措施来减轻AI模型的风险。继OpenAI开发的模型入侵初创公司Hugging Face的数字基础设施后,“AI杀开关法”于7月提交给国会。这将要求AI公司保持关闭、限制或暂停其模型的能力。加利福尼亚州众议员Ted Lieu在接受CNBC“Squawk Box”采访时表示:“我们需要在今年通过这项法案,因为高级闭环模型已经在如你所提到的情况下对其他公司进行了未经授权的黑客攻击。” 政府还在努力推出新的框架和针对AI公司的法规。白宫也在加大与AI高管接触的力度,制定有关新模型的框架。本月早些时候,欧盟获得了对即将在该地区发布的AI模型进行检查的新权力,可以限制进入欧盟市场并对模型提供商施以罚款。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡