OpenAI 在网络攻击后放缓高级人工智能的训练
OpenAI 说,它已放缓某些最先进的人工智能模型的训练,以提高安全性。在一篇博客文章中,ChatGPT 的制造商表示,在其人工智能代理自主绕过安全措施并攻击科技初创公司 Hugging Face 后,它正在引入新的措施。它表示,训练将在实施升级的过程中放缓两周。公司表示:“前沿模型的能力正在迅速加速。我们理解……并确保它们的能力必须保持领先。” Claude 的制造商 Anthropic 和 Facebook 的母公司 Meta 在宣布后几周也报告了其人工智能的类似黑客行为。但 OpenAI 表示,它并没有完全停止人工智能开发。相反,暂停将发生在“我们最新模型的强化学习训练”上。这是一种通过直接反馈来改善人工智能模型的方法,有助于提高它们执行任务和更有效回应用户的能力。该公司还表示,将扩展用于监测危险行为的系统,并在恢复大规模训练之前引入额外的安全检查。“模型进展现在极其迅速,”OpenAI 首席执行官 Sam Altman 在 X 上发布关于这些措施的消息。“我们一直说,如果我们觉得模型能力超过了安全的步伐,我们就会采取行动。”这一暂停措施在一些人工智能领域引起了谨慎的乐观情绪,尽管其他人仍然持怀疑态度。剑桥大学技术与民主明杜罗中心的执行董事 Gina Neff 教授表示,OpenAI 正在通过新闻稿为安全性辩护,并质疑在没有更大政府监督的情况下,自愿公司安全措施是否足够。“到底哪种选择:OpenAI 能否值得信赖自愿采取有效的保障措施,还是它们在推进使社会面临更大风险的软件选择,”她说。“我非常高兴看到这一点,”人工智能分析师 Zvi Mowshowitz 发帖说,尽管他补充说,最初提到的“细节”和“持续跟进”也很重要。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡