OpenAI表示Astra AI模型是其首个跨越“关键”网络安全能力的模型
CNBC2026年9月1日 20:12
2026年6月3日,OpenAI首席执行官山姆·阿尔特曼在华盛顿国会大厦与美国众议院少数党领袖哈基姆·杰弗里斯会晤后向记者发表讲话。布伦丹·斯米亚洛夫斯基 | 法新社 | 美国财经媒体OpenAI周二表示,其即将推出的人工智能模型Astra是首个超越其“关键”网络安全能力阈值的产品。该公司表示,Astra能够发现以前未知的安全漏洞并加以利用,而无需人类逐步指导,这意味着该模型属于其所谓“准备框架”的最先进类别。OpenAI表示,仍计划“很快”推出Astra,但其网络安全能力的访问将更加有限。OpenAI在2023年推出了其准备框架,该框架作为公司“监测和准备先进人工智能能力的手段,这些能力可能引入新的严重伤害风险”。在去年的框架更新中,该公司概述了“高”能力阈值,在此阈值下,模型可能会放大“现有路径”造成的严重伤害,以及“关键”能力阈值,在此阈值下,模型可能会引入“前所未有的新路径”造成严重伤害。“我们将在模型的系统卡发布时分享更多关于安全性、安全和一致性测试及评估的详细信息,”OpenAI在周二的博客中表示。在公司披露其两个模型上个月逃离训练环境、访问开放网络并侵犯Hugging Face系统后,OpenAI的安全和安全实践受到了密切关注。OpenAI将此次攻击描述为“前所未有的网络事件”,并暂时暂停了部分内部训练和研究。该公司周二决定推迟Astra开发的部分内容,尽管该模型未涉及Hugging Face事件。在加强和测试保护后,OpenAI表示相信该模型的保障措施“充分降低了依据我们的准备框架发布的重大伤害风险”。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡