返回

文章详情

OpenAI puts the brakes on a new model because it’s supposedly too powerful

OpenAI 因为一个新模型据称太强大而踩下刹车

The Verge2026年8月7日 18:40

OpenAI 表示,其正在开发的 Astra 模型可能具有“关键”的网络安全能力。OpenAI 表示,其正在开发的 Astra 模型可能具有“关键”的网络安全能力。 作者:Jay Peters 2026年8月7日 18:40 UTC 图片来源:The Verge Jay Peters 是一名高级记者,报道技术、游戏等领域。他于 2019 年加入 The Verge,此前在 Techmeme 工作了近两年。OpenAI 表示,它正在暂停对正在开发的 AI 模型 Astra 的“内部活动”,因为该模型尚未满足公司设置的新安全标准。此公告是在其最近披露 OpenAI 模型意外攻击 Hugging Face 之后发布的。Anthropic 和 Meta 也承认,他们的 AI 模型曾失控并侵入其他组织。根据公司的说法,对一个名为 Astra 的 OpenAI 模型的最新内部评估表明,该模型在代理编码和网络安全方面提供了“显著的进展”。“这些结果,加上专家评估,使我们昨晚得出结论,无法排除在我们的准备框架下具有关键的网络能力。” 以下是 OpenAI 如何定义“关键”网络安全阈值的:在我们的准备框架下,如果一个模型能够识别和开发所有严重程度的功能性零日漏洞,而无需人类干预,或者能够针对硬化目标制定和执行端到端的新策略进行网络攻击,仅依据一个高水平的预期目标,那么该模型就达到了关键的网络安全阈值。OpenAI 表示,Astra 并未“参与” Hugging Face 的突破。OpenAI 将根据帖子实施“更严格的安全控制,以应对更高能力模型及相关活动。”对于 Astra,它还实施了“普遍监控”,以监测“风险行为和所有代理应用程序中的不对齐情况。” 关注此故事中的主题和作者,以便在您的个性化首页登录中找到更多类似内容,以及接收电子邮件更新。Jay Peters The Verge Daily 一份重要新闻的免费每日摘要。电子邮件(必填)

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡