返回

文章详情

应对关键网络能力的下一个前沿

Hacker News2026年8月7日 16:39

网络安全正在迅速变化,模型在各种方面的能力不断增强,这既可以加强网络防御,也能够以前所未有的速度和规模实施攻击。我们对即将推出的模型Astra在过去几天的内部评估显示出在代理编码和网络安全方面的显著进展。这些结果,加上专家评估,促使我们昨晚得出结论,我们不能排除在我们的准备框架下出现关键网络能力的可能性。我们分享这一信息,因为我们认为向公众和安全社区透明这一潜在能力的转变是重要的。我们首次在2023年12月发布了我们的准备框架,远在模型达到生物、化学、网络安全和人工智能自我提升能力的这一水平之前。我们创建该框架是为了为我们识别能力进展提供指导,并计划在这些能力出现时我们公司将会采取的行动。之前的模型,包括GPT-5.6-Sol,已经在前沿网络能力方面进行了评估,并被评测为高(而非关键)阈值。测量关键网络安全能力根据我们的准备框架,如果一个模型能够识别并开发出所有严重级别的功能性零日漏洞,且能够在许多经过强化的现实世界关键系统中无需人工干预,或者能够根据仅给出一个高水平的期望目标设计和执行端到端的新网络攻击策略,那么该模型就达到了关键的网络安全阈值。虽然我们继续对该模型进行基准测试和评估,但我们的初步评估表明其性能强劲,以至于我们此时不能排除关键能力水平。Astra是一个即将推出的模型,并未涉及利用Hugging Face。我们采取的步骤因此,我们已扩大了我们的安全保障和安全控制的稳健性测试,以便它们适合于这些能力的部署。内部,我们还采取了以下步骤,以确保该模型的进一步开发安全且可靠:我们正在为更高能力的模型及相关活动实施更严格的安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重保护和加密、额外的监控和检测能力,以及沙盒执行。我们正在暂停与Astra相关的内部活动,这些活动尚未满足这些强化安全控制的要求。我们已经对Astra的所有代理应用实施了普遍监控,以监测风险行为和不一致,包括训练和评估。监视器评估模型的思维链,并触发安全响应,以审查和中断高风险活动。我们将与相关政府机构和特定的人工智能安全组织合作,测试该模型的能力。我们将为第三方测试合作伙伴提供推荐的安全控制,以安全地运行更高风险的评估和工作负载。该框架已经引导我们通过其他能力转变。在2025年6月,当我们的模型在准备框架下达到生物学的高能力阈值时,我们概述了为加强保障、扩大测试、与外部专家合作和部署额外安全控制而采取的步骤。我们在这里应用相同的原则。我们相信,具备高级网络能力的模型应该帮助防御者在攻击者之前识别和解决漏洞。我们致力于与各国政府、安全机构和民间社会合作,确保像Astra这样的模型及后续模型的前沿能力得到负责任和广泛的部署,以造福全人类。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡