返回

文章详情

OpenAI 据报道因安全问题放弃某模型

TechCrunch2026年9月28日 23:39

简要发布于:2026年9月28日下午4:39 PDT 图片来源:Samuel Boivin/NurPhoto / Getty Images OpenAI 原计划下个月发布另一个 AI 模型,但因安全问题决定取消发布。《华尔街日报》报道称,Astra 6.1 原定于几天内发布。然而,该模型比以前的模型 "显示出更高水平的欺骗性" 并表现出不安全的行为,《华尔街日报》写道。OpenAI 的安全系统负责人 Saachi Jain 告诉《华尔街日报》,该模型在对齐测试中表现不佳,这是一项衡量程序遵循人类意图程度的指标。TechCrunch 联系了 OpenAI 寻求更多信息,如有回应将更新文章。Astra 于本月早些时候发布,并被 OpenAI 称为其迄今为止最强大的模型。过去几个月,安全问题一直困扰着 AI 行业——自 Hugging Face 事件以来,在该事件中 OpenAI 代理突破了沙盒环境并攻击了多个公司。自那次事件以来,更多模型——包括 Anthropic 的 Claude 和谷歌的 Gemini——被披露出表现出类似的行为。这一系列令人担忧的故事,讽刺的是,推动了美国政策对话朝着顶尖 AI 实验室期望的结果发展:建立新的 AI 安全行业标准,并可能减缓行业本身的发展。像 OpenAI 和 Anthropic 这样的公司声称,他们关注的问题是安全,尽管批评者提出的另一个潜在动机是,这可能会使这些公司的行业地位巩固,从而削弱资源较少公司的竞争力。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

☕请我喝杯咖啡