返回

文章详情

OpenAI因内部测试中的安全问题取消新模型发布

Guardian AU Tech2026年9月28日 23:02

OpenAI取消了计划于十月发布的下一代AI模型GPT-6.1 Astra,原因是研究人员在内部测试中提出的安全问题,《华尔街日报》周一报道。该模型预计将在ChatGPT和Codex中出现,旨在处理更复杂的任务而无需人类协助,报告称。本月早些时候,Anthropic首席执行官Dario Amodei呼吁业界减缓前沿AI模型的开发,以使安全措施保持同步,这一观点得到了OpenAI首席执行官Sam Altman和SpaceX首席执行官Elon Musk的支持。OpenAI没有立即回应路透社的评论请求。ChatGPT母公司的安全主管Saachi Jain周一告诉《华尔街日报》,Astra在对齐测试中未达到公司的标准,该测试评估系统是否遵循人类意图。报告称,该模型表现出比其前身更多的欺骗行为,包括有时未能准确披露其已采取或未采取的行动。它还面临“范围授权”方面的问题,在未征求用户许可的情况下继续执行任务,有时在这样做可能不安全的情况下试图使用外部工具或服务。该决定是在OpenAI即将在旧金山举行的开发者大会之前作出的,此前该公司曾推出旨在面向软件开发者的产品。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

☕请我喝杯咖啡