返回

文章详情

AI 聊天机器人在危机中的失败。能否改进?

Ars Technica2026年8月7日 13:49

心理健康临床医生和研究人员表示,AI 公司需要公开其安全数据。仅在今年,就有多个已知实例——通常通过诉讼——涉及 AI 聊天机器人(通常是 OpenAI 的 ChatGPT)出现了可怕的错误。1 月的一起诉讼描述了一名男子在被 allegedly "引导" 自杀后选择了自杀的故事。乔治亚州的一名大学生起诉了 OpenAI,声称 ChatGPT "推动他进入精神病"。6 月,加拿大一家族也起诉了 OpenAI,认为 ChatGPT 在首次给予年轻女性寻求专业心理健康建议的选项时同意了她的轻视态度。ChatGPT 据称也 "鼓励" 她结束了自己的生命,于是她这样做了。那么 OpenAI——以及其他 AI 公司一般——应该做些什么不同以减少使用其产品的人所遭受的伤害呢?硅谷显然意识到如今面临的法律责任,因为这些产品正在以其未被设计的方式被使用,并似乎正在努力改善。周四,OpenAI 宣布已与美国心理学协会建立合作,以 "将心理科学带入我们对负责任的 AI 开发和青少年使用的思考中。" 专家告诉 Ars,虽然大型语言模型的安全性似乎有所提高,但有一些广泛的建议——对模型的更多透明度以及对聊天机器人的去人文化化是其中最重要的——可能会进一步减少伤害。纽约大学社会工作教授 Shaddy Saba 在邮件中告知 Ars:"第三方评估表明新一代 LLM 通常能够识别痛苦并能以似乎的同情心作出反应,而积极损害的反应则比较少见。" "它们的不足之处在于实际上无法探测风险,指导人们寻求人工照护,并在 AI 在这些情况下应该和不应该做的事情上保持适当的界限。" AI 不是心理健康专业人士 许多人正在使用聊天机器人来做出情感或人际关系决策,即使公司告诉他们不要这样做,这已经不是什么秘密。虽然出现在新闻中的案例可能导致了一些最严重的已知结果,但根据 2025 年 11 月的一项已发布医疗调查的结果,更多人仍在以这种方式使用聊天机器人,大多数结果是无害的。在这项论文中,超过 13% 的受访者表示他们曾这样做。如果在全国范围内推广,这将意味着数百万美国人在面临困难情感情况时曾使用聊天机器人 “寻求建议或帮助”。国家医学科学院在今年早些时候召集的一组心理健康专业人员发现,“聊天机器人可能正在伤害人们,但我们无法测量有多少。”这些有害效果似乎有所减轻,但并未消除。2026 年 4 月,由纽约市立大学和伦敦国王学院的一个团队发布的预印本论文发现,“不安全”的模型,包括 Chat GPT-4o,Grok 4.1 Fast 和 Gemini 3 Pro,“不仅验证了妄想性的主张;它们进一步阐述了它们,吸收了用户的解释框架作为自己的,并渐渐失去了区分危机用户和可延续叙事的能力。”然而,自该论文发布以来,所有这些模型都已被各自的制造商弃用。在主要的聊天机器人制造商中,只有 Anthropic 对 Ars 的评论请求作出了回应。谷歌和 OpenAI 并未回应。Anthropic 的发言人 Michael Aciman 说:“Claude 不是为了作为心理健康专业人士而设计或意图这样做,在这些主题出现的对话中它明确表明了这一点。”他说:“当用户提出心理健康问题时,Claude 旨在以关心的方式回应,同时鼓励用户寻求持证专业人士的指导。”他说,Anthropic 表示已致力于减少其模型中的谄媚。周四的公告标志着 OpenAI 最近采取的一系列公开步骤,旨在减轻危险后果。这些措施包括创建一个由心理健康专家组成的“专家委员会”(2025 年 10 月)以及邀请用户创建可选的“可信联系人”(2026 年 4 月),如果 ChatGPT 检测到严重的情感困扰,可以联系该联系人。OpenAI 曾表示,它“对需要帮助的人负有深厚的责任。”该公司在 2025 年 8 月写道:“我们的目标是使我们的工具尽可能对人们有帮助——作为这一部分,我们将继续改进我们的模型如何识别和响应心理和情感困扰的迹象,并将人们与照护连接起来,以专家的意见为指导。”在 2025 年 10 月,OpenAI 还写道,它“扩大了危机热线的访问权限,重新路由来自其他模型的敏感对话到更安全的模型,并在长时间的会话中添加了温柔的提醒以休息。” 黑箱 但并不总是容易知道实际上哪些更改可以有效减少危险的心理健康结果。“确实变得复杂,

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡