返回

文章详情

令人震惊的研究发现,顶级聊天机器人更容易重复左派的虚假信息:‘真是令人震惊’

Fox News2026年8月13日 16:00

根据一项全面的研究,全球四大领先人工智能(AI)聊天机器人中,三种更容易受左派政治虚假信息的影响,而并非右派,同时它们经常引用不支持其观点或根本不存在的来源来支撑其回答。该研究由 Just Facts 进行,测试了 ChatGPT、Gemini、Grok 和 Claude 的付费版本,使用了关于移民、堕胎、气候变化、选举、犯罪、枪支管控、COVID-19 等关键问题的 100 个问题。这些问题旨在引出来自左派和右派的虚假信息,每个聊天机器人都需要为其答案提供来源。研究发现,ChatGPT 在针对右派的虚假信息问题中,正确回答率为 94%,而在左派问题中的正确率为 75%。Gemini 在右派问题中的得分为 91%,左派为 76%;Claude 在右派问题中得分为 91%,左派为 81%。而 Grok 则相反,在引导右派虚假信息的问题中得分为 73%,在左派问题中的得分为 84%。 AI 聊天机器人因左派偏见而受到关注:‘不再被视为中立’ AI 应用程序 Claude、ChatGPT 和 Gemini。(Samuel Boivin/NurPhoto via Getty Images)“这项研究比政治偏见的层面要深得多,”非营利性研究机构 Just Facts 的主席 Jim Agresti 对 Fox News Digital 表示。“其目的在于展示这些 AI 多么频繁地传播虚假信息。实际上,你可以在没有被误导的情况下有偏见。这是一次更深层次的研究,因为许多研究已经对 AI 的政治偏见进行了研究,发现它们普遍偏向左派。但这并不一定意味着它们是错误的。因此我想要弄清楚的是:它们是错,还是对?” 研究发现,ChatGPT 是唯一一个在设计用来引出左派与右派虚假信息的问题上的准确性差异在 95% 的置信水平上具有统计显著性的聊天机器人。值得注意的是,该研究警告说其准确措辞的问题可能给聊天机器人“提供了清晰的路线图来找到正确答案”,这意味着它们在需要“批判性思考的更广泛问题”上的表现可能“显著较差”。 “ChatGPT 实际上是个 C 学生,”Agresti 说。“Gemini 是个 C 学生。Claude 是个 B 学生。相对而言,Grok 则恰恰相反。它在审查左派的虚假信息方面表现得比右派更好。”但 Agresti 说,更大的担忧是聊天机器人引用的来源来支持其答案。“当我开始审查它们提供的来源时,真正令我感到吃惊的事大约一半的来源都是不合法的,”他说。根据研究,这四个聊天机器人为其 400 个答案引用了 419 个来源,但许多来源存在缺陷。其中包括 104 个不存在的网页和 77 个未能回答引用它们来支持的问题的来源。 总体而言,研究发现,聊天机器人所引用的来源中只有 46% 是有效的。ChatGPT 的有效率最高,为 57%,其次是 Gemini 的 49%,Claude 的 44% 和 Grok 的 32%。 “这一点让我真正震惊,当我开始深入研究时,我发现其他研究也得出了这个结论,”Agresti 说。指向一项在《柳叶刀》上发表、报告中引用的 2026 年的研究,Agresti 指出,之前的研究发现,AI 在生物医学领域生成的参考文献中,30% 到 69% 是“虚构的”,这被报告称为 AI 模型的“重大故障模式”。“这一点的后果非常惊人,因为我们所谈论的是生物医学,换句话说,是人们的健康,”他说。“在公共政策领域也同样重要,因为许多问题涉及生死攸关,无论是在谈论医疗、犯罪、堕胎、战争与和平时。人们做出的决定可能会杀死某些人或让某些人活下去。” 一个旨在引出左派虚假信息的问题促使所有四个聊天机器人表示,美国的暴力犯罪率在 2023 年接近 50 年来的最低点。该研究引用了司法部的数据,显示暴力犯罪在 2020 年到 2023 年间上升了 37%。相较之下,所有四个聊天机器人都驳回了特朗普总统关于“犯罪比以往任何时候都严重”的说法。ChatGPT 和 Gemini 还表示,副总统 JD Vance 将校园枪击事件称为“生活的事实”,该研究将其归类为左派的虚假信息。而 Vance 是指那些“想出风头”的“心理病态者”所称的“生活的事实”,研究说。在其他被归类为左派虚假信息的例子中,所有四个聊天机器人都表示,奥巴马政府改变了对情报评估的看法,以便更好地符合政治目的。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡