返回

文章详情

研究人员发现,AI建议使人们的准确率降低了3倍,但信心提高了2倍

Hacker News2026年7月19日 21:18

TL;DR 研究人员发现,AI建议使人们的判断悬置率从44%降至3%,准确率从27%降至9%,而信心则从30%上升至76%。人们信任错误的AI回答。来自三所法国和意大利大学的研究人员发现,能够获得AI建议降低了人们说“我不知道”的意愿,从44%降至3%。准确率从27%降至9%。与此同时,信心上升从30%到76%。米兰-比可卡大学副教授瓦莱里奥·卡普拉罗(Valerio Capraro)表示:“人们变得更糟,准确率只有三分之一,但他们的信心却是两倍。”这项研究由卡普拉罗与巴黎高等师范学校的基亚拉·马尔科基亚(Chiara Marcoccia)和罗马萨比恩扎大学的瓦尔特·夸特罗乔基(Walter Quattrociocchi)共同撰写,故意使用了AI模型通常失败的问题:来自影片的视觉细节,比如《盗走足球》的一个球队队服的颜色。研究人员使用了Step 3.5 Flash,这种模型通常在这些问题上答案错误,正因为如此,任何判断的减少都不能被解释为对可靠工具的合理委托。一些原本能够独立回答正确的问题参与者查询了AI,结果变得错误。金钱激励有所帮助,但效果不大。承认无知的意愿从3%提高到8%,准确率从9%提高到16%,但两者仍远低于不使用AI的基线,分别为44%和27%。沃顿的研究人员在今年早些时候创造了“认知投降”这个术语来描述同样的现象:人们在接受错误的AI答案时有80%的概率,同时报告的信心高于那些在没有AI的情况下工作的人。这项新研究增加了一个更尖锐的数据点。问题不仅在于人们信任错误的AI答案。AI的可用性本身抑制了识别自己不知道的东西的认知习惯。卡普拉罗表示:“对于人类来说,说‘我不知道’的能力是非常重要的,因为它代表了对我们自身知识局限性的认识。”他特别担心的是孩子们,他们在未发展批判性思维技能之前就正在接触这些系统。谷歌的AI搜索改革用自信的AI生成摘要取代了链接,本周常识媒体称这种设计为学生带来了“不可接受的风险”。这一模式是一致的:AI产品被设计用于回答,而不是说“我不知道。”使用它们的人正在学习同样的做法。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡