IT之家7月20日消息,2026年,AI依然会出现“幻觉”(hallucination),并且经常给出错误答案。

然而,法国和意大利多所大学的研究人员发现,获得AI 建议后,人类的批判性思维能力可能会受到削弱,使人们更容易自信地复述 AI 提供的错误信息。


AI会削弱人类批判性思维

“对于人类来说,能够说‘我不知道’这一能力非常重要,因为这代表我们意识到了自身知识的局限。”米兰比可卡大学副教授 Valerio Capraro 在接受采访时表示,“但如今借助 AI,我们几乎可以轻松获得任何问题的答案。因此,我们想知道,这是否会影响人类承认‘我不知道’、暂缓判断的能力。”

Capraro 与 École Normale Supérieure(法国高等师范学院)的 Chiara Marcoccia,以及罗马第一大学(Sapienza University of Rome)的 Walter Quattrociocchi 共同开展了一项研究,试图了解 AI 如何影响人们承认自己无知的意愿。

论文标题直接揭示了研究结论:《AI 建议会降低人们说“我不知道”的意愿,即使 AI 给出的建议是错误的且准确性是被鼓励的》。

AI 建议让人更少承认“不知道”

Capraro 表示,他和团队设计了一组大型语言模型通常无法正确回答的问题。

据IT之家了解,在实验中,他们要求参与者回答一些关于电影视觉细节的问题,例如《我爱贝克汉姆》(Bend It Like Beckham)中球队球衣的颜色,或者电影《高速路上一只猫》(Like a Cat on a Highway)中 Monica 驾驶的车辆类型。

研究人员预计,这类细节通常不会出现在大多数 AI 模型的训练数据中,而实验所使用的模型(Step 3.5 Flash)也确实经常无法回答这些问题。

他们还测试了目前较新的前沿模型,包括 GPT-5.5、Claude Sonnet 4.6和 Gemini 3.5 Flash。这些模型虽然在车辆问题上表现不佳,但经常能够正确回答其他细节问题。

研究人员选择 Step 3.5 Flash 的原因是,该模型在实验中通常会给出错误答案,这可以避免有人认为参与者只是合理地把判断权交给了一个可靠工具。

“我们将参与者分成两组。”Capraro 解释道,“一组需要在没有 AI 建议的情况下回答问题,另一组则可以向 AI 请求帮助。结果发现,在没有 AI 的情况下,有44% 的人选择回答‘我不知道’,也就是暂缓判断。而在可以获得 AI 建议后,只有3% 的人这么做。也就是说,人们暂停判断的能力几乎崩溃了。”

AI 降低准确率,却提高自信程度

Capraro 表示,更令人意外的是,当 AI 提供帮助时,参与者的回答准确率也明显下降。换句话说,人们开始更加相信 AI 的答案,而不是自己的判断。

“在没有 AI 的情况下,有27% 的人给出了正确答案。”他说,“但在获得 AI 建议后,只有9% 的人回答正确。因此,一些原本可能答对的人,在询问 AI 后反而得到了错误答案。”

与此同时,AI 建议还显著提高了人们对自身答案的信心。Capraro 表示,在没有 AI 帮助时,参与者认为自己正确的比例约为30%;而在使用 AI 后,这一比例上升到了76%。

也就是说,即使 AI 存在幻觉问题,人们依然会相信它提供的信息。

“简单来说,人们的表现变得更差 —— 准确率只有原来的三分之一,但他们的自信程度却提高了一倍。”Capraro 说道。

金钱激励能改善情况,但效果有限

研究人员还进行了另一项实验,引入金钱奖励机制,希望鼓励参与者更加谨慎地判断。

结果显示,金钱激励确实带来了一定改善。选择暂缓判断、承认“不知道”的比例从3% 提升到了8%;回答正确的比例也从9% 提升到了16%。

不过,这两个数字仍然明显低于没有 AI 时的水平 —— 分别为44% 和27%。

虽然研究人员选择的是电影细节类问题,但他们认为,这一发现可以推广到其他领域。

Capraro 表示,他认为这一问题需要通过社会层面的 AI 素养教育和教育政策来解决。“当然,模型提供商也应该努力改善这一问题,但我认为双方的利益并不完全一致。”他说,“更有希望的解决方式,可能是在教育层面进行干预。”

Capraro 特别担心 AI 对儿童成长带来的影响。

“成年人已经通过过去的学习经历培养了一定的批判性思维能力。”他说,“但对于那些从出生起就伴随着这些系统成长的孩子来说,风险在于,他们甚至可能无法真正学会最基本的批判性思考能力。”