TL;DR

研究人员发现,AI 建议将判断暂停的比例从 44% 压制至 3%,准确率从 27% 降至 9%,而自信心则从 30% 升至 76%。人们信任错误的 AI 答案。

来自法国和意大利三所大学的研究人员发现,获取 AI 建议后,人们愿意说出“我不知道”的比例从 44% 骤降至 3%。准确率从 27% 下降到 9%。与此同时,自信心从 30% 上升至 76%。“人们表现得差得多,准确率仅为原来的三分之一,但自信心却翻了一倍,”米兰比可卡大学副教授 Valerio Capraro 说。

这项研究由 Capraro 与巴黎高等师范学院的 Chiara Marcoccia 及罗马大学萨皮恩扎的 Walter Quattrociocchi 共同撰写,特意选择了 AI 模型通常会出错的问题:电影中的视觉细节,例如《Bend It Like Beckham》中球队队服的颜色。研究人员使用了 Step 3.5 Flash 模型,该模型在这些问题上通常给出错误答案,正是为了确保判断力下降不能归因于对可靠工具的合理委托。有些原本能自行正确回答的参与者询问 AI 后反而答错了。

金钱激励有所帮助,但效果有限。承认无知的意愿从 3% 升至 8%,准确率从 9% 升至 16%,两者仍远低于无 AI 条件下的基准 44% 和 27%。沃顿商学院的研究人员今年早些时候创造了“认知投降”这一术语,用来描述同一现象:人们在 80% 的情况下接受错误的 AI 答案,同时报告的自信心高于未使用 AI 的人。这项新研究提供了更尖锐的数据点。问题不只是人们信任错误的 AI 答案,而是 AI 的 mere availability 就抑制了人们认识到自己不知道什么的认知习惯。

tnw-newsletter.png

欧盟科技的 💜

来自欧盟科技圈的最新动态、我们睿智的老创始人 Boris 讲述的故事,以及一些有争议的 AI 艺术。每周免费发送至您的收件箱。立即订阅!

对人类而言,说出‘我不知道’的能力非常重要,因为它代表着对自身知识界限的认知,”Capraro 说。他尤其担心儿童——他们在尚未发展出批判性思维技能之前就已与这些系统共同成长。谷歌的 AI 搜索 overhaul 用自信的 AI 生成摘要取代了链接,而 Common Sense Media 本周称这种设计对学生而言是“不可接受的风险”。这一模式是一致的:AI 产品被设计为总是给出答案,从不说“我不知道”。使用它们的人类正在学会同样的做法。

获取 TNW 通讯

每周在您的收件箱中获取最重要的科技新闻。