TL;DR

研究人員發現,AI 建議使人們放棄判斷的比例從 44% 降至 3%,準確度從 27% 降至 9%,同時自信程度從 30% 上升至 76%。人們會相信 AI 給出的錯誤答案。

來自法國與義大利三所大學的研究人員發現,取得 AI 建議後,人們願意說「我不知道」的比例從 44% 暴跌至 3%。準確度從 27% 下降至 9%。同時,自信程度則從 30% 上升至 76%。米蘭比可卡大學副教授 Valerio Capraro 表示:「人們變得更差,準確度只有原本的三分之一,但自信程度卻是原本的兩倍。」

這項研究由 Capraro 與 École Normale Supérieure 的 Chiara Marcoccia 及羅馬大學的 Walter Quattrociocchi 共同撰寫,刻意選擇 AI 模型通常會答錯的問題:電影中的視覺細節,例如《一球成名》中球隊制服的顏色。研究人員使用了 Step 3.5 Flash 模型,該模型在這些問題上通常會答錯,目的是確保任何判斷能力的下降無法歸因於合理地委託可靠工具。部分原本可以自行答對的參與者,在詢問 AI 後反而答錯。

金錢誘因有幫助,但效果有限。承認無知的意願從 3% 上升至 8%,準確度則從 9% 上升至 16%,兩者仍遠低於無 AI 情況下的基準值 44% 與 27%。沃頓商學院的研究人員今年稍早提出「認知投降」一詞,用來描述同樣的現象:人們有 80% 的時間會接受 AI 的錯誤答案,同時回報的自信程度高於未使用 AI 的人。這項新研究提供了更精確的數據點。問題不僅在於人們相信 AI 的錯誤答案,更在於 AI 的存在本身就抑制了人們認知「自己不知道什麼」的習慣。

tnw-newsletter.png

The 💜 of EU tech

來自歐洲科技圈的最新動態、我們睿智的創辦人 Boris 撰寫的故事,以及一些值得商榷的 AI 藝術作品。每週免費寄送至您的收件匣,立即註冊!

對人類而言,能夠說『我不知道』非常重要,因為這代表認知到自身知識的極限」,Capraro 表示。他特別擔心兒童,他們在尚未發展出批判性思考能力之前就已開始使用這些系統。Google 的 AI 搜尋改版以自信的 AI 生成摘要取代連結,而 Common Sense Media 本週指出,這種設計對學生而言是「無法接受的風險」。模式始終如一:AI 產品被設計成只會回答,而不會說「我不知道」。使用它們的人類也正在學習同樣的做法。

Get the TNW newsletter

Get the most important tech news in your inbox each week.