3132人实验:用了AI之后,人们几乎不再说“我不知道”,答对率却从27.5%掉到9.2%

AI资讯52分钟前发布 ingrid
3K 0

先看一组对比:自信心从 29.6 分涨到 75.9 分(满分 100),答对率从 27.5% 跌到 9.2%。

这是一项涉及 3132 名参与者、共五个实验的研究给出的结果。研究者挑的都是容易让大模型产生幻觉的冷门细节题,让参与者在有、无 AI 帮助两种条件下作答,用到的模型包括 GPT-5.5、Claude 4.6 Sonnet、Gemini 3.5 Flash 和 Step 3.5 Flash 等。

关键指标是“放弃作答”。

没有 AI 的时候,参与者对 36% 到 44% 的题目选择不答,也就是老老实实承认“我不知道”。拿到 AI 的建议之后,这个比例掉到 3% 到 6%。几乎所有人都愿意给出一个答案了,可这些题本来就是模型容易答错的类型,于是出现了开头那组数字:人更笃定,也错得更多。即便 AI 给的是错误建议,参与者依然倾向于照单全收。

研究者试过用钱来纠正。答对有奖励、答错要扣钱,这个设计确实让人少向 AI 求助了一些,但没有从根上扭转对 AI 的过度信任。更接近日常的一组实验是模拟现在搜索引擎和写作助手的做法,不等用户开口,直接把 AI 生成的答案摆在面前。在这种条件下,哪怕有经济激励,选择不作答的比例也从 39% 掉到了 7%。

研究人员把这种现象叫作一种新型的轻信:AI 的表达太流畅了,流畅到让人忘了自己原本不知道。过去人们向别人求助时,通常还会留一点自己的判断,这个习惯在面对 AI 时被打破了。此前微软和一些学术机构也发现过 AI 会削弱人的批判性思维,这项研究等于从“敢不敢说不知道”这个角度又补了一刀。

对做产品的人来说,那个自动展示答案的实验最刺眼,因为这正是现在最常见的设计。

© 版权声明

相关文章

3132人实验:用了AI之后,人们几乎不再说“我不知道”,答对率却从27.5%掉到9.2% 暂无评论

none
暂无评论...