正在加载文章内容,请稍候。
正在加载文章内容,请稍候。
达宁—克鲁格效应常被简化为“无知者更自信”,但现实还受到统计回归、动机偏差和知识诅咒影响。文章说明低水平者为何高估自己、高水平者为何也可能误判优势,并提醒这种元认知偏差会在人人不熟悉的领域出现。

✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可保存笔记、高亮、划线和批注。
精准输入
“达宁—克鲁格效应”常被当成嘲笑无知者的标签,但提出者大卫·达宁(David Dunning)希望它促使人自省。本文从作者在舞蹈课上突然发现自己“不知道自己不知道什么”写起,回到 1999 年实验、元认知机制、统计争议和 AI 新问题,并追问人如何识别能力边界。

几年前,我开始上 House 舞课程。此前二十多年,我一直在锐舞派对和聚会上跳舞,常有人称赞,甚至问我是不是专业舞者。进工作室前,我有理由相信自己不会太差;可我立刻成了教室后排最笨拙的人。我此前并不知道自己不知道什么。
这段经历体现了心理学与大众文化中经常被引用、也持续受到争论的“达宁—克鲁格效应”。
1999 年,时任康奈尔大学心理学家的大卫·达宁和研究生贾斯廷·克鲁格(Justin Kruger)发表奠基论文《无能且无知》。他们用四项实验测试大学生的幽默、逻辑和语法能力,并要求参与者估计自己的绝对与相对成绩。反复出现的关键结果是:成绩最低四分位的人大幅高估自己,在一些研究里实际约第 10 百分位,却平均估成第 60 百分位。成绩最高四分位的人则经常低估自己的相对优势,不过幅度较小。
两人推测,完成任务所需的技能与判断完成质量所需的技能重叠,所以表现差的人也缺乏发现失败的元认知。再叠加普遍存在的“优于平均效应”,最低水平者便高估得最厉害。高水平者同样认为自己高于平均,却因“知识诅咒”误以为别人也拥有自己的知识,低估了领先幅度。
学术论文进入大众文化后往往会被误解。达宁如今任职于密歇根大学,仍积极捍卫该机制,也在探索它的新表现。他甚至把名字变成形容词:每个人一生中某些时刻都会处于“达宁—克鲁格”状态。

你们 1999 年论文的起源是什么?
我一直反复研究一个问题:人有多了解自己?观察办公室里的学生、教师会议和 C-SPAN 时,我常听见人们说出——委婉地讲——荒唐的话。他们理应知道那不可能是真的。有学生来办公室,“慷慨”地给我机会承认:考试中被我判定为正确的答案其实错了。
克鲁格读研第一年说想和我合作。我问:人多大程度知道自己正在犯错?于是我们用逻辑、语法和辨认笑话等测试,看表现很差的人是否意识得到。第一批数据令人震惊。我们知道人会高估自己,却没想到幅度那么大。
物理、国际象棋、网球、阅读、驾驶和社交研究早已发现无知带来自信,你们的新发现是什么?
我们把它量化,并给出正式心理学分析:作出判断时的认知,与评价这个判断时的元认知,是两回事。
这个效应只包括低水平者过度自信,也包括高水平者信心不足吗?
关于知识渊博者的“知识诅咒”,早已有大量研究。医生常不善沟通,就是因为他们以为你知道肾脏在哪里,也知道某种药物会影响心脏。
你把知识诅咒也算作达宁—克鲁格效应吗?
不算。顺便说,我们没有给它起这个名字;多年后,网上有人谈论“达宁—克鲁格综合征”,又建立了 Wikipedia 页面。许多人把效应简化成“底层的人不知道自己在底层”,到此为止;但效应还包括把能力失败与判断失败连接起来的机制。
今天有什么醒目的例子?
AI 最有意思。第一个问题是聊天机器人会不会出现达宁—克鲁格效应?会。除少数例外,它们不知道何时应因不确定而收手。有人编造短语让聊天机器人解释,模型会硬给答案,而不是承认不知道。第二个问题是聊天机器人会不会把这种效应带给人?一项研究发现,它反转了传统模式,让最佳表现者比最差者更加过度自信。另有研究显示,人们判断真假新闻的能力也很“达宁—克鲁格”。
还有教授允许学生在觉得自己会落入班级后 50% 时购买保险,但几乎没人买;错误估计会直接导致无效行为。其他研究则发现,最可能拒绝科学共识的人,往往科学知识最少,却对自己的科学知识最有信心。
聊天机器人奉承用户的 AI 谄媚,会加剧这种效应吗?
会。人过度自信的一个原因,就是倾向寻找支持自己观点的理由。重要决策时,我们一直建议停下来问:“我为什么可能错?”团队规划可以做“事前验尸”:想象项目未来惨败,再追问什么导致了失败,以及现在能如何防止。
医生也这样做,只是称为“鉴别诊断”。他们可能先想到莱姆病,但必须追问症状还符合什么,再用检测逐一排除。医学的核心就是思考替代解释,以及自己可能错在哪里。
原论文提到“动机偏差”:人害怕寻找自己错误的理由,也害怕把自己想成笨蛋。承认人有多种智力和技能,是否会让人更愿意接受特定领域的负面反馈?
当然。达宁—克鲁格效应与“愚蠢”无关,它关乎每个人。有人有特别精彩的失败故事,但人人都有能力洼地。重点不是笨,而是谨慎与明智;人也会成长和改变,所以应让自己更可能成功。
有人用这个效应解释政治对手为何“蠢到不知道自己错了”。这是能力问题,还是意识形态动机?
人可能愚蠢,也可能受意识形态驱动。我希望人们不要再互相喊“达宁—克鲁格”。我们写论文是为了自省。以前我在 Twitter 上看到大家骂别人“你这个达宁—克鲁格蠢货”,心想:糟了。它变成攻击别人的称号,是我最大的遗憾;人应该偶尔把它扔向自己。
我们怎样检查盲点?
最好的办法是借助他人。当然,对方必须勇敢,愿意告诉你错了。我希望我们更擅长指出彼此的盲点。
过度自信有好处吗?
自信并不坏,但要管理。准备阶段不要过度自信,宁可信心不足并多做准备;上战场或参加奥运会,不能因为相信自己会赢就不训练。真正执行的那一天,则应保持极高自信,因为它会带来回报。
什么时候最该警惕达宁—克鲁格效应?
当实际表现与判断表现所需能力高度重叠时。逻辑几乎完全重叠,体育则不一定。我知道自己高尔夫打得很差,因为球会右偏,树木和毒藤会告诉我。也要警惕缺少外部参照。我曾以为自己大提琴拉得不错,直到听见雅克琳·杜普蕾(Jacqueline du Pré)的录音,才知道这种乐器竟能那样演奏。
研究显示,人做难题时过度自信,做简单题时反而信心不足。
没错。信心通常保持在中高水平,因为人已经得出了自己能想到的最佳答案。难题上,这个答案常常错误;简单题上则几乎总正确。我们作出决定后便会去执行,仿佛被自己的选择俘虏。除了《宋飞正传》里的乔治·科斯坦萨,没人会把原本要做的事全部反过来。
批评者说,达宁—克鲁格效应只是“向均值回归”:技能和技能估计都是有噪声的测量,极高或极低的第一次测量,第二次自然更靠近中间。你怎么看?
这忽略了纠正向均值回归的成熟方法。流行病学、经济学和心理学都有标准校正手段;校正只会稍微削弱效应。
有些研究还有方法问题。例如让人做完智商测试后,以 1 到 25 给自己的智力打分,再假定打 25 的人认为自己 IQ 160、打 1 的人认为自己 IQ 40。这是很大的假设,我不会把这种想法塞进参与者脑中,也不会询问“智力”这样含义因人而异的宽泛能力。
另一个例子反而漂亮地支持原框架。研究者在统计上把“判断表现的能力”与“产生优质表现的能力”分开,发现高水平者判断表现并不比低水平者更好,于是声称我们错了。但分开之前,高水平者的判断确实更准确,正因为专业知识同时帮助了表现与判断。这恰恰是 1999 年论文所说的机制;现实生活中两者不会被统计分离。
这些年,你对效应的理解有变化吗?
我越来越看重这样一个事实:我们生活在自身知识的泡泡里。最近研究显示,专家更能判断自己何时正确、何时错误;但有一个转折:专家一旦错了,确信自己正确的程度甚至高于新手。我们反复看到这种现象。
专家犯错时比非专家更自信,似乎与达宁—克鲁格效应相反。
总体上,专家更常正确,也更知道自己何时正确;但他们必须明白,高度自信并不能保证不会出错。
这是否类似“诺贝尔病”——诺奖得主对不熟悉的领域也高谈阔论?
诺贝尔病是另一种综合征,也叫“认识论越界”。疫情期间到处都是:人们对疫苗和流行病学发表意见,明明没有资格,却觉得“我有哈佛学位,这就够了”。许多人凭自身的软性线索判断能力,却不知道自己的能力圈边界;拿到诺奖后,这种倾向会达到顶点。
这关乎“专家”的地理边界。我们刚发表一篇论文:人开始上心理学与法律课程后,会觉得自己知道一些根本不可能知道的东西。结课时,学生不仅声称知道真正讲过的心理—法律概念,也声称知道从未讲过、其实由研究人员捏造的概念。知道与不知道的边界是模糊的;活在自身经验的泡泡里,是人类一个深刻特征。
文章从低水平者高估自己这一经典发现出发,逐步补全元认知机制、知识诅咒、动机偏差和外部参照的作用,再把效应延伸到 AI、假新闻与专家越界。统计上的向均值回归能削弱图形,却不能消除“同一份专业能力同时支撑表现和判断”的现实机制。达宁最终反对把效应当作辱骂他人的标签:它真正要求人管理自信、寻找反证、借助勇敢的他人,并持续辨认自己能力圈模糊的边界。
费曼输出