🪤 思维陷阱 · 思维陷阱·经典关卡

直觉反射陷阱:CRT 认知反射测验三题、System 1 与 System 2 双系统、认知吝啬鬼——为什么一半 MIT 学生也答错,直觉何时才可信|思维陷阱

从球拍与球到荷叶翻倍——三道 CRT『小学算术』难倒一半 MIT 学生;认识 System 1 的抢答、System 2 的偷懒与认知吝啬鬼,学会在关键时刻按下慢想开关

一句话先懂 · TL;DR

一节先让你中招、再帮你免疫的直觉陷阱入门课。开头就是三道 CRT 认知反射测验原题:球拍和球(直觉 10 美分,正确 5 美分)、机器造零件(直觉 100 分钟,正确 5 分钟)、荷叶翻倍盖满湖(直觉 24 天,正确 47 天)。Frederick (2005) 对 3,428 人施测:平均只答对 1.24 题,33% 全错、仅 17% 全对;MIT 均分 2.18 全场最高,也只有 48% 的人三题全对。课程拆解背后机制:Stanovich & West (2000) 命名、Kahneman《思考,快与慢》普及的 System 1/System 2 双系统;Fiske & Taylor (1984) 的认知吝啬鬼;答错的人反而估计 92% 的人会做对的『无警报中招』;West 等 (2012) 认知能力越高偏差盲点反而越大的证据;以及 Kahneman & Klein (2009) 直觉可信的两个必要条件——高效度环境+长期练习与及时反馈。破除『聪明人免疫』『System 1 是坏的』两大误区,装上按场景切换的慢想开关。

先别翻答案:一支球拍和一颗球,难倒半个 MIT

开课先做题,别紧张,就一道小学算术:

球拍和球一共 1.10 美元,球拍比球贵 1 美元。请问:球多少钱?

先别往下翻——3 秒内,在心里说出你的答案。

……

有了吗?如果你心里冒出来的是「10 美分」——恭喜,你和哈佛、MIT、普林斯顿一半以上的学生站在同一边:都错了。验算一下就露馅:球若是 10 美分,球拍比它贵 1 美元就是 1.10 美元,两样加起来 1.20 美元,超了。正确答案是 5 美分(球 0.05 + 球拍 1.05 = 1.10)。这是 Frederick (2005) 认知反射测验(CRT)的第一题,也是整个『直觉陷阱』研究里最出名的一道题。

为什么几乎人人的第一反应都是 10 美分?因为你脑子里跑着两套流程:

- System 1:自动、快速、几乎不占注意力、想关都关不掉——比如一眼认出熟人的脸;
- System 2:缓慢、串行、费力,需要动机和注意力——比如不用计算器硬算 √19163。

这对术语由 Stanovich 和 West 在 2000 年命名,后来被 Kahneman 的《思考,快与慢》(2011) 借用并普及成全书框架。直觉陷阱的机制就藏在两者的交接处:System 1 先抢答一个听起来顺滑的候选答案(『1.10 拆成 1 块和 1 毛,多顺!』),而 System 2 常常连看都不看一眼就签字背书。 所以 CRT 测的从来不是算术,而是:你能不能摁住那个脱口而出的答案。

⚠️中招真的不丢人。 Frederick (2005) 在 26 个月里、35 项独立研究中对 3,428 人施测 CRT 三题:总平均只答对 1.24 题,33% 的人全错,只有 17% 三题全对。分校看更扎心:MIT 均分 2.18 全场最高,普林斯顿 1.63,哈佛 1.43,托莱多大学 0.57——就算在 MIT,也只有 48% 的人三题全对。三道『小学算术』,难倒了顶尖理工学生的一半。
系统1抢答、系统2打瞌睡盖章——大多数错误从这里开始

机器题:为什么中招的瞬间,你连一点感觉都没有

再来一道,还是 3 秒规则,心里作答:

5 台机器 5 分钟造 5 个零件。100 台机器造 100 个零件,要多久?

……

答「100 分钟」的请举手。正确答案是 5 分钟:每台机器 5 分钟造 1 个零件,100 台同时开工,5 分钟自然出 100 个。这是 CRT 第二题。Frederick 还在卷面上发现一个可爱的细节:答对的人也常常先想到错误答案——纸上经常看到 10 美分被划掉改成 5 美分,却从未见过反向修改。直觉答案人人都会先冒出来,差别只在你放不放它出门。

这背后是大脑的出厂设置:认知吝啬鬼(cognitive miser)——Fiske 和 Taylor 在《Social Cognition》(1984) 提出:人处理信息时倾向选最省力的捷径和现成图式,而不是像此前『朴素科学家』模型假设的那样收集齐证据再推理。Kahneman 管同一现象叫最省力法则:System 2 天性懒惰,System 1 递上来的流畅答案往往未经复核就被签收。Stanovich 更进一步,把这种『吝啬式加工』视为聪明人也做蠢决定(dysrationalia)的核心机制。

注意:吝啬不是缺陷,是节能设计。 大脑要是事事深想,你连早饭吃什么都得开董事会。绝大多数时候捷径够用——陷阱题只是精准踩在它失灵的位置。证据?Frederick 把题面改成不诱发直觉的同构题(香蕉与贝果共 37 美分、香蕉贵 13 美分),错误率大幅下降:数学没变,变的只是那个『顺滑假答案』消失了。

⚠️最吓人的一条数据。 Frederick 让受访者估计『其他人做对球拍与球问题的比例』——给出错误答案「10 美分」的人,平均估计 92% 的人会做对;答对「5 美分」的人反而只估 62%。也就是说:答错的人比答对的人更觉得这题容易。 中招的瞬间没有任何主观警报,没有『咦,好像哪里不对』,只有一片『这题也太简单了吧』的岁月静好。直觉陷阱的危险正在这里:错误自带流畅感。
大脑是个吝啬鬼:顺滑的捷径往往通向陷阱

荷叶题:那直觉到底还能不能信?

最后一道,老规矩,3 秒:

湖里的荷叶面积每天翻一倍,48 天可以盖满整个湖。请问盖住半个湖,需要几天?

……

「24 天」对吧?多对称,多优美。可惜——47 天。翻倍这件事得倒着想:既然每天翻一倍,那盖满一半的第二天就盖满全湖,所以是 48 − 1 = 47。至此 CRT 三题你已集齐:直觉答案 10 美分/100 分钟/24 天,正确答案 5 美分/5 分钟/47 天。Frederick 统计过:所有错误答案里,10、100、24 这三个数字占绝对主导——大家不是乱错的,是整整齐齐掉进同一个坑

学到这,你可能会冒出两个念头。念头一:『我挺聪明的,应该没事。』——很遗憾。Stanovich 和 West (2008) 在 7 项研究里发现:锚定、框架效应、合取效应、沉没成本、基率忽视这些经典偏差,与认知能力(SAT 分数)基本不相关。更扎心的是 West、Meserve 和 Stanovich (2012):『偏差盲点』——觉得别人比自己更有偏差——不但不随认知能力减弱,认知能力更高的人偏差盲点反而更大。聪明给你的是『用的时候有马力』,不保证『想到要用』。

念头二:『那 System 1 就是个坏蛋,以后我遇事全程慢想!』——也错。Kahneman 自己说得很清楚:System 1 既是许多错误的来源,也是我们做对的大多数事情的来源——而『做对』占了我们所做事情的绝大部分。让 System 2 复核一切既不可能(注意力和算力有限),也会让生活直接瘫痪。

那直觉什么时候能信?Kahneman 和 Klein (2009)——一个毕生研究直觉怎么出错,一个毕生研究直觉多神奇——两人合写论文给出两个必要条件:① 环境有足够的可预测性与规律(高效度环境);② 你有机会经长期练习与及时、明确的反馈把这些规律学到手。两条全中(棋手、消防指挥员、临床护士的即时判断),直觉是真技能;缺一条(长期政治预测、选股),再多年资历也只养出自信、养不出准头——而且『主观体验不是判断准确性的可靠指标』。

所以本课的正确姿势不是『永远慢想』,而是装一个场景开关:答案顺滑得可疑、涉及概率或统计、金额或后果重大——见到这三类线索,再按下慢想键。

荷叶每天翻倍:第47天才铺满半湖——指数直觉最容易翻车

自测 · 学完检查一下

想真正动手做题、记进度、攒连胜?到互动课里练。

一杯咖啡和一个杯子一共 22 元,咖啡比杯子贵 20 元。杯子多少钱?(先摁住 3 秒内冒出来的那个答案)

答案:1 元

直觉抢答的是「2 元」——把 22 拆成 20 和 2,顺滑得可疑。验算就露馅:杯子若 2 元,咖啡贵 20 元就是 22 元,加起来 24 元,超了。设杯子为 x:x + (x + 20) = 22,x = 1 元(咖啡 21 元)。这是 Frederick (2005) CRT 球拍与球问题的同构变体:原题球拍和球共 $1.10、球拍贵 $1.00,直觉答案 10 美分、正确 5 美分——所有错误答案里 10 美分占绝对主导,说明大家掉的是同一个坑。见到『总价顺手拆两半』式的流畅答案,先验算再出口。(出处:Frederick, S. (2005). Cognitive Reflection and Decision Making, Journal of Economic Perspectives 19(4))

8 台打印机 8 分钟印 8 本手册。24 台同样的打印机印 24 本手册,要多久?

答案:8 分钟

每台打印机 8 分钟印 1 本;24 台并行开工,8 分钟就印出 24 本。直觉抢答的「24 分钟」是把数字的表面对称当成了答案——和 CRT 机器造零件原题(5 台机器 5 分钟造 5 个零件,100 台造 100 个:直觉 100 分钟、正确 5 分钟)掉的是同一个坑:机器变多不会让单件变慢,产能是并行的。Frederick 的证据显示错误答案里 100 占绝对主导,属于典型的冲动直觉。(出处:Frederick, S. (2005). Cognitive Reflection and Decision Making, Journal of Economic Perspectives 19(4))

一块面包上的霉斑面积每天翻一倍,第 30 天正好长满整块面包。霉斑长满半块面包,是第几天?

答案:第 29 天

翻倍要倒着想:长满一半的第二天就长满整块,所以是 30 − 1 = 29。直觉答「第 15 天」是拿 30 直接对半分——和 CRT 荷叶原题(每天翻倍、48 天盖满全湖,盖一半是 47 天而不是 24 天)同一个坑:指数增长不是匀速铺开,最后一天翻出来的量等于之前所有天的总和。Frederick 统计所有错误答案里 24 占绝对主导,说明『对半分』就是那个人人先冒出来的冲动直觉。(出处:Frederick, S. (2005). Cognitive Reflection and Decision Making, Journal of Economic Perspectives 19(4))

关于 System 1 和 System 2,下面哪个说法符合双系统理论?

答案:System 1 自动、快速、几乎不占注意力、无法随意关闭;System 2 缓慢、串行、需要努力和注意力——一眼认出熟人的脸靠前者,不用计算器硬算 √19163 靠后者

「System 1 / System 2」这对术语由 Stanovich 和 West 在 2000 年命名,Kahneman 在《思考,快与慢》(2011) 中借用并普及为全书框架:System 1 自动、快速、几乎不占注意力且无法关闭;System 2 缓慢、串行、需要努力、动机与注意力。它是对两类加工过程的功能区分,不是左右脑的解剖分区;System 1 也不是『情绪』的代名词。至于『System 2 时刻监督』——恰恰相反:直觉陷阱的机制正是 System 1 先抛出流畅的候选答案,System 2 常常不加复核就直接背书。(出处:Stanovich & West (2000), Behavioral and Brain Sciences;Kahneman (2011), Thinking, Fast and Slow)

判断:直觉陷阱的发生机制是——System 1 先抛出一个流畅的候选答案,而 System 2 常常不加复核就直接签字背书。

答案:正确

正确。这正是双系统理论对直觉陷阱的解释:System 1 自动快速地给出流畅候选答案,System 2 天性懒惰、常常直接放行。Frederick (2005) 的 CRT 论文开篇就用这一区分定义测验目标:测『能否抑制脱口而出的错误答案』。卷面证据也支持:答对的人也常先想到错误答案——常见 10 美分被划掉改成 5 美分,却从未见过反向修改,说明直觉候选答案人人都会先冒出来,差别只在 System 2 有没有起身复核。(出处:Stanovich & West (2000);Frederick (2005), JEP 19(4);Kahneman (2011), Thinking, Fast and Slow)

『认知吝啬鬼(cognitive miser)』说的是什么?

答案:指人处理信息时默认走最省力的捷径、能不深想就不深想——这是节能的默认设计,大多数时候够用,但陷阱题恰好踩在它失灵的位置

『认知吝啬鬼』由 Fiske 和 Taylor 在《Social Cognition》(1984) 提出:人处理信息倾向选最省力的捷径与现成图式,而不是像此前『朴素科学家』模型假设的那样全面收集证据再推理。它不是道德评价,也不是缺陷,而是默认的节能设计,大多数时候够用。Kahneman 称同一现象为『最省力法则』;Stanovich 则把『吝啬式加工』视为聪明人也做蠢决定(dysrationalia)的核心机制——所以『高学历就不吝啬』也不成立,CRT 测的正是关键时刻能否克服这种吝啬。(出处:Fiske & Taylor (1984), Social Cognition;Stanovich (2009), What Intelligence Tests Miss;Kahneman (2011))

Frederick (2005) 让做过球拍与球问题的人估计『其他人做对这道题的比例』,结果发现了什么?

答案:给出错误答案「10 美分」的人平均估计 92% 的人会做对——比答对的人(估 62%)更觉得这题容易,中招瞬间没有任何主观警报

Frederick (2005, p.27-28) 的发现方向正好和干扰项相反:答「10 美分」的人平均估计 92% 的人会做对——他们完全没意识到题里有陷阱;答对「5 美分」的人只估 62%(两组其实都高估了实际正确率)。这解释了直觉陷阱为何危险:错误答案伴随『这题很容易』的流畅感,出错瞬间没有主观警报,甚至比答对的人更笃定——与 Kahneman & Klein (2009)『主观体验不是准确性的可靠指标』互为印证。(出处:Frederick (2005), JEP 19(4): 25-42, p.27-28;Kahneman & Klein (2009), American Psychologist 64(6))

按 Kahneman 与 Klein (2009) 给出的直觉可信两个必要条件——高效度环境+长期练习与及时明确的反馈——下面哪种『多年经验养出的直觉』最可能靠谱?

答案:临床护士对『病人状态突然不对劲』的即时判断——环境有规律可学,且多年实践中反馈及时明确

Kahneman & Klein (2009) 的两个必要条件:① 判断所处环境有足够的可预测性与规律(高效度环境);② 判断者有充分机会通过长期练习与及时、明确的反馈学到这些规律。临床护士的即时判断(以及棋手、消防指挥员)两条全中,直觉是真技能;长期政治预测与选股所处环境效度低,再多年资历也养不出可靠直觉,只养出自信;彩票开号无规律可学,两条全不满足。记住论文的提醒:『主观体验不是判断准确性的可靠指标』——感觉笃定不等于判断得准。(出处:Kahneman & Klein (2009). Conditions for Intuitive Expertise, American Psychologist 64(6): 515-526)

判断:认知能力越强(比如 SAT 分数越高),『偏差盲点』——觉得别人比自己更有偏差——就越小,所以聪明人更能看清自己的偏差。

答案:错误

错误,方向恰恰相反。West、Meserve 和 Stanovich (2012) 发现:偏差盲点不因认知能力或思维倾向而减弱,更高的认知能力反而伴随更大的偏差盲点。Stanovich & West (2008) 在 7 项研究中也发现锚定、框架效应、合取效应、沉没成本、基率忽视等大量经典偏差与认知能力(SAT)基本不相关。CRT 数据同向:得分最高的 MIT 样本平均也只有 2.18/3,52% 的 MIT 受访者至少错一题。聪明提供的是『用的时候有马力』,不保证『想到要用』。(出处:West, Meserve & Stanovich (2012), JPSP 103(3): 506-519;Stanovich & West (2008), JPSP 94(4): 672-695;Frederick (2005), Table 1)

判断:既然直觉这么容易中招,最理性的活法就是把 System 1 当敌人——遇到任何事都关掉直觉、全程用 System 2 慢慢想。

答案:错误

错误。Kahneman 在《思考,快与慢》里明确说:System 1 既是许多错误的来源,也是我们做对的大多数事情的来源——而『做对』占了我们所做事情的绝大部分;让 System 2 复核一切既不可能(注意力与算力有限),也会让生活瘫痪。何况 System 1 想关也关不掉。可行的策略是场景开关:见到『答案顺滑得可疑』『涉及概率/统计』『金额或后果重大』这些线索时,再切换慢想。另一面,Kahneman & Klein (2009) 也指出:在高效度环境+充分练习与及时反馈的条件下,直觉本身就是真技能。(出处:Kahneman (2011), Thinking, Fast and Slow;Kahneman & Klein (2009), American Psychologist 64(6))

想边练边学,而不只是读?

到互动课里答题、记进度、攒连胜——游客即可试学,无需注册。

进入互动课程 →

学点新东西,不错过更新

新课程、新功能、学习小技巧——偶尔一封,随时退订。