Watson Glaser 式练习卷:20 题 / 15 分钟
五个 Watson Glaser 分段一卷打通:五级标尺给推断评级、揪隐藏假设、验演绎、判解释、掂论证强弱。原创题目,15 分钟,交卷即出分段报告。
Watson Glaser 批判性思维测评是律所和专业服务机构用来筛选申请人的考试,五个分段从不改变:五级标尺做推断、识别未言明的假设、检验演绎、判定解释、给论证评强弱。本练习卷逐段复刻该结构,20 道原创题、15 分钟。
把话说明白:这是本站编写的、Watson Glaser 风格的独立练习卷,与官方测评出版方 Pearson 无关联、未获其背书、也不取材于官方题——这同时意味着这些题不可能出现在你的正式考试里,在这里练不会剧透真卷。
每题 1 分、不倒扣、交卷前不揭晓。报告按分段拆正确率——五级推断标尺和论证强弱判定是初考者漏分最多的两段——每道题的解析讲的是判定标准本身,不只是答案。
限时模拟测试
开始限时卷
律所筛选在用的五段格式——原创题,掐表练。
- 题数
- 20 题
- 限时
- 15:00
- 评分方式
- 每题 1 分,答对得分,答错不倒扣
- 过程反馈
- 中途不显示对错
点开始后计时立刻开始,中途可自由跳题、改答案。
五个分测验,各自到底在考什么
每份 Watson Glaser 都由同样的五个部分构成,顺序固定。它们不是同一类题的五种变体——每一部分都要求你切换到不同的证明标准,而绝大多数失分都来自把上一部分的标准带进了下一部分。
1. 推论(Inference)。 给一段事实材料和一条待评推断,在五档上评分:真、可能真、资料不足、可能假、假。这里的标准是「仅凭材料判断的概率」。陷阱在于「资料不足」正确的次数远超考生预期——材料若根本没涉及该陈述,答案就是它,哪怕那句话在现实世界里明显成立。
2. 假设识别(Recognition of Assumptions)。 给一句陈述和一条待判假设,答「做了此假设」或「未做此假设」。标准是必要性:抽掉它,说话人的陈述还站得住吗?不是「这个说法合不合理」,也不是「换个理性的人会不会也这么想」。抽掉之后陈述依然成立,那就是没做这个假设。
3. 演绎(Deduction)。 给前提和结论,答「结论可推出」或「不可推出」。这是唯一采用严格形式标准的一节。现实中真不真无关紧要——一个结论可以荒谬至极却依然可推出。把前提当作完整且封闭的。
4. 解释(Interpretation)。 给一段材料和一条待判结论,答可推出与否。标准比演绎松——问的是「是否排除合理怀疑」,而非逻辑必然。但它比推论严格得多。从样本推广到总体在这一节通常不成立。
5. 论证评价(Evaluation of Arguments)。 给一个议题和一条论证,答「强」或「弱」。只有既重要又与议题直接相关才算强。为真但无关痛痒的论证是弱的;诉诸「多数人怎么想」的论证也是弱的。
证明标准的阶梯——失分最多的地方
五节构成一道从松到紧的阶梯,知道自己此刻站在哪一级,比任何单项技巧都值钱:
- 推论 —— 概率,且只对照材料
- 解释 —— 排除合理怀疑
- 演绎 —— 严格逻辑必然
- 假设 —— 同样是必要性,但针对前提而非结论
- 评价 —— 相关性与重要性,完全不看有效性
最典型的失手是:做到演绎时还停在推论的模式里,因为「多半是真的」就判可推出。演绎不关心什么是可能的。 反向失手同样常见:在演绎里绷紧之后一路紧到解释,把本来满足「排除合理怀疑」的结论也否掉了。
练习时别只看对错。要看自己套用了哪个标准、本该套用哪个。 两个人原始分相同,问题可能完全不同。
谁在用它,以及到底要考多少分
Watson Glaser 与法律行业绑定最深——在英国,它是大型商事律所培训合同筛选的标准环节——同时也用于管理咨询、专业服务、管培生项目,以及内部晋升到分析类岗位。
不存在统一及格线,任何给出一个统一分数的说法都是在猜。雇主自定门槛,且通常用相对常模组的百分位而非原始分。由此有两个推论:
- 同样的原始分在一家过、在另一家不过,因为常模组不同。和「毕业生申请者」比,比和「已执业律师」比容易得多。
- 竞争性法律筛选常被引用的数字是 70–80 百分位左右,但除非雇主自己公布,否则当作坊间传闻。可以直接问招聘方用的是哪个常模组——多数会告诉你。
可靠成立的是:时间压力大、各节难度不均、未作答计零分。做完比做对更优先。
与 LSAT 及其他推理测试的区别
这几者常被混为一谈,因为都自称考批判性思维,但测的东西不同,需要的准备也不同。
对比 LSAT。 LSAT 逻辑推理给你一个论证,问一个具体问题——找漏洞、加强、指出假设。Watson Glaser 给你五种任务,要求你在其间切换标准。LSAT 奖励对单个论证的深度,Watson Glaser 奖励对「该用哪个标准」的判断准确度。做过 LSAT 备考的人,演绎和假设两节通常很强,而推论节多半是最弱的——LSAT 训练你越过缺口去推理,而推论节恰恰惩罚这一点。
对比 SHL、Kenexa 系测试。 那些通常是语言、数字或归纳推理,单一题型重复。Watson Glaser 是常见雇主测试里唯一刻意在卷内切换证明标准的。
对比 GMAT。 GMAT 批判性推理在结构上更接近 LSAT。两者同时准备的话,重叠是真实的但只是部分——那种题型见 GMAT 批判性推理题。
失分最多的五个错误
引入外部知识。 每一节都只对照材料判断。你凭经验知道某条推断是真的,这与本题无关,除非材料支持它。这是最大的失分来源,而且你在该领域越专业,栽得越狠。
回避「资料不足」。 考生把它当成逃避,硬要做判断。它是一个真实选项,而且常常是正确答案。
在假设节把「必要」和「合理」搞混。 用否定法检验:抽掉这条假设,陈述还成立吗?成立,就说明没做这个假设。
在评价节按结论立场判强弱。 支持你认同立场的论证也可能是弱的,支持你反对立场的也可能是强的。评的是推理,不是阵营。
最后一节做不完。 论证评价排在最后,最常被赶时间。未作答计零分,所以一个仓促但经过判断的答案,好过一个空白。
一道完整例题:推论题的五档判定走一遍
推论节是证明标准阶梯真正咬人的地方,这里用一道原创题从头走到尾。陈述:某市图书馆三月起把工作日开放时间延长两小时。四月,工作日借阅量比二月高 12%。开放时间没变的周末,借阅量不变。
待判定的推论:延长开放时间导致了工作日借阅量上升。 按阶梯走。真 要求陈述明说或严格蕴含它——没有;没有任何信息排除三月同时开始的新书活动。假 要求陈述与它矛盾——也没有。所以答案在中间三档,问题变成:陈述是否让这个推论「多半成立」。周末那个数字是决定性细节:只有工作日延长了时间,也只有工作日借阅量涨了。这是对照组,不是巧合,它把推论推到 很可能为真。最常见的错法是选 资料不足——那是在阶梯只要求「可能性」的地方去索要证明。
同一段陈述再看两个推论,做对比。「四月总借阅量上升了」——很可能为真:工作日涨 12%、周末持平,除非工作日借阅量微不足道(陈述没给任何这样的理由),总量就是涨的。「图书馆也延长了周末开放时间」——假:陈述明说周末时间没变。注意这里的 假 建立在明确陈述之上,而不是信息缺失——信息缺失才是 资料不足 的用武之地。
- 假设节用同样的纪律。论证:「把团队会议改到早上八点,好让更多人能参加。」 待判定的假设:「有些人在现在的时间无法参加」——是假设,没有它论证就塌了。待判定的假设:「八点的会更短」——不是假设;它可能为真,但论证不需要它。
上面那份卷子每一节都有这类题,报告会对每道错题告诉你:你选了哪一档,陈述支持的是哪一档。
考前一周怎么准备
Watson Glaser 奖励的是校准而非知识量,所以短期集中训练比长期泛读更有用。
- 先在不做任何复习的情况下完整掐表做一份,找出五节里真正弱的是哪一节。多数人猜错自己的短板。
- 按节复盘,不按总分。每道错题写下:我套用了哪个标准,本该套用哪个。
- 单独练推论节。它是多数人最差、也最不像他们做过的任何东西的一节。
- 最后一次完整练习放在与真实考试相同的时段,且每题都作答,哪怕不确定。
上面那份测验遵循同样的五节结构,且是掐表的。交卷前不给对错,报告会按分节拆分你的得分,让你看出自己在误用哪个标准。
做完之后往哪走
常见问题
这是官方 Watson Glaser 考试吗?
不是。这是同五段格式的原创练习卷,由本站独立编写,与 Pearson 无关联。这份独立性对练习反而是优点:这里的任何一题都不可能出现在你的正式测评里。
哪些雇主在用 Watson Glaser?
它最出名的身份是律所筛选器——许多英国及国际律所的 training contract 和 vacation scheme 申请都用它——咨询、金融和政府选拔中也会出现。五段功夫可直接迁移到任何批判性思维测评。
怎么计分?该以多少为目标?
本卷每题 1 分。真实 Watson Glaser 通常按常模参照计分,而律所申请人群体很强——把七成五以上当作要练到的区间,用分段报告找出拖后腿的那一段。
最难的是哪一段?
推断评级,远远领先——因为它用五级标尺计分,「大概率为真」和「证据不足」贴得很近。纪律是先问事实逼出了什么,再问离确定还差多远。这里的解析练的正是那条边界。
这张卷和批判性思维测试怎么搭配用?
同格式、零重题——天然的第一卷和第二卷。先裸考一张定基线,读透它的解析,再考另一张检验判定标准有没有长在身上。两份分段报告并排看,就是你的趋势线。