← 学习科学

为雅思建立读与写的习惯

有人做了四十套模拟题,还是停在 6.5。问题很少出在不熟悉题型。本文把学习者常混为一谈的两个目标拆开——熟悉考试和提高英语——并给出真正有研究支撑的读写习惯,包括一项关于培训班的、不太好听的发现。

AI Aggregated source· 2026年8月2日· 11 分钟阅读 ·Exams

有一个非常眼熟的场景。某人已经做了四十套模拟题。题型全认得,NOT GIVEN 的坑门儿清,每种 Task 2 题目都备好了提纲。而分数还是 6.5,和半年前一模一样。

通常的反应是再做几套。但如果四十套不够,第四十一套也不会够,而这背后有一个非常具体的原因。

两个被当成一个的目标

准备雅思其实是两件不同的事,而学习者几乎总是把它们合并。

第一件是熟悉考试。知道有几个部分、题目长什么样、要写多少字、按什么标准评分。这是真实且必要的工作——但它很快就饱和了。大约五到十套题之后,关于考试形式,你已经知道了几乎所有值得知道的东西。从那以后,再做题几乎不会让你对这场考试有更多了解。

第二件是提高你的英语。这件事移动缓慢,以月计而不是以周计,而在熟悉度饱和之后,决定分数的正是它。

人人都会撞上的那个瓶颈,恰恰就是第一件事耗尽、而第二件事还没跟上的那一刻。

这里有一项不太好听的研究。安东尼·格林(Anthony Green, 2007)比较了上专门雅思培训课的学习者和上普通学术英语课的学习者。在写作的进步上,备考组并没有更领先。针对考试来教,并没有带来大家默认它会带来的优势。

埃尔德与奥洛克林(Elder & O'Loughlin, 2003)补上了数字:测量高强度英语学习期间的分数增长,他们发现进步是真实的但幅度不大——几个月全日制学习平均约半分,且个体差异很大。

说白了:如果你需要涨一整分,请按月做计划,不要按周。向你承诺相反结果的人,是在卖东西。

阅读:做不完,几乎总是词汇问题

先看真实的数字。雅思学术类阅读给你 60 分钟,三篇文章,40 道题,总长 2,150–2,750 词。而且与听力不同,不额外给誊写答案的时间——那 60 分钟已经包含把答案填到答题卡上。

几乎所有人都把这个问题诊断为「时间管理」。通常不是。

取一套大约 2,450 词的中等长度试卷,套上词汇覆盖率门槛。胡与内申(Hu & Nation, 2000)证明,要在无人帮助下舒服地阅读,你需要认识大约 98% 的词。

在 98% 覆盖率下,你在这套题里会遇到约 49 个生词。烦人,但扛得住。

在 95% 下——这仍然是相当不错的英语水平——你会遇到约 122 个生词。每一次停下来推测词义都要花掉几秒,而它们会累加。你并不慢;你是在每一行上都缴一笔词汇税。

这就是为什么技巧只能帮到某个程度。你没法略读你解码不了的东西。略读的前提是:当你的眼睛扫过时,词义会自动弹出来。如果它们不弹出来,这套技巧就塌了。

所以要做的功课有两部分,而大多数学习者只做了第二部分。

建学术词汇。这是长线工程,也是间隔重复(塞佩达等人,2006)的教科书级用例。优先通用学术词汇,而不是罕见的专业术语。

建识别速度。这是被忽略的另一半。格拉贝(Grabe, 2009)强调,第二语言的阅读流畅度必须单独训练:认识一个词,和在四分之一秒内认出它,是两回事。训练方法是计时阅读和把同一段文字重复读——而不是再做几套题。

而这两者的底座是广泛阅读中西(Nakanishi, 2015)的元分析发现阅读理解和词汇上有小到中等的增益。每天二十分钟读你真心喜欢的东西,能做到一周一套模拟题做不到的事:它给你量。

写作:四项标准,而你只在练其中一项

写作考试给你 60 分钟:Task 1 至少 150 词,约 20 分钟;Task 2 至少 250 词,约 40 分钟。Task 2 的权重是 Task 1 的两倍

作文按四项标准评分,每项权重相同:Task Achievement/Response(任务完成度)、Coherence and Cohesion(连贯与衔接)、Lexical Resource(词汇资源)、Grammatical Range and Accuracy(语法多样性与准确性)。

请在这里停一下,因为它改变了练习该长什么样。四项里有三项与你有没有好点子无关。它们关乎组织、词汇和语法准确度。

然而学习者「练写作」时,压倒性地只练一件事:想出内容并凑够字数。而四分之三的分数来自那些很少被单独拎出来练的技能。

这正是埃里克森(Ericsson, 1993)刻意练习概念的用武之地。单纯重复不产生进步;产生进步的是带反馈的、针对某个明确子技能的训练。没有反馈地写三十篇作文,主要是在把你已有的错误练熟。

哪一种反馈真的有用

这是写作研究中最漫长的争论之一,而它有一个可用的结论。

特拉斯科特(Truscott, 1996)直截了当地主张,写作课上的语法纠错无效、甚至有害,应当放弃。费里斯(Ferris, 1999)反驳。这场辩论持续了几十年。

它最终落定的地方相当清楚:有重点的反馈远比全面反馈有效。把一篇作文里所有错误都改出来,往往不会带来持久改善——作文满篇是红,学习者扫一眼,什么也没留下。但当反馈只针对一两类具体错误时,恰恰在那些点上的准确度会提升并保持。比奇纳与克诺赫(Bitchener & Knoch, 2010)在高水平写作者身上也发现了这类效应。

这转化成一个非常具体的习惯。不要请人把所有错误都改掉。挑两类错误——比如冠词和主谓一致——然后三周之内只盯这两类。它们稳了,再换两类。

对中文母语者来说,候选清单是可预测的,因为汉语没有屈折变化:冠词a/the/零冠词)、复数 -s时态与 -ed第三人称单数 -s。这些都是短的、不重读的语素,在口语中会被吞掉——也就是说,你的耳朵永远不会替你抓住它们。它们必须被有意识地处理。

为什么背模板会反噬

最流行的备考策略也是风险最高的:背下范文段落,然后往每道题上套。

它失败有两个原因,而且都写在评分标准里。

Task Response 下降。背下来的开头段是为一道泛泛的题写的;真实的题目是具体的。你越是硬套模板,作文就离真正的问题越远。考官受过训练,能识别背诵内容,而不是你产出的语言不计入你的能力。

Lexical Resource 同样下降。被用滥的模板句——「In this ever-changing world...」 那一家子——不是「不常见的词汇」。它们是世上最常见的词汇。

不过这个想法有一个正确的版本,而且有效:学小而灵活的语块,而不是整段。表示对比的说法、让步的说法、举例的说法、限定程度的说法。这些能挂到任何内容上。它们是工具,不是剧本。

还有一个便宜又有证据的习惯:写 Task 2 之前花五分钟列提纲。埃利斯与袁(Ellis & Yuan, 2004)证明,写前的计划时间能可测量地提升二语写作的流畅度和复杂度。五分钟不是丢掉的时间;它是后面赚回来的时间。

而习惯这一部分——真正的科学

大多数备考计划就死在这里。不是内容不对,而是它撑不过两周。

首先,扔掉「21 天」这个数字。它是民间传说。拉利(Lally)等人(2010)跟踪真实的人养成真实的习惯,发现中位数是 66 天,范围从 18 天到 254 天不等,取决于行为和人。如果到第三周学习仍然费劲,你没有失败——你正处在数据预测的位置上。

其次,使用执行意图。这是整个习惯科学中证据最强的技术,而且基本免费。戈尔维策(Gollwitzer, 1999)证明,「如果出现情境 X,我就做 Y」形式的计划远胜于笼统的意愿。戈尔维策与希兰(2006)对数百项研究的元分析发现了中到大的效应。

实践中:「我要更用功」几乎没用。「倒完早咖啡之后,我就在餐桌上读一篇阅读」有用,因为它已经预先决定了时间、地点和触发信号。

第三,保持情境稳定。伍德与尼尔(Wood & Neal, 2007)把习惯描述为情境—反应的关联:行为会附着在反复出现的环境线索上。在同一个地方、同一个时间学习,消耗的意志力远低于每天重新决定一次。

第四,把最低标准定得小到能熬过糟糕的一天。每天三小时的计划活不过第一周。四十五分钟可以。

那么模拟题该放在哪里?

它们不是没用——但它们有用的原因,和大家以为的不一样。

做一套模拟题是一次提取行为,而罗迪格与卡皮克(2006)证明,提取本身对记忆的强化远大于重读。所以模拟题确实在教你——只是教的分量配不上它占用的时数。

决定其价值的是之后发生了什么。一套被批改完就归档的题,只是一次测量。一套被拆解的题——每个生词进卡片系统,每道错题追到原因(是不认识词?没看懂题?还是没时间了?)——才是一次学习。

这正是刷题这个习惯走偏的地方。一套接一套地刷,感觉上像在进步,因为它可测量而且确实累人。但如果跳过纠错环节,你只是在用越来越高的精度反复测量同一个缺口。一套认真分析过的题,胜过五套匆匆刷完的题。

一周该长什么样

具体,而且忙起来也守得住:

每天(20 分钟):广泛阅读你真心喜欢的东西,难度是你基本能懂的。这是地基,也是第一个被砍掉的东西。别砍它。

每天(10 分钟):按间隔复习词汇卡片。短,且不可商量。

每周三次(20 分钟):计时阅读练识别速度——同一段读两遍,第二遍更快。

每周两次(45 分钟):完整写一篇计时的 Task 2,含五分钟列提纲。然后只就你正在盯的那两类错误请人反馈。

每周一次(30 分钟):拿到反馈后重写那同一篇。这一步几乎总被跳过,而它是一周里学习效率最高的一步。

每两周一次:一套完整的阅读题,严格 60 分钟,按考试条件。然后花在分析上的时间要长于做题的时间。

分数是一支温度计

备考中最大的诱惑,是瞄准那个数字,而不是瞄准产生那个数字的东西。

但分数是对你某一时刻读写能力的测量。你可以让这次测量更准确——通过理解考试、不因誊写答案而丢分、不跑题。这是熟悉度的功课,值得做,但它有天花板。

剩下的部分没有捷径。词汇量是靠几个月里反复遇见同一批词长出来的。准确度是靠有人反复指出同一个具体错误、直到你自己开始抓住它而提高的。阅读速度是靠词汇识别变成自动化而上去的。

这些没有一样会在考前那一夜发生。但只要习惯活得够久,它们全都会相当可靠地发生——而按数据,该瞄准的数字是大约两个月,不是三周。

读简明版

同样的内容,用浅白的话再讲一遍——写给年纪小的读者,也写给想快点抓住要点的人。

有一个非常眼熟的场景。某人做了四十套模拟题。他知道题型,知道 NOT GIVEN 的陷阱,任何 Task 2 题目他都有现成的提纲。而他的分数仍然是 6.5,和六个月前一模一样。

通常的反应是再多做几套。但如果四十套不够,第四十一套也不会够,而且原因很具体。

被当成一件事的两个目标

准备雅思其实是两件不同的活儿,而学习者几乎总是把它们混成一件。

第一件是熟悉形式。知道有几个部分、题目长什么样、要写多少词、评分标准是什么。这是真实且必要的功夫——但它很快就饱和。大约做完五到十套之后,关于考试形式值得知道的你基本都知道了。从那以后,再做更多套题,关于这场考试几乎再教不了你任何东西。

第二件是把英语水平提上去。那件事走得慢,以月计而不是以周计,而在熟悉形式饱和之后,决定你分数的正是它。

每个人都会撞上的那个平台期,恰恰就是第一件事耗尽、而第二件事还没跟上的那一刻。

而研究在这里说了句不太中听的话。Anthony Green(2007)比较了上专门雅思备考课程的学习者与上一般学术英语课程的学习者。在写作进步上,备考组并没有胜出。照着考试教,并没有带来所有人都默认它会带来的那份优势。

Elder 与 O'Loughlin(2003)补上了数字:测量密集英语学习期间的分数增长,他们发现进步真实但有限——平均而言,全日制学习几个月之后约提高半分,个体差异很大。

直说:如果你需要整整一分,请按月做计划,不要按周。承诺别的人是在卖东西。

阅读:时间不够,几乎总是词汇问题

看真实的数字。学术阅读给你 60 分钟、三篇文章、40 道题,共 2,150–2,750 词。而且与听力不同,不另给誊写答案的时间——那 60 分钟已经包含把答案抄到答题卡上。

几乎所有人都把这诊断成时间管理问题。通常并不是。

取一套约 2,450 词的平均试卷,套用覆盖率门槛。Hu 与 Nation(2000)指出,要在无人帮助的情况下读得舒服,你需要认识约 98% 的行文词。

在 98% 覆盖率下,你在那套题里会遇到大约 49 个生词。烦人,但撑得住。

在 95% 下——仍然是不错的英语水平——你会遇到大约 122 个生词。每停下来推测一个都要花几秒,而它们会累积。你不是慢;你在为每一行缴纳词汇税。

这就是为什么技巧提示只能帮到某个限度。你没法略读你解码不了的东西。 略读假定的是:当你的眼睛扫过那些词时,它们的意思会自动点亮。如果没点亮,这个技巧就垮了。

所以功夫有两部分,而大多数学习者只做第二部分。

建学术词汇。 这是长线,也是间隔重复的教科书案例(Cepeda 等,2006)。优先一般学术词汇,而不是罕见的专业术语。

建识别速度。 这是被忽略的那一半。Grabe(2009)强调第二语言的阅读流利度必须单独训练:认识一个词,和在四分之一秒内认出它,是两项不同的成就。 你用计时阅读和同一篇反复读来训练它——不是用更多套题。

这两者底下垫着的是泛读。Nakanishi 的元分析(2015)发现在理解力和词汇上有小到中等的增益。每天二十分钟读你真正喜欢的东西,能做到每周一套模拟题做不到的事:它给你量。

写作:四条标准,而你只在练一条

写作给你 60 分钟:Task 1 约 20 分钟、至少 150 词;Task 2 约 40 分钟、至少 250 词。Task 2 的权重是 Task 1 的两倍。

答卷按四条标准评分,每条权重相同:Task Achievement/Response、Coherence and Cohesion、Lexical Resource、Grammatical Range and Accuracy。

请在这里停一会儿,因为它改变了练习该长什么样。四条里有三条并不问你有没有好点子。 它们问的是组织、词汇和语法准确性。

可当学习者「练写作」时,他们压倒性地只练一件事:生成内容、凑够词数。四分之三的分数来自那些很少被单独拿出来操练的技能。

这正是 Ericsson 的刻意练习(1993)派上用场的地方。单纯重复不产生进步;产生进步的是带着反馈、针对一项被界定清楚的子技能所做的工作。没有反馈地写三十篇作文,多半是在把你已有的错误再练一遍。

哪一种反馈真的管用

这是写作研究里最长的争论之一,而它有一个可用的结论。

Truscott(1996)直言写作课上的语法纠错无效、甚至可能有害,应予放弃。Ferris(1999)反驳。争论持续了数十年。

它落定的地方相当清楚:聚焦式反馈比全面式反馈管用得多。 把一篇作文里的每一个错都改掉,往往不会带来持久进步——作文一片红地还回来,学习者扫一眼,什么也没留下。但当反馈只针对一两类特定错误时,恰恰在那些点上的准确性会提高并保持。Bitchener 与 Knoch(2010)在高水平写作者身上也找到了这类效应。

这换算成一个非常具体的习惯。不要请任何人把所有东西都改一遍。挑两类错误——比如冠词和主谓一致——只追踪这两类,为期三周。等它们稳了,再换两类。

对说没有屈折变化的语言的人来说,候选清单是可以预料的:冠词(a/the/零冠词)、复数 -s、时态与 -ed、第三人称单数 -s。这些都是又短又不带重音的语素,说话时会被吞掉——也就是说,你的耳朵永远不会替你抓住它们。 它们必须被有意识地处理。

背模板为什么会反噬

最受欢迎的备考策略也是最冒险的:背下范文段落,往每一道题上套。它失败有两个理由,两个都写在评分标准里。

Task Response 掉下去。 一段背下来的开头是为一道笼统的题写的;真正的题是具体的。你越是把模板硬塞进去,作文就离真正的问题越远。考官受过训练能识别背诵内容,而不是你自己产出的语言,不会计入你的能力。

Lexical Resource 也掉下去。 那些被用滥的模板短语——「In this ever-changing world…」那一族——并不是更少见的词汇项。它们是世上最常见的那些

不过这个想法有一个正确的版本,而且它管用:学小而灵活的语块,而不是整段。表示转折的方式、让步的方式、引入例子的方式、给论断定量的方式。这些能附着到任何内容上。它们是工具,不是脚本。

再加一个便宜且有证据的习惯:写 Task 2 之前花五分钟做计划。Ellis 与 Yuan(2004)表明任务前计划能可测量地提升第二语言写作的流利度与复杂度。五分钟不是丢掉的时间,是后面买回来的时间。

还有习惯这一块——真正的科学

这是大多数学习计划失败的地方。不是因为内容错了,而是因为它们没能活过两周。

第一,把 21 天这个数字丢掉。 那是民间说法。Lally 等(2010)追踪真实的人养成真实的习惯,发现中位数是 66 天,范围随行为和人而异,从 18 天到 254 天。如果到第三周学习仍然费力,你没有失败——你正好在数据预测的位置上。

第二,使用执行意图。 这是整个习惯科学里证据最强的技术,而且基本免费。Gollwitzer(1999)表明「如果出现情境 X,那么我就做 Y」这种形式的计划远远胜过笼统的意愿。Gollwitzer 与 Sheeran(2006)对数百项研究做的元分析发现中到大的效应。

实际上:「我要更努力学习」几乎没用。「倒完早晨那杯咖啡之后,我就在餐桌上读一篇阅读」管用,因为它已经预先决定了时间、地点和触发点。

第三,保持情境稳定。 Wood 与 Neal(2007)把习惯描述为情境—反应的联结:行为附着在反复出现的环境线索上。在同一个地方、同一个时间学习,比每天重新决定要省下太多意志力。

第四,把最低量定得小到能熬过糟糕的一天。 每天三小时的计划活不过第一周。四十五分钟能。

那么模拟题的位置在哪里

它们并非无用——但它们有用的原因,不是人们以为的那个原因。

做一套模拟题是一次提取,而 Roediger 与 Karpicke(2006)表明提取本身对记忆的强化远胜过重读。所以模拟题确实在教——只是教的量与它吃掉的时数不成比例。

决定它们价值的是之后发生的事。一套批改完就归档的题是一次测量。一套被拆开的题——每个生词进卡片系统,每道错题追到原因(是我不认识那个词?没看懂题目?还是时间不够?)——才是一次学习。

一套接一套地刷,正是在这里走偏。它感觉像进步,因为它可测量而且确实累人。但如果跳过了纠错环节,你只是在用越来越高的精度反复测量同一个缺口。 一套被认真分析过的题,胜过五套匆匆做完的。

一周长什么样

每天(20 分钟): 泛读你真正喜欢的东西,选一个你大体读得懂的难度。这是地基,也是第一个被砍掉的。别砍。

每天(10 分钟): 间隔重复的词汇卡。短,且不可商量。

每周三次(20 分钟): 为识别速度做计时阅读——同一篇读两遍,第二遍更快。

每周两次(45 分钟): 计时条件下完整写一篇 Task 2,含五分钟计划。然后只就你正在追踪的那两类错误请求反馈。

每周一次(30 分钟): 拿到反馈后重写那同一篇作文。这一步几乎总被跳过,而它是一周里学习率最高的一步。

每两周: 一整套阅读,严格 60 分钟,按考试条件。然后花在分析上的时间要多于你做题的时间。

分数是一支温度计

备考最大的诱惑,是去瞄准那个数字,而不是瞄准产生那个数字的东西。

但分数是对你某一时刻的阅读与写作所做的一次测量。你可以让这次测量更准确——通过理解考试,通过不在誊写答案时丢分,通过不写离题。那是熟悉形式的功夫,值得做,但它有天花板。

其余没有捷径。词汇是在几个月里反复遇见同一批词而长出来的。准确性是在有人足够多次地指着某一个具体错误、直到你自己开始抓得住它时才提升的。阅读速度是在词汇识别变得自动时才上来的。

这些没有一件会在考前一夜发生。但只要习惯活得够久,它们都会相当可靠地发生——而数据说,该瞄准的数字是大约两个月,不是三周。

来源与延伸阅读

这些文章综合了学习科学与语言学中公认的研究成果。主要来源与延伸阅读:

  • Green, A. (2007). IELTS Washback in Context: Preparation for Academic Writing in Higher Education (Studies in Language Testing 25). Cambridge: Cambridge University Press / UCLES.
  • Elder, C., & O'Loughlin, K. (2003). Investigating the relationship between intensive English language study and band score gain on IELTS. IELTS Research Reports, 4, 207–254.
  • Hu, M., & Nation, P. (2000). Unknown vocabulary density and reading comprehension. Reading in a Foreign Language, 13(1), 403–430.
  • Nation, I. S. P. (2006). How large a vocabulary is needed for reading and listening? Canadian Modern Language Review, 63(1), 59–82.
  • Grabe, W. (2009). Reading in a Second Language: Moving from Theory to Practice. Cambridge: Cambridge University Press.
  • Nakanishi, T. (2015). A meta-analysis of extensive reading research. TESOL Quarterly, 49(1), 6–37.
  • Truscott, J. (1996). The case against grammar correction in L2 writing classes. Language Learning, 46(2), 327–369.
  • Ferris, D. (1999). The case for grammar correction in L2 writing classes: A response to Truscott (1996). Journal of Second Language Writing, 8(1), 1–11.
  • Bitchener, J., & Knoch, U. (2010). Raising the linguistic accuracy level of advanced L2 writers with written corrective feedback. Journal of Second Language Writing, 19(4), 207–217.
  • Ellis, R., & Yuan, F. (2004). The effects of planning on fluency, complexity, and accuracy in second language narrative writing. Studies in Second Language Acquisition, 26(1), 59–84.
  • Ericsson, K. A., Krampe, R. T., & Tesch-Römer, C. (1993). The role of deliberate practice in the acquisition of expert performance. Psychological Review, 100(3), 363–406.
  • Lally, P., van Jaarsveld, C. H. M., Potts, H. W. W., & Wardle, J. (2010). How are habits formed: Modelling habit formation in the real world. European Journal of Social Psychology, 40(6), 998–1009.
  • Gollwitzer, P. M. (1999). Implementation intentions: Strong effects of simple plans. American Psychologist, 54(7), 493–503.
  • Gollwitzer, P. M., & Sheeran, P. (2006). Implementation intentions and goal achievement: A meta-analysis of effects and processes. Advances in Experimental Social Psychology, 38, 69–119.
  • Wood, W., & Neal, D. T. (2007). A new look at habits and the habit-goal interface. Psychological Review, 114(4), 843–863.
  • Roediger, H. L., & Karpicke, J. D. (2006). Test-enhanced learning: Taking memory tests improves long-term retention. Psychological Science, 17(3), 249–255.
  • Cepeda, N. J., Pashler, H., Vul, E., Wixted, J. T., & Rohrer, D. (2006). Distributed practice in verbal recall tasks: A review and quantitative synthesis. Psychological Bulletin, 132(3), 354–380.

记住这一点——几天后再来复习。

更多学习科学相关内容