為雅思建立讀與寫的習慣
有人做了四十套模擬題,還是停在 6.5。問題很少出在不熟悉題型。本文把學習者常混為一談的兩個目標拆開——熟悉考試和提高英語——並給出真正有研究支撐的讀寫習慣,包括一項關於補習班的、不太好聽的發現。
有人做了四十套模擬題,還是停在 6.5。問題很少出在不熟悉題型。本文把學習者常混為一談的兩個目標拆開——熟悉考試和提高英語——並給出真正有研究支撐的讀寫習慣,包括一項關於補習班的、不太好聽的發現。
有一個非常眼熟的場景。某人已經做了四十套模擬題。題型全認得,NOT GIVEN 的坑一清二楚,每種 Task 2 題目都備好了大綱。而分數還是 6.5,和半年前一模一樣。
通常的反應是再做幾套。但如果四十套不夠,第四十一套也不會夠,而這背後有一個非常具體的原因。
準備雅思其實是兩件不同的事,而學習者幾乎總是把它們合併。
第一件是熟悉考試。知道有幾個部分、題目長什麼樣、要寫多少字、按什麼標準評分。這是真實且必要的工作——但它很快就飽和了。大約五到十套題之後,關於考試形式,你已經知道了幾乎所有值得知道的東西。從那以後,再做題幾乎不會讓你對這場考試有更多了解。
第二件是提高你的英語。這件事移動緩慢,以月計而不是以週計,而在熟悉度飽和之後,決定分數的正是它。
人人都會撞上的那個瓶頸,恰恰就是第一件事耗盡、而第二件事還沒跟上的那一刻。
這裡有一項不太好聽的研究。安東尼·格林(Anthony Green, 2007)比較了上專門雅思補習課的學習者和上普通學術英語課的學習者。在寫作的進步上,備考組並沒有更領先。針對考試來教,並沒有帶來大家預設它會帶來的優勢。
艾爾德與奧洛克林(Elder & O'Loughlin, 2003)補上了數字:測量高強度英語學習期間的分數增長,他們發現進步是真實的但幅度不大——幾個月全日制學習平均約半分,且個體差異很大。
說白了:如果你需要漲一整分,請按月做計畫,不要按週。向你承諾相反結果的人,是在賣東西。
先看真實的數字。雅思學術組閱讀給你 60 分鐘,三篇文章,40 道題,總長 2,150–2,750 詞。而且與聽力不同,不額外給謄寫答案的時間——那 60 分鐘已經包含把答案填到答案卡上。
幾乎所有人都把這個問題診斷為「時間管理」。通常不是。
取一套大約 2,450 詞的中等長度試卷,套上詞彙覆蓋率門檻。胡與內申(Hu & Nation, 2000)證明,要在無人幫助下舒服地閱讀,你需要認識大約 98% 的詞。
在 98% 覆蓋率下,你在這套題裡會遇到約 49 個生詞。煩人,但扛得住。
在 95% 下——這仍然是相當不錯的英語水準——你會遇到約 122 個生詞。每一次停下來推測詞義都要花掉幾秒,而它們會累加。你並不慢;你是在每一行上都繳一筆詞彙稅。
這就是為什麼技巧只能幫到某個程度。你沒法略讀你解碼不了的東西。略讀的前提是:當你的眼睛掃過時,詞義會自動彈出來。如果它們不彈出來,這套技巧就塌了。
所以要做的功課有兩部分,而大多數學習者只做了第二部分。
建學術詞彙。這是長線工程,也是間隔重複(塞佩達等人,2006)的教科書級用例。優先通用學術詞彙,而不是罕見的專業術語。
建辨識速度。這是被忽略的另一半。格拉貝(Grabe, 2009)強調,第二語言的閱讀流暢度必須單獨訓練:認識一個詞,和在四分之一秒內認出它,是兩回事。訓練方法是計時閱讀和把同一段文字重複讀——而不是再做幾套題。
而這兩者的底座是廣泛閱讀。中西(Nakanishi, 2015)的後設分析發現閱讀理解和詞彙上有小到中等的增益。每天二十分鐘讀你真心喜歡的東西,能做到一週一套模擬題做不到的事:它給你量。
寫作考試給你 60 分鐘:Task 1 至少 150 詞,約 20 分鐘;Task 2 至少 250 詞,約 40 分鐘。Task 2 的權重是 Task 1 的兩倍。
作文按四項標準評分,每項權重相同:Task Achievement/Response(任務完成度)、Coherence and Cohesion(連貫與銜接)、Lexical Resource(詞彙資源)、Grammatical Range and Accuracy(文法多樣性與準確性)。
請在這裡停一下,因為它改變了練習該長什麼樣。四項裡有三項與你有沒有好點子無關。它們關乎組織、詞彙和文法準確度。
然而學習者「練寫作」時,壓倒性地只練一件事:想出內容並湊夠字數。而四分之三的分數來自那些很少被單獨拎出來練的技能。
這正是艾瑞克森(Ericsson, 1993)刻意練習概念的用武之地。單純重複不產生進步;產生進步的是帶回饋的、針對某個明確子技能的訓練。沒有回饋地寫三十篇作文,主要是在把你已有的錯誤練熟。
這是寫作研究中最漫長的爭論之一,而它有一個可用的結論。
特拉斯科特(Truscott, 1996)直截了當地主張,寫作課上的文法糾錯無效、甚至有害,應當放棄。費里斯(Ferris, 1999)反駁。這場辯論持續了幾十年。
它最終落定的地方相當清楚:有重點的回饋遠比全面回饋有效。把一篇作文裡所有錯誤都改出來,往往不會帶來持久改善——作文滿篇是紅,學習者掃一眼,什麼也沒留下。但當回饋只針對一兩類具體錯誤時,恰恰在那些點上的準確度會提升並保持。比奇納與克諾赫(Bitchener & Knoch, 2010)在高水準寫作者身上也發現了這類效應。
這轉化成一個非常具體的習慣。不要請人把所有錯誤都改掉。挑兩類錯誤——比如冠詞和主謂一致——然後三週之內只盯這兩類。它們穩了,再換兩類。
對華語母語者來說,候選清單是可預測的,因為漢語沒有屈折變化:冠詞(a/the/零冠詞)、複數 -s、時態與 -ed、第三人稱單數 -s。這些都是短的、不重讀的語素,在口語中會被吞掉——也就是說,你的耳朵永遠不會替你抓住它們。它們必須被有意識地處理。
最流行的備考策略也是風險最高的:背下範文段落,然後往每道題上套。
它失敗有兩個原因,而且都寫在評分標準裡。
Task Response 下降。背下來的開頭段是為一道泛泛的題寫的;真實的題目是具體的。你越是硬套模板,作文就離真正的問題越遠。考官受過訓練,能辨識背誦內容,而不是你產出的語言不計入你的能力。
Lexical Resource 同樣下降。被用濫的模板句——「In this ever-changing world...」 那一家子——不是「不常見的詞彙」。它們是世上最常見的詞彙。
不過這個想法有一個正確的版本,而且有效:學小而靈活的語塊,而不是整段。表示對比的說法、讓步的說法、舉例的說法、限定程度的說法。這些能掛到任何內容上。它們是工具,不是劇本。
還有一個便宜又有證據的習慣:寫 Task 2 之前花五分鐘列大綱。艾利斯與袁(Ellis & Yuan, 2004)證明,寫前的計畫時間能可測量地提升二語寫作的流暢度和複雜度。五分鐘不是丟掉的時間;它是後面賺回來的時間。
大多數備考計畫就死在這裡。不是內容不對,而是它撐不過兩週。
首先,扔掉「21 天」這個數字。它是民間傳說。拉利(Lally)等人(2010)追蹤真實的人養成真實的習慣,發現中位數是 66 天,範圍從 18 天到 254 天不等,取決於行為和人。如果到第三週學習仍然費勁,你沒有失敗——你正處在數據預測的位置上。
其次,使用執行意圖。這是整個習慣科學中證據最強的技術,而且基本免費。戈爾維策(Gollwitzer, 1999)證明,「如果出現情境 X,我就做 Y」形式的計畫遠勝於籠統的意願。戈爾維策與希蘭(2006)對數百項研究的後設分析發現了中到大的效應。
實踐中:「我要更用功」幾乎沒用。「倒完早咖啡之後,我就在餐桌上讀一篇閱讀」有用,因為它已經預先決定了時間、地點和觸發信號。
第三,保持情境穩定。伍德與尼爾(Wood & Neal, 2007)把習慣描述為情境—反應的關聯:行為會附著在反覆出現的環境線索上。在同一個地方、同一個時間學習,消耗的意志力遠低於每天重新決定一次。
第四,把最低標準定得小到能熬過糟糕的一天。每天三小時的計畫活不過第一週。四十五分鐘可以。
它們不是沒用——但它們有用的原因,和大家以為的不一樣。
做一套模擬題是一次提取行為,而羅迪格與卡皮克(2006)證明,提取本身對記憶的強化遠大於重讀。所以模擬題確實在教你——只是教的分量配不上它占用的時數。
決定其價值的是之後發生了什麼。一套被批改完就歸檔的題,只是一次測量。一套被拆解的題——每個生詞進卡片系統,每道錯題追到原因(是不認識詞?沒看懂題?還是沒時間了?)——才是一次學習。
這正是刷題這個習慣走偏的地方。一套接一套地刷,感覺上像在進步,因為它可測量而且確實累人。但如果跳過糾錯環節,你只是在用越來越高的精度反覆測量同一個缺口。一套認真分析過的題,勝過五套匆匆刷完的題。
具體,而且忙起來也守得住:
每天(20 分鐘):廣泛閱讀你真心喜歡的東西,難度是你基本能懂的。這是地基,也是第一個被砍掉的東西。別砍它。
每天(10 分鐘):按間隔複習詞彙卡片。短,且不可商量。
每週三次(20 分鐘):計時閱讀練辨識速度——同一段讀兩遍,第二遍更快。
每週兩次(45 分鐘):完整寫一篇計時的 Task 2,含五分鐘列大綱。然後只就你正在盯的那兩類錯誤請人回饋。
每週一次(30 分鐘):拿到回饋後重寫那同一篇。這一步幾乎總被跳過,而它是一週裡學習效率最高的一步。
每兩週一次:一套完整的閱讀題,嚴格 60 分鐘,按考試條件。然後花在分析上的時間要長於做題的時間。
備考中最大的誘惑,是瞄準那個數字,而不是瞄準產生那個數字的東西。
但分數是對你某一時刻讀寫能力的測量。你可以讓這次測量更準確——透過理解考試、不因謄寫答案而丟分、不離題。這是熟悉度的功課,值得做,但它有天花板。
剩下的部分沒有捷徑。詞彙量是靠幾個月裡反覆遇見同一批詞長出來的。準確度是靠有人反覆指出同一個具體錯誤、直到你自己開始抓住它而提高的。閱讀速度是靠詞彙辨識變成自動化而上去的。
這些沒有一樣會在考前那一夜發生。但只要習慣活得夠久,它們全都會相當可靠地發生——而按數據,該瞄準的數字是大約兩個月,不是三週。
同樣的內容,用淺白的話再講一遍——寫給年紀小的讀者,也寫給想快點抓住要點的人。
有一個非常眼熟的場景。某人做了四十套模擬題。他知道題型,知道 NOT GIVEN 的陷阱,任何 Task 2 題目他都有現成的提綱。而他的分數仍然是 6.5,和六個月前一模一樣。
通常的反應是再多做幾套。但如果四十套不夠,第四十一套也不會夠,而且原因很具體。
準備雅思其實是兩件不同的活兒,而學習者幾乎總是把它們混成一件。
第一件是熟悉形式。知道有幾個部分、題目長什麼樣、要寫多少詞、評分標準是什麼。這是真實且必要的功夫——但它很快就飽和。大約做完五到十套之後,關於考試形式值得知道的你基本都知道了。從那以後,再做更多套題,關於這場考試幾乎再教不了你任何東西。
第二件是把英語程度提上去。那件事走得慢,以月計而不是以週計,而在熟悉形式飽和之後,決定你分數的正是它。
每個人都會撞上的那個高原期,恰恰就是第一件事耗盡、而第二件事還沒跟上的那一刻。
而研究在這裡說了句不太中聽的話。Anthony Green(2007)比較了上專門雅思備考課程的學習者與上一般學術英語課程的學習者。在寫作進步上,備考組並沒有勝出。照著考試教,並沒有帶來所有人都預設它會帶來的那份優勢。
Elder 與 O'Loughlin(2003)補上了數字:測量密集英語學習期間的分數增長,他們發現進步真實但有限——平均而言,全日制學習幾個月之後約提高半分,個體差異很大。
直說:如果你需要整整一分,請按月做計畫,不要按週。承諾別的人是在賣東西。
看真實的數字。學術閱讀給你 60 分鐘、三篇文章、40 道題,共 2,150–2,750 詞。而且與聽力不同,不另給謄寫答案的時間——那 60 分鐘已經包含把答案抄到答題卡上。
幾乎所有人都把這診斷成時間管理問題。通常並不是。
取一套約 2,450 詞的平均試卷,套用覆蓋率門檻。Hu 與 Nation(2000)指出,要在無人幫助的情況下讀得舒服,你需要認識約 98% 的行文詞。
在 98% 覆蓋率下,你在那套題裡會遇到大約 49 個生詞。煩人,但撐得住。
在 95% 下——仍然是不錯的英語程度——你會遇到大約 122 個生詞。每停下來推測一個都要花幾秒,而它們會累積。你不是慢;你在為每一行繳納詞彙稅。
這就是為什麼技巧提示只能幫到某個限度。你沒法略讀你解碼不了的東西。 略讀假定的是:當你的眼睛掃過那些詞時,它們的意思會自動點亮。如果沒點亮,這個技巧就垮了。
所以功夫有兩部分,而大多數學習者只做第二部分。
建學術詞彙。 這是長線,也是間隔重複的教科書案例(Cepeda 等,2006)。優先一般學術詞彙,而不是罕見的專業術語。
建辨識速度。 這是被忽略的那一半。Grabe(2009)強調第二語言的閱讀流暢度必須單獨訓練:認識一個詞,和在四分之一秒內認出它,是兩項不同的成就。 你用計時閱讀和同一篇反覆讀來訓練它——不是用更多套題。
這兩者底下墊著的是泛讀。Nakanishi 的後設分析(2015)發現在理解力和詞彙上有小到中等的增益。每天二十分鐘讀你真正喜歡的東西,能做到每週一套模擬題做不到的事:它給你量。
寫作給你 60 分鐘:Task 1 約 20 分鐘、至少 150 詞;Task 2 約 40 分鐘、至少 250 詞。Task 2 的權重是 Task 1 的兩倍。
答卷按四條標準評分,每條權重相同:Task Achievement/Response、Coherence and Cohesion、Lexical Resource、Grammatical Range and Accuracy。
請在這裡停一會兒,因為它改變了練習該長什麼樣。四條裡有三條並不問你有沒有好點子。 它們問的是組織、詞彙和文法準確性。
可當學習者「練寫作」時,他們壓倒性地只練一件事:生成內容、湊夠詞數。四分之三的分數來自那些很少被單獨拿出來操練的技能。
這正是 Ericsson 的刻意練習(1993)派上用場的地方。單純重複不產生進步;產生進步的是帶著回饋、針對一項被界定清楚的子技能所做的工作。沒有回饋地寫三十篇作文,多半是在把你已有的錯誤再練一遍。
這是寫作研究裡最長的爭論之一,而它有一個可用的結論。
Truscott(1996)直言寫作課上的文法糾錯無效、甚至可能有害,應予放棄。Ferris(1999)反駁。爭論持續了數十年。
它落定的地方相當清楚:聚焦式回饋比全面式回饋管用得多。 把一篇作文裡的每一個錯都改掉,往往不會帶來持久進步——作文一片紅地還回來,學習者掃一眼,什麼也沒留下。但當回饋只針對一兩類特定錯誤時,恰恰在那些點上的準確性會提高並保持。Bitchener 與 Knoch(2010)在高水準寫作者身上也找到了這類效應。
這換算成一個非常具體的習慣。不要請任何人把所有東西都改一遍。挑兩類錯誤——比如冠詞和主謂一致——只追蹤這兩類,為期三週。等它們穩了,再換兩類。
對說沒有屈折變化的語言的人來說,候選清單是可以預料的:冠詞(a/the/零冠詞)、複數 -s、時態與 -ed、第三人稱單數 -s。這些都是又短又不帶重音的語素,說話時會被吞掉——也就是說,你的耳朵永遠不會替你抓住它們。 它們必須被有意識地處理。
最受歡迎的備考策略也是最冒險的:背下範文段落,往每一道題上套。它失敗有兩個理由,兩個都寫在評分標準裡。
Task Response 掉下去。 一段背下來的開頭是為一道籠統的題寫的;真正的題是具體的。你越是把模板硬塞進去,作文就離真正的問題越遠。考官受過訓練能識別背誦內容,而不是你自己產出的語言,不會計入你的能力。
Lexical Resource 也掉下去。 那些被用濫的模板短語——「In this ever-changing world…」那一族——並不是更少見的詞彙項。它們是世上最常見的那些。
不過這個想法有一個正確的版本,而且它管用:學小而靈活的語塊,而不是整段。表示轉折的方式、讓步的方式、引入例子的方式、給論斷定量的方式。這些能附著到任何內容上。它們是工具,不是腳本。
再加一個便宜且有證據的習慣:寫 Task 2 之前花五分鐘做計畫。Ellis 與 Yuan(2004)表明任務前計畫能可測量地提升第二語言寫作的流暢度與複雜度。五分鐘不是丟掉的時間,是後面買回來的時間。
這是大多數學習計畫失敗的地方。不是因為內容錯了,而是因為它們沒能活過兩週。
第一,把 21 天這個數字丟掉。 那是民間說法。Lally 等(2010)追蹤真實的人養成真實的習慣,發現中位數是 66 天,範圍隨行為和人而異,從 18 天到 254 天。如果到第三週學習仍然費力,你沒有失敗——你正好在資料預測的位置上。
第二,使用執行意圖。 這是整個習慣科學裡證據最強的技術,而且基本免費。Gollwitzer(1999)表明「如果出現情境 X,那麼我就做 Y」這種形式的計畫遠遠勝過籠統的意願。Gollwitzer 與 Sheeran(2006)對數百項研究做的後設分析發現中到大的效應。
實際上:「我要更努力學習」幾乎沒用。「倒完早晨那杯咖啡之後,我就在餐桌上讀一篇閱讀」管用,因為它已經預先決定了時間、地點和觸發點。
第三,保持情境穩定。 Wood 與 Neal(2007)把習慣描述為情境—反應的聯結:行為附著在反覆出現的環境線索上。在同一個地方、同一個時間學習,比每天重新決定要省下太多意志力。
第四,把最低量定得小到能熬過糟糕的一天。 每天三小時的計畫活不過第一週。四十五分鐘能。
它們並非無用——但它們有用的原因,不是人們以為的那個原因。
做一套模擬題是一次提取,而 Roediger 與 Karpicke(2006)表明提取本身對記憶的強化遠勝過重讀。所以模擬題確實在教——只是教的量與它吃掉的時數不成比例。
決定它們價值的是之後發生的事。一套批改完就歸檔的題是一次測量。一套被拆開的題——每個生詞進卡片系統,每道錯題追到原因(是我不認識那個詞?沒看懂題目?還是時間不夠?)——才是一次學習。
一套接一套地刷,正是在這裡走偏。它感覺像進步,因為它可測量而且確實累人。但如果跳過了糾錯環節,你只是在用越來越高的精度反覆測量同一個缺口。 一套被認真分析過的題,勝過五套匆匆做完的。
每天(20 分鐘): 泛讀你真正喜歡的東西,選一個你大體讀得懂的難度。這是地基,也是第一個被砍掉的。別砍。
每天(10 分鐘): 間隔重複的詞彙卡。短,且不可商量。
每週三次(20 分鐘): 為辨識速度做計時閱讀——同一篇讀兩遍,第二遍更快。
每週兩次(45 分鐘): 計時條件下完整寫一篇 Task 2,含五分鐘計畫。然後只就你正在追蹤的那兩類錯誤請求回饋。
每週一次(30 分鐘): 拿到回饋後重寫那同一篇作文。這一步幾乎總被跳過,而它是一週裡學習率最高的一步。
每兩週: 一整套閱讀,嚴格 60 分鐘,按考試條件。然後花在分析上的時間要多於你做題的時間。
備考最大的誘惑,是去瞄準那個數字,而不是瞄準產生那個數字的東西。
但分數是對你某一時刻的閱讀與寫作所做的一次測量。你可以讓這次測量更準確——透過理解考試,透過不在謄寫答案時丟分,透過不寫離題。那是熟悉形式的功夫,值得做,但它有天花板。
其餘沒有捷徑。詞彙是在幾個月裡反覆遇見同一批詞而長出來的。準確性是在有人足夠多次地指著某一個具體錯誤、直到你自己開始抓得住它時才提升的。閱讀速度是在詞彙辨識變得自動時才上來的。
這些沒有一件會在考前一夜發生。但只要習慣活得夠久,它們都會相當可靠地發生——而資料說,該瞄準的數字是大約兩個月,不是三週。
這些文章綜合了學習科學與語言學中公認的研究成果。主要來源與延伸閱讀:
錄音只播放一次。這一個事實統轄整張卷子,所有值得學的技巧都是它的推論。
三個部分不是同一項任務的三個難度層級。它們考的是不同的東西——在 Part 1 拿分的答案長度,到 Part 3 就會讓你丟分。
Task 2 的分量是 Task 1 的兩倍。所以你做的最要緊的決定不是想出一個好詞組,而是在第二十分鐘停下 Task 1。