用演化的眼光看學習科學
每個正常的孩子都能在無人教導的情況下學會說話。沒有一個孩子能在無人教導的情況下學會讀寫。心理學家大衛·吉爾里把這兩件事分別叫作「生物學初級知識」與「次級知識」——這道裂縫解釋了為什麼發現式學習對前者有效、對後者失靈,為什麼學習本來就該費力,以及為什麼你的記憶會遺忘,其實是設計而非故障。
每個正常的孩子都能在無人教導的情況下學會說話。沒有一個孩子能在無人教導的情況下學會讀寫。心理學家大衛·吉爾里把這兩件事分別叫作「生物學初級知識」與「次級知識」——這道裂縫解釋了為什麼發現式學習對前者有效、對後者失靈,為什麼學習本來就該費力,以及為什麼你的記憶會遺忘,其實是設計而非故障。
有一件事我們太熟悉了,熟悉到不再覺得它奇怪。
每一個正常的孩子,在每一種文化裡,都能在無人教導的情況下學會說母語。沒有大綱,沒有練習題,沒有人給他講文法。到五歲時,他已經在自如使用一些結構——而一個成年人把同一門語言當外語來學,可能要和這些結構纏鬥好幾年。

然而,沒有一個孩子能靠自己學會讀寫。文字必須被系統地教授,教上好幾年,而且相當一部分學習者終其一生仍覺得吃力。
同一個大腦,同一門語言。差別從何而來?
最有用的答案來自心理學家大衛·吉爾里(David Geary),他在兩類認知能力之間劃了一條線。
生物學初級知識是我們這個物種在演化中被塑造成「會自動獲得」的東西:說和聽懂母語、辨認人臉、一眼判斷少量物體的數目、在空間中找路、讀出別人的意圖。這些能力出現在每一種文化裡,按大致相同的時間表發育,並且無需教學就能獲得——一個孩子只需要待在人群中,然後玩。
生物學次級知識則是那些太年輕、演化來不及為我們準備的文化發明。文字大約有五千年歷史;代數、化學符號、樂譜和程式設計要年輕得多。人類沒有「讀寫本能」,就像有「說話本能」那樣的東西並不存在於讀寫上。這些必須被主動傳遞,而學習者必須付出有意識的努力。
神經科學家史坦尼斯拉斯·狄漢(Stanislas Dehaene)揭示了其中的機制。當我們學習閱讀時,大腦並不會啟動一個專為文字而生的腦區——因為根本沒有這樣的腦區。它徵用了一小片原本演化來辨識形狀與物體的視覺皮質,再把它重新訓練成辨識字形的裝置。狄漢把這稱為神經元再利用(neuronal recycling)。學會閱讀,字面意義上就是借用一台為別的用途造出來的機器。
這個區分聽起來很學院氣,但它了結了教育界最漫長的爭論之一。
那個論證聽起來相當合理:孩子靠沉浸就學會了說話,沒人教——那就讓他們用同樣的方式學數學、學閱讀、學科學吧。讓他們去發現。別講課。
這混淆了兩種知識。自然的發現之所以對初級知識有效,是因為大腦本來就準備好了。而對於大腦完全沒有準備的次級知識,沒有任何東西保證同一件事會發生。
這正是基爾施納、斯威勒與克拉克(Kirschner, Sweller & Clark)2006 年那篇著名論文的立足點:最小指導對新手是失效的。不是因為發現不好,而是因為面對次級內容時,新手缺乏能發現出任何有價值東西的背景知識。他們在黑暗中摸索,工作記憶被灌滿,最後留下的很少。
約翰·斯威勒(John Sweller)走得更遠,他把整個認知負荷理論建立在演化的地基上,把人類認知與自然選擇並置描述:兩者都是隨時間建構複雜結構的資訊處理系統。
其中兩條原則值得單獨拎出來。
借用與重組原則。你所知道的幾乎一切,都不是你發現的。你從別人那裡拿來——透過說話、文字和觀看。這,而不是個人的發現,才是人類這個物種主要的學習機制。原創性的發現既罕見又昂貴。
變化的狹窄界限原則。工作記憶一次只能容納少數幾個元素。這聽起來像個缺陷,但它有演化上的道理:對一套已經能用的知識儲備做大幅而快速的改動,損壞它的機率遠高於改進它——正如大規模突變通常是致命的。一條狹窄的通道,逼著改變只能緩慢發生,一次一小塊。
換句話說:遇到難懂的概念時那種「腦子被塞滿了」的感覺,不是你遲鈍的證據。那是一套安全機制在正常運作。
演化的視角也把我們對記憶的看法整個翻轉過來。
記憶並不是為了「儲存」而演化出來的。它是為了預測而演化的——讓恰當的資訊在你面前的情境中可用。這樣看,放掉那些已經不再被使用的東西就不是失靈,而是系統讓有用之物保持在伸手可及處的方式。
羅伯特與伊莉莎白·比約克(Robert & Elizabeth Bjork)把這一點形式化了:一段記憶同時有儲存強度和提取強度,而兩者會分離。此刻最容易想起來的,往往正是存得最不牢的。這解釋了有益的困難(desirable difficulties)為什麼管用:用提取代替重讀,用間隔代替集中,用交錯代替成塊。它們全都讓學習的感覺變差,卻讓結果變好。
有一項發現尤其說明問題。詹姆斯·奈恩(James Nairne)和同事讓受試者用各種方式加工詞表,其中一條指令是:想像你被困在草原上,為每個物品對生存的有用程度評分。這個「生存框架」帶來的回憶成績,超過了此前被認為最強的深加工方法。我們的記憶,直到今天仍然在字面意義上偏愛那些對石器時代大腦重要的東西。
對語言學習者來說,演化框架能理順好幾件原本看上去自相矛盾的事。
為什麼沉浸有效——但不是對一切都有效。聽和說調動的是初級機器:聲音、節奏、社會互動、讀懂對方的意圖。這就是為什麼住在母語者中間,對理解力和流利度幫助那麼大。
為什麼書寫完全是另一個問題。希臘字母、漢字、英語拼寫——全都是純粹的次級知識。這裡沒有任何本能能幫你。它們必須被系統地教、被拆成部件、被按計畫複習。
對華語母語者來說,這一點其實近在眼前。你不用教就會說華語,可是識字要練十年:筆順、部首、間架結構、三千個常用字,一個都不會自己「滲」進腦子。這不是孩子笨,而是文字這件事本來就在演化預算之外。反過來,當你去學英語拼寫、韓文字母或希臘字母時,你會再一次撞上同一堵牆——而應對辦法也一樣:拆成規律的小塊,按間隔重訪。這正是把一份龐大的次級負荷,變成一個窄小的工作記憶處理得了的東西的方法。
還有,為什麼動機是一個真實存在的問題。沒有哪個孩子需要被鼓勵才肯學說話。但每個人都需要一個理由,才肯坐下來對付三十個字。初級知識自帶動機;次級知識的動機必須外部供給。這不是學習者的性格缺陷——這是問題本身的形狀。
一個強而有力的框架容易被用過頭,所以要誠實地標出幾條界限。
初級與次級的界線並不銳利。它是一個有用的分類,而不是一條界定清晰的生物學邊界。批評者指出,很難檢驗某項能力究竟該歸入哪一類,而這削弱了它的解釋力。
演化解釋很容易滑向「事後編故事」。任何一個特徵,事後都能被配上一個聽起來合理的演化說法。這個框架裡值得信任的部分,是那些能做出可檢驗預測的部分——比如奈恩的生存加工效應,或者認知負荷的實驗。
最重要的一點:「我們不是為此演化的」不等於「這學不會」。它的意思是:這必須被教、被下功夫、被好好設計。人類閱讀、做數學、寫軟體都做得極好。只是不是自然而然做到的。
先給你要學的東西分類。這是大腦生來就有準備的,還是一項文化發明?答案決定方法:前者靠沉浸與練習,後者靠明確的教學。
面對次級知識,不要等它自己到來。去把清楚的講解、做好的例題、成套的體系找出來。自己把規則琢磨出來這件事很有吸引力,但對新手來說要慢上好多倍。
把初級機器借來當鷹架。故事、空間意象、聲音、與另一個人的互動——這些是大腦幾乎不花代價就能處理的通道。一個掛著畫面和故事的字,比一個光禿禿的字待得牢。
把遺忘算進計畫裡。不要用「學的時候感覺多順」來衡量進展。用「一週之後還剩下什麼」來衡量——然後圍繞它安排複習。
你帶進一堂語言課的這個大腦,是被幾十萬年的說話、觀看,以及記住那些關乎活命之事所塑造的。它從來沒有為文字做過準備。知道這一點並不會讓學習變輕鬆——但它確實解釋了為什麼有些東西必須被教、被重複、被體系化,以及為什麼「費勁」這種感覺並不是你做錯了的信號。
同樣的內容,用淺白的話再講一遍——寫給年紀小的讀者,也寫給想快點抓住要點的人。
每個孩子都不用教就學會說話。可沒有哪個孩子能自己學會讀字。
同一個大腦,同一門語言。差別從哪兒來?
有用的答案,是在兩類東西之間劃一條線。
第一類,是我們這個物種演化來就會去獲取的。說母語、聽懂母語。認臉。一眼估出小數目。在空間裡找路。讀出別人的意圖。
這些在每種文化裡都出現,按大體相似的時間表長出來,而且不需要教。孩子只需要待在人群裡,然後玩。
第二類,是那些太新、演化來不及為我們配備的文化發明。文字大約五千歲;代數、化學符號、樂譜和程式設計,都年輕得多。
並不存在一種「閱讀本能」,像存在「說話本能」那樣。這些東西必須被主動傳授,而學的人必須付出有意識的努力。
它並沒有打開一塊為文字而造的區域,因為沒有那樣的區域。它是把一小片本來演化來識別形狀與物體的視覺皮質挪作他用,再拿字形去重新訓練它。
學認字,字面意義上就是:借用一台為別的用途造出來的機器。
那場爭論聽著挺有道理:孩子靠沉浸就學會了說話,沒人教——那就讓他們用同樣的方式去學數學、認字和科學吧。讓他們自己發現。別講課。
這混淆了兩類知識。自然發現在第一類上行得通,因為大腦是帶著準備來的。而在第二類上——大腦對它毫無準備——沒有任何東西保證同樣的事會發生。
最低限度的指導對新手是失敗的——不是因為「發現」不好,而是因為面對這類內容,新手恰恰缺少那份能讓他發現出有價值東西的背景知識。他摸索,工作記憶被灌滿,最後留下的很少。
你帶進中文課堂的那個大腦,是被幾十萬年的說話、觀看,以及記住那些關乎活下去的事情所塑造出來的。它從來沒有為文字做過準備。
知道這一點,學習不會因此變輕鬆。但它解釋了為什麼有些東西必須被教、被重複、被系統化——以及為什麼「費勁」這種感覺,並不是你做錯了的信號。
這些文章綜合了學習科學與語言學中公認的研究成果。主要來源與延伸閱讀:
這個問題預設了專注是一塊練了會變大的肌肉。最扎實的證據說,練出來的部分幾乎搬不走,而真正變好的一份來自減法——從那個你感覺...
沒時間、沒天分、年紀大了——這些是解釋,不是原因。真正量得出來的要乏味得多:一句帶時間、帶地點、帶第一個動作的話,而還沒有...
不是一件事,而是四件,跑在相差十億倍的鐘上:400毫秒處的一個波、一夜之間被鎖住的一個詞、幾個月裡收窄的活化範圍、幾年裡改...