
學習金字塔查證:聽課 5% 教人 90% 是真的嗎
學習金字塔宣稱聽課只記得 5%、教別人能記住 90%,這組數字被課程與企業內訓教材引用了幾十年。文中往源頭查證:被引用的 NTL Institute 承認找不到原始研究,戴爾 1946 年的經驗之塔原始版本沒有百分比,英文維基百科已將它歸為偽科學模型,並整理測試效應、主動學習後設分析與教學預期實驗等有方法的替代證據與落地做法。
- 學習金字塔
- learning pyramid
- 學習金字塔是真的嗎
- 學習金字塔迷思
- 教別人90%
- 學習金字塔查證
- 經驗之塔
- 戴爾
- 測試效應
- 分散練習
- 主動學習
- 教學預期
- 學習迷思
- 記憶保留率
約 26 分鐘閱讀作者:Whoops 編輯團隊
「聽講只記得 5%,閱讀記得 10%,看影片 20%,看示範 30%,小組討論 50%,動手做 75%,教別人 90%。」這組數字在教學簡報、企業內訓教材與知識型內容裡出現了幾十年,通常搭配一句「研究顯示」。查證結果分成兩個必須分開回答的問題。第一個問題:這張圖表存在而且流傳很廣嗎?答案是真的,它有名字,叫學習金字塔(learning pyramid),也有大量變體。第二個問題:這些百分比是研究測出來的嗎?答案是否定的,往上追會遇到一條斷掉的來源鏈,被引用的源頭機構自己都承認拿不出原始研究。
「數字是假的」與「方向是錯的」也要分開。大學理工課程中的主動學習有實證支持,這一點有合併兩百多個研究的大型後設分析支撐,效應量、樣本、方法攤在陽光下可供檢查。大學理工課程的主動學習研究,衡量的是成績與當掉率,不能用來驗證金字塔按活動分層的保留率。那七個百分比缺少可查的測量程序。可以保留的是限定情境下有證據的教學效果,應撤下的是沒有相應研究的七層刻度。
這份查證把整條線走完:先拆解宣稱的結構,再追被引用的源頭 NTL Institute,再往上溯到 1946 年的經驗之塔,接著看學術界超過半個世紀的查證結論,檢討這張圖表為什麼殺不死,找回真正有研究基礎的替代技術,整理成查證三步,提供給課程創作者與企業講師一套撤下假數字之後仍然站得住的說法與做法。文內引用的論文與查證狀態以 2026 年 9 月 18 日查到的版本為準。
先給對照錨點。站上的寫作鐵律查證也用相近的查證骨架:把宣稱與證據分層,往源頭追,看方法,比對每一手轉述。學習金字塔是同一種練習的教科書級案例,因為它牽涉的不只是數字真假,還包括一個機構的歸屬故事、一本教科書的誤讀史,以及學界點名反駁之後引用量不降反升的傳播現象。
重點先看
一、七層數字(5%、10%、20%、30%、50%、75%、90%)作為「研究測得」的宣稱不成立。最常被引用的源頭 NTL Institute 在回覆中明說:他們相信這個模型正確,但已經找不到、也拿不出支撐這些數字的原始研究。
二、再往上追是美國教育學者戴爾 1946 年提出的經驗之塔。原始版本沒有任何百分比,也不以科學研究為基礎,戴爾本人還提醒讀者別把塔的排序當成鐵律。數字是後人疊上去的。
三、學界的結論一致:Lalley 與 Miller 在 2007 年的文獻回顧找不到任何可信的支撐研究,Subramony 等四位研究者 2014 年證明每一個被點名的「正確出處」都站不住腳,英文維基百科也已把學習金字塔歸類為偽科學模型。
四、方向有真實證據,但證據的形態完全不同:Freeman 團隊合併 225 個研究的後設分析顯示主動學習提高考試表現、降低當掉率,Dunlosky 團隊的評比中,練習測驗與分散練習名列最高效用,抱著「等一下要教人」的預期讀書,記憶表現也真的更好。
五、可以立刻做的動作:課程頁與行銷文案撤下 90% 這顆數字,改引有方法的實證。聽到任何帶數字的學習主張,走一遍往源頭追、看方法欄、比對每一手轉述。
宣稱與證據:查證在查什麼
一個帶數字的學習主張由兩層構成。宣稱層是那句話本身:聽講只能記住 5%。證據層是這句話背後的東西:誰測的、測了誰、怎麼測、多久之後測。查證的動作就是拿宣稱層去對證據層,金字塔的問題出在第二層是空的,而轉述的人用「研究顯示」四個字把空洞填了起來。
把學習圈常見的數字主張排在同一條線上,可以分出四個位置。最左邊是查無出處的數字,來源鏈在中途斷掉,誰也指不出最初的研究。往右一格是被引源否認的數字,出處文件或機構真實存在,可是被引的一方明說數字不是它測的,或者拿不出依據。再往右是描述性模型,提出者本來就沒有把它當成測量結果,它是排序想法的圖像。最右邊是有方法細節的實證,樣本、程序、效應量與限制公開可查。金字塔的七層數字落在前兩格的混合位置:它住在一個真實機構的歸因故事裡,而那個機構拿不出這些數字的出處。主動學習的效果落在第四格。
這四個位置可以當判讀框架用。判讀的第一步是確認宣稱落在哪一格,因為每一格的處理方式不同。第一格直接降級為「來源不明的說法」。第二格要引述否認本身。第三格可以引用,但要忠於它的描述性身份,不能替它補上數字。第四格才能寫「研究顯示」,而且要連方法一起講。
還有一個容易混淆的口徑先講清楚。查證否定的是「這些百分比由研究測得」這件事,不是「這張圖表存在」這件事。圖表存在、流傳廣、被大量教材引用,都是可查證的事實,下文引用的醫學教育文獻回顧甚至記錄了它被引用量急劇增加的趨勢。把這兩個口徑分開,查證的結論才站得住:一個東西流行與否,跟它對不對,中間沒有任何關係。
標準形態:七層數字長什麼樣
先把宣稱的標準形態完整擺出來。依英文維基百科的整理,最常見的版本是一個七層金字塔,從頂端往下依序是:聽講 5%、閱讀 10%、視聽教材 20%、看示範 30%、小組討論 50%、實作練習 75%、教別人或立即使用 90%。維基條目同時記錄了這個模型的一堆別名:cone of learning、learning cone、cone of retention、pyramid of retention。
數字不只一套。研究學習迷思的 Thalheimer 在他的Work-Learning Research 網站上列出過文字版的標準形態:「人們記住所讀的 10%、所聽的 20%、所看的 30%、視聽並用的 50%、所說的 70%、邊做邊說的 90%」。對照金字塔圖表會發現配對已經變了:圖裡聽是 5%,文字版聽是 20%。圖裡實作是 75%,文字版說是 70%。他看過數百個版本,結論是變體的多樣程度令人吃驚。
學術查證對這個現象有正式記錄。Subramony、Molenda、Betrus 與 Thalheimer 四人在2014 年的教育技術期刊專題裡寫得直接:這些百分比以數十種排列組合的形式被轉述。這個細節本身就是線索。真正的測量結果經得起版本比對,同一個實驗不會被轉述成幾十種數字配對,這些變體要求我們逐一核對數字與原始研究的對應,像民間故事每講一次就換一個版本。
連圖表自己的欄位設計都藏著一個沒有被兌現的承諾。維基條目附的 NTL 版表格,兩個欄位的名稱分別是「保留率」與「測驗前的學習活動」。欄位名稱等於承認了一個前提:保留率是相對於某個測驗而言的數字,測驗的時點會改變一切。可是整張圖從頭到尾沒有告訴你測什麼、怎麼測、學完隔多久測,而這三個問題恰好是記憶研究全部的難度所在。隔五分鐘測與隔一週測,同一種教學法可以給出完全相反的排名,後文的測試效應實驗會親自示範這件事。
| 金字塔層級 | 宣稱保留率 | 常見中文轉述 |
|---|---|---|
| 聽講 | 5% | 「上課聽講最沒效」 |
| 閱讀 | 10% | 「看書記不住」 |
| 視聽 | 20% | 「看影片好一點」 |
| 看示範 | 30% | 「看人做一遍」 |
| 小組討論 | 50% | 「討論勝過單向聽」 |
| 實作練習 | 75% | 「做中學最有效」 |
| 教別人 | 90% | 「教人是最好的學」 |
表裡數值最高的一層是整張圖表傳播力的來源。「教別人記住 90%」是表格裡最高的宣稱值,也能被拿來替教人或實作之類方法背書。Thalheimer 觀察到許多圖表變體,2014 年的專題也記錄百分比有數十種排列。這些材料能說明數字在流傳中變動,卻不能量出華語課程文案、講師簡報或學員筆記各自使用了多少。簡報若引用這組數字,仍須能交代原始研究。
第一站:被引源頭 NTL 的回覆
往上追的第一站是歸因故事本身。金字塔最常見的署名是 NTL Institute(National Training Laboratories,美國國家訓練實驗室),故事說法是:模型在 1960 年代初期由 NTL 位於緬因州貝塞爾的校區發展出來。維基條目在這句話上用詞謹慎,寫的是「據稱」由 NTL 發展,並註明據稱存在的內部研究已經佚失。一個模型的原始研究處於「據稱曾經存在」的狀態,本身就已經是警訊。
有人真的去問過。依後來的考據整理,美國查爾斯頓學院學術計算部門的一位人員,曾經寫信給 NTL,要求提供金字塔的原始研究。NTL 的回覆被 Lalley 與 Miller 兩位學者收進 2007 年的論文裡,之後在網路上有兩份獨立轉錄可以對照,文字一致。回覆關於源頭的部分是這樣的:金字塔確實在 1960 年代初期,於 NTL 貝塞爾校區發展使用,當時 NTL 還隸屬於全國教育協會的成人教育部門。
回覆的下半段是整個查證的關鍵,翻譯如下:「我們相信它是正確的,但原創研究我們已經沒有了,也找不到支撐這些數字的資料。相關詢問每個月都有很多,許多人找過原始研究,全部空手而回。」被全世界教材引用了幾十年的數字,源頭機構的正式答覆是四連:沒有、找不到、很多人找過、全找不到。
回覆裡還有一條線索值得單獨看。NTL 表示,他們知道 1954 年一本名為《Audio-Visual Methods in Teaching》的書第 43 頁,出現過一個數字略有出入的相似金字塔。這本書的作者正是教育學者戴爾,也就是下一站要追的人。換句話說,連被引用的源頭機構都把指針往更早的地方撥,而後續考據連這條線索也推翻了:1954 年那本書的原圖同樣沒有任何百分比,數字在戴爾的三個版本裡從未存在過。
順著「研究佚失」這條線,維基條目的總結值得整段消化:這個領域整體站在一個方法不明、品質不明的研究之上,影響結果的參數,例如時間間隔、受測人群,如何被控制也不得而知,因此原始研究的結果不可信賴。查證圈對「研究佚失」的標準處理是:無法檢查的研究等於不存在的研究。主張者的責任是拿出可檢查的證據,時間過去多久、找過多少人,都不會把舉證責任轉移到質疑者身上。
再上一層:戴爾的經驗之塔沒有數字
金字塔的視覺祖先,是戴爾(Edgar Dale)在 1946 年的教科書裡提出的「經驗之塔」(Cone of Experience)。依維基百科的戴爾條目,他在 1929 年離開柯達的教學影片部門,成為俄亥俄州立大學的教授,專長是把視聽教材引進課堂,這個塔在 1954 年與 1969 年兩度修訂。依條目的描述,這座塔要提供的是各類視聽媒體在具體程度上的直觀模型:有的媒體讓學習者靠近直接經驗,有的偏向抽象的符號表達,差別在經驗的直接性。
關鍵事實只有一條:原始的塔沒有任何百分比。維基條目寫得明確,戴爾沒有放進任何數字,塔也不以科學研究為基礎,他甚至提醒讀者不要把塔看得太認真。Thalheimer 網站上貼出了從 1969 年版書裡影印出來的原圖,結論相同:塔上沒有數字,作者本人還警告過讀者別照字面理解。今天簡報裡那個掛滿百分比的錐形圖,每一個數字都是別人替他補的。
塔的用途也常被講反。Lalley 與 Miller 的2007 年論文考據了原始設計:塔要表達的是教學方法應該依學生的背景知識調整,它呈現的是方法的連續體,並非效力的階梯。把連續體畫成階梯,再替每級階梯掛上一個保留率,等於把作者的比喻改寫成作者的測量,而測量從來沒有發生。戴爾在教學媒體領域是受敬重的研究者,把他捲進這件事最諷刺的地方在於:拿他的名字替假數字背書,恰恰違背了他自己對模型的保留態度。
這條上溯路線同時解釋了金字塔的另一個視覺特徵:錐形。常見的圖把「聽講 5%」放在頂端、「教別人 90%」放在底部,而戴爾的塔區分的只是媒體的具體與抽象程度,抽象度高低與記憶好壞在他的原始用法裡並不掛鉤。把數字套上塔身之後,讀圖的人自然把「越低越具體」誤讀成「越低越有效」,一個關於媒體光譜的示意圖,就這樣變成了效力的排行榜。

起源羅生門:每個候選出處都被推翻
數字不是戴爾放的,NTL 也拿不出支持數字的原始研究,那是誰加的?答案是沒有定論,而且查證的過程本身就是教材。被點名過的起源不只一個。維基的戴爾條目記載的候選是 1967 年一位石油公司員工 Treichler 發表的非學術文章。Thalheimer 的整理則記錄了另一批人依賴的引用:1943、1947、1963 與 1967 年的研究文獻。
2014 年的專題論文把這條線查到了底。Subramony 等人發現,10%、20%、30% 這組數字早在 1914 與 1922 年的文獻裡就已經出現,而且當時的行文姿態是「眾所周知的常識」。這代表 1943 之後被當成「定義性研究」的引用對象,本身就是轉述更早的無源說法,而 1967 的候選源也一樣:論文的核心結論之一,是每一個被世人宣稱為正確出處的來源,經查證後全部被推翻。
論文還整理了一份假出處清單:被轉述者拿來當源頭的 NTL Institute、被點名的 Glasser、英國視聽學會,以及 Chi 等人 1989 年的研究,全部被證明不是真正的來源。一個數字宣稱若掛著多個互相衝突的出處,就要逐一核對各處是否真的包含測量方法與結果。這裡被點名的候選來源已遭查證推翻,仍不能從出處數量推斷其他主張也沒有原始研究。
專業研究者其實很早就聞出不對勁,理由樸素得驚人。Thalheimer 轉述的查證論證是:這些數字全部能被 5 或 10 整除,做過研究的人一眼就知道這不可能是實測出來的,人類表現的變異不容許這麼整齊的數字。整齊數字值得追問測量與取整方式,單看整數不足以判定有無實測。這條「整齊度檢查」可以現學現用:任何把人類行為簡化成一排整數的統計宣稱,都值得先扣分再查證。
第二個專業直覺是邏輯自洽。查證者問了一個簡單的問題:數字宣稱裡有所謂「讀的保留率」與「看的保留率」,可是讀難道不是一種看?把讀與看拆成兩個獨立類別的測量要怎麼設計?讀與看如何分成可比較的條件,得由原始方法說明。這個分類疑點能促使查證,卻無法推知製圖者是否想過測量。金字塔沒有交代分類定義與程序,讀者因此無從檢驗那兩個保留率如何產生。
把三站連起來看:戴爾原圖沒有百分比,保留率數字與圖像後來被混合。NTL 承認找不到原始研究,各個起源候選也被後續查證推翻。現有材料無法指認最初加入數字的人,也無法判定流傳鏈上的責任。七層百分比仍缺少可查的測量根據。
學界怎麼判:從查無實據到偽科學
對保留率數字的反駁至少可追到 1971 年。這裡先看 Lalley 與 Miller 2007 年刊於 Education 期刊的論文,標題把問題問得很白:學習金字塔有把教師指向正確方向嗎?論文的結論開宗明義:對金字塔作為學生記憶保留指南的可靠性提出嚴重質疑。他們檢視文獻後的判定是,沒有發現任何具體、可信的研究支撐金字塔,而金字塔與戴爾理論的關聯也僅止於鬆散的連結。
值得停下來看的是論文同時查到了什麼。他們發現金字塔列出的每一種方法,在真實文獻裡都各有保留效果,沒有任何一種在所有情境下恆定勝出,每一種在特定情境下都有效。這個發現比「數字是假的」更有用:它說明真實世界的記憶表現由內容、學生狀態與教學設計的互動決定,方法排行榜在真實文獻裡並不存在。論文的落點放在教師身上:選擇教學方法的關鍵,是教師作為有知識的決策者。
另一個代表節點是 2014 年 Educational Technology 期刊四位研究者合寫的專題論文,前面已經引用過它的考掘成果。專題的態度比 2007 年更硬,四位作者的引語值得照錄:教室裡、訓練中心裡、家裡的學習者,正在接受依據不可靠且無效的原則設計的課程,在任何專業裡這都被稱為業務過失。研究者的用詞從質疑升級到 malpractice,因為此時證據狀態已經從「沒找到」變成「找過了,全部推翻」。
分類體系也跟著更新。英文維基百科現在把學習金字塔歸類為偽科學的無效學習模型群,並記錄批評者指出的金字塔與研究文獻之間的不一致。後文引用的測試效應實驗與學習技術評比,可供核對方法與結果。兩種身份在文獻層級上就分開了。
還有一項證據來自醫學教育圈,也最令人洩氣。Masters 在 2020 年刊於 Medical Education 的追蹤研究裡重做了 2013 年的文獻回顧,想看看指出金字塔是迷思之後,引用量有沒有下降。結果相反:醫學教育文獻引用金字塔的數量急劇增加,更離譜的趨勢是,反駁金字塔的文獻被拿來支持金字塔,連承認證據薄弱的研究者都照引不誤。
Masters 對這個現象提出一個可能原因:反駁的學術用語太客氣,後人讀了只覺得這是個「有爭議」或「仍在辯論」的模型。所以他把結論寫成了查證圈的直球:金字塔是垃圾,那些統計數字是垃圾,而且它們不是戴爾來的。在 NTL 拿得出原始研究的細節之前,他們的版本也必須當垃圾處理。一個醫學教育期刊的摘要願意寫到這個程度,正好示範了反駁的另一種語域。
為什麼查無實據的圖表還活著
查證終結不了傳播,這件事本身值得教材設計者研究。2014 年專題指出,這張圖把媒體與方法選擇的複雜度壓成易記的公式,可供引用者替原有的方法偏好背書。
整數的修辭力量是第二個機制。90% 與 5% 的對比提供了戲劇張力,聽起來像實驗室產物,實際上是修辭產物。在 Freeman 納入的大學理工課程裡,考試與概念測驗表現的平均差異為 0.47 個標準差,主動學習與傳統授課的平均當掉率分別為 21.8% 與 33.8%。現有引句能確認的是,圖表把方法選擇壓成好記的公式,使用者似乎會拿它替自身偏好背書。這不足以推定行銷文本的整體偏好,也不能量出誰追問過原始研究。
圖像流傳有一個可觀察的線索。Thalheimer 對「Dale 錐」做圖片搜尋,結果裡約八成是帶假數字的誤導版本。2014 年專題的作者群則把他們追蹤到的傳播動態形容為持續突變的網路瘟疫,並且特別提到傳到中國。教材若引用帶百分比的版本,引用的就不是戴爾原圖。版本已在流傳中變動,應先查清引用的是哪一版。
還有一個可能的使用方式:引用者原本偏好某種媒體或教學方法,便拿這張圖當背書。Thalheimer 的原文把它寫成觀察與推測,沒有量出講師群體的想法或動機。教材設計者若要撤下假數字,可以保留有研究支持的教學效果,並把引用換成有方法、有測量對象的研究。下一段就列出可核對的例子。
方向查證:主動參與真的有效嗎
撤下七層保留率後,可以另看測量成績與當掉率的教學研究。華盛頓大學 Freeman 團隊 2014 年發表於 PNAS 的後設分析,合併了 225 個比較傳統授課與主動學習的研究,對象是大學理工領域的學生。
結果的形態值得與金字塔並排欣賞。成績側:在納入的大學理工課程裡,主動學習的考試與概念測驗表現平均高出 0.47 個標準差。作者以第 50 百分位到第 68 百分位示意這個效果。當掉率側:主動學習課程的平均當掉率是 21.8%,純聽講課程是 33.8%,聽講的學生被當的機率約為 1.5 倍。注意這些數字的長相:有小數,也有明確的效應量與比較條件,每一個都可回溯到指定研究。這組數字的可信度,應由研究公開的比較對象、分析方法與限制來判斷,而不是由小數外觀決定。
把兩組數字並列時,應先交代各自的測量對象,避免讀者誤認它們在衡量同一結果。Freeman 衡量的是大學理工課程成績與當掉率,金字塔宣稱的是活動別記憶保留率,兩組指標不能互換。引用時應分別交代兩組主張的測量對象與證據狀態。

效應量的換算方式也值得學一次,之後讀任何學習研究都用得上。0.47 個標準差聽起來抽象,後設分析裡的通行換算是把它放到百分位上:原本排在第 50 百分位的學生,換到主動學習的教室後平均會移動到第 68 百分位。這個百分位示例說明分數分布中的位置變化,並非固定的百分比分數增幅。這類數字沒有 90% 那樣的戲劇效果,可是每一個單位都對得上可查的研究,簡報現場被問到「數字哪來的」,你可以直接給出研究、樣本數與換算方式,而不是重複一次「研究顯示」。
證據的邊界也要照實講。Freeman 團隊自己註明,納入研究的講師是自願採用主動學習的一群,全面推行後效果是否相同仍是開放問題。Lalley 與 Miller 那邊的提醒同樣重要:金字塔列的每種方法在特定情境都有效,純聽講並未出局,好的講課依然是教學工具箱裡的一件。真實證據自帶限制條款,這一點也與金字塔不同。
有據的替代品:真正被驗證過的學習技術
講師與創作者真正需要的不是「哪個方法排第幾」,而是可以放進課程設計的具體技術。在 Dunlosky 團隊評比的十種技術中,練習測驗與分散練習獲得最高效用評級。先看與練習測驗相關的測試效應。Roediger 與 Karpicke 2006 年刊於 Psychological Science 的實驗用教育性材料研究它:受試者讀文章後,一組重讀,一組接受回憶測驗,之後在五分鐘、兩天或一週後測最終保留。五分鐘後測,重讀組佔上風。延遲測驗裡劇情反轉,做過測驗的組別保留顯著更好,而且重讀組對自己記憶的信心更高。信心往上、表現往下,這對「感覺很有用」的學習法是最實在的警告。
第二個是系統性的技術評比。Dunlosky 團隊 2013 年在 American Educator 刊出的回顧論文評了十種學習技術,拿到最高評級的是練習測驗與分散練習,理由包括跨年齡適用,練習測驗更同時增進記憶與理解。對照組同樣發人深省:許多學生依賴的劃線、重讀與考前衝刺屬於相對低效的技術,而且學生普遍相信這些低效技術最有效。評比的存在本身就是金字塔的反義詞:它不給排名式的單一數字,它給每個技術標註證據等級與適用條件。
這份評比的入圍條件也值得知道。作者群鎖定的是一般學生用紙筆、索引卡與行事曆就能執行的技術,需要特殊設備、許多學生無法取得的技術根本不在評比範圍裡。換句話說,拿到最高評級的兩個技術都能用簡單工具執行:練習測驗可用紙筆或索引卡,分散練習可用行事曆安排。這份評比討論的是一般學生能用簡單工具執行的策略,沒有比較改造整門課需要多少工時。課程創作者可以把自測與間隔複習當成兩項設計選項,再依學習目標決定如何放進教材。門檻低、證據厚,這種組合在學習建議的世界裡並不常見。
金字塔頂端那個 90% 呢?與『教別人 90%』相關、但研究對象不同的現象,是教學預期效應。Nestojko 團隊 2014 年刊於 Memory and Cognition 的兩個實驗設計得乾淨:受試者讀文章,一組被告知等一下要考試,一組被告知等一下要把文章教給另一位同學,實際上所有人到頭來都被考試,沒有任何人真的去教。結果抱著教學預期的那組,自由回憶更完整、組織更好,答對的題目更多,尤其是涵蓋文章主旨的題目。研究者給這個介入的評語很節制:簡單、低成本、有潛力提升學習效率。
行銷文案可以把假百分比換成有實驗設計可查的教學預期結果。原本寫「教別人可以記住 90%」,現在可以寫「研究顯示,光是抱著要教人的預期去讀,回憶就會更完整更有條理」。前者是一個查無來源的數字,隨時可能被較真的客戶當場戳破。後者是一個有作者、有期刊、有實驗設計可查的發現,經得起追問。誠實的版本在這場比較裡甚至更具體,因為它說得出機制:研究者推論,這群人讀的時候用了更有效的學習策略。
查證一個學習數字的三步
把前面的案例收攏,可以整理出一條可重複走的路,與寫作鐵律查證那套方法是同一個骨架,換到學習領域的用詞。三步的名字叫:往源頭追、看方法欄、比對每一手轉述。
第一步,往源頭追。看到「研究顯示」就問研究是哪一個,看到署名機構就問機構認不認。金字塔案例的示範在於,追到 NTL 這一站時得到的答案已經足夠宣判:源頭說數字不可考。若第二手轉述只剩『據說』或『有研究指出』,就要繼續追第一手研究,免責詞是來源鏈斷裂的先兆。
第二步,看方法欄。找到宣稱的研究後,別急著看結論,先看受測者是誰、怎麼分組、測驗在學習後多久執行。這一欄的檢查有兩個簡單的觸發器:數字全部能被 5 或 10 整除,先扣分。分類若沒有操作定義,例如未說明如何區分讀與看,就先要求原始方法。金字塔在兩個觸發器上全中。這一步的真正功能是分辨「有測量」與「有敘事」,研究與故事的分界就在方法欄。
第三步,比對每一手轉述。同一個主張,源頭說「據稱」,教材寫「研究顯示」,簡報再變成「科學證實」,歸因的確定度逐級上升,證據量卻沒有任何增加。金字塔的數十種排列組合是這一步的極端教材:數字會在轉述裡突變,突變方向由每一手的論證需要決定。比對到第一手就斷掉的宣稱,引用價值歸零。
三步的工具門檻比想像中低。教育與心理學領域的論文摘要,在 ERIC 與 PubMed 這類公開資料庫通常查得到,關鍵字加上 pyramid 或 retention 就能起手。找到論文名稱後,把標題放進搜尋引擎加 PDF,常能找到作者自存檔或期刊的公開版本。維基百科在這條路上是起點而非終點:條目頁面可以快速定位爭議輪廓,但引用時要順著它底下的參考文獻回到論文本身。這套流程能留下可供讀者核對的引用依據。

創作者的落地:課程與文案怎麼用
對知識變現工作者,查證的結論要能換成動作才算數。文案側的動作最簡單:全文搜尋自己產品頁與廣告素材裡的 90%、75%、5%,把它們換成上一段的真實發現。替換句型現成就有:「主動學習的研究」換掉「學習金字塔的研究」,「抱著教人的預期讀書,回憶更完整更有組織」換掉「教別人記住 90%」。改後文案可指向有方法的研究,讀者也能沿引用核對。
課程側的動作是把「做中學」的直覺翻譯成結構。測試效應的落地是每個單元配一組低門檻練習題,讓學員在看完影片後先回憶再對答案,而不是按下一支影片。把測驗做成互動體驗甚至名單工具的完整做法,測驗式互動行銷指南有現成的企劃框架。分散練習的落地是把複習排進行事曆與提醒系統。個人知識庫的建立與筆記組織,可以參考Obsidian 入門指南。
教學預期的落地更輕:在作業設計裡放「回講」任務。學員看完一個單元,錄一小段語音講給想像中的同學,或者到社群回覆另一個學員的問題。現有實驗支持的是讀書時預期要教對後續回憶的效果。回講任務可作為課程設計,實際回講的品質與監督需求仍不能由這項實驗判定。整門課的設計如果要系統性重看,線上課程製作流程從驗證到上架有完整的整理。
內部訓練場景適用同一套換法。企業講師若在簡報裡引用金字塔,應先交代這組百分比找不到原始研究。需要呈現教學效果時,可以改引有明確對象與方法的比較研究。內訓簡報可引用 Freeman 後設分析,呈現大學理工課程中主動學習與傳統授課的平均當掉率,分別是 21.8% 與 33.8%。
站內分工與下一步
查證方法之外,站上有幾份相鄰的指南可以接手。同一套三步用在寫作領域的完整案例,開頭提過的寫作鐵律查證,可供對照這套方法如何用於寫作主張。相關的素材調查程序,可接續閱讀動筆前的調查方法。查證與調查是同一種紀律的兩端,一端過濾你要引用的,一端整理你要使用的。
下一步很具體。挑一個你正在用的帶數字學習主張,走一遍往源頭追、看方法欄、比對每一手轉述。三步走完還活著的,你會用得更有底氣。走到一半斷鏈的,把版面換給有方法的實證。至於那座掛著百分比的金字塔,讓它留在迷思史的教材裡,它查過的案底,已經足夠豐富。







