Skip to content

數位學習之外,紙筆還剩下什麼:三個實體仍然有效的地方,與一個沒有

2026年8月6日 1 分鐘
TL;DR 學習全面數位化之後,實體仍有明確效果的地方有三個:閱讀(紙勝螢幕 g ≈ −0.21,17 萬人樣本,需要捲動時擴大到 0.35–0.48)、作答時動筆(螢幕上題目越難反而越少用草稿紙)、畫圖(回憶率 45% 對比抄寫 20%)。反倒是最多人相信的「手寫筆記比較好記」,四份統合分析從 −0.008 到 +0.248 沒有共識。

🌏 English version

現在要學一件事,預設路徑幾乎都是數位的。線上課程、PDF、筆記 app、平板加觸控筆、間隔重複工具。整條鏈路不碰紙也跑得完。

那紙還有什麼用?

我本來以為答案大概是情懷成分居多。查完發現不是。實體真的還有效果,而且效果量比我想的大。只是不在多數人以為的地方。

下面三節是紙還贏得了的地方,證據由強到弱。第四節是唯一輸的那個,剛好也是最多人拿出來講的那個。

實體優勢最明確的地方:閱讀

統合分析規模效果量
Delgado et al. 201854 篇 / 171,055 人g = −0.21(紙優於螢幕)
Clinton 2019g = −0.25
Salmerón et al. 202449 篇(專看平板手機等手持裝置)g = −0.113 / −0.103
2025 network meta-analysis56 篇 / 4 種裝置排序:紙 > 平板 > 電子閱讀器 > 電腦 > 手機

十七萬人的樣本,四份統合分析方向一致。這塊沒什麼好吵的。

不過它有邊界。知道邊界,你才知道什麼時候值得印出來。

先講文本類型。Delgado 的資料裡,資訊性文本 g = −0.27,純敘事文本 g = .01,等於沒差。Clinton 也是同樣型態。所以小說看 Kindle 沒問題,教科書和論文才要小心。

再來是時間壓力。限時閱讀 g = −0.26,自己控制速度只有 −0.09。你在趕 deadline 或考試的時候讀,虧最多。

第三個可能才是重點。2025 那份 network meta-analysis 把捲動分開算:需要捲動的時候紙贏 g = 0.35–0.48,不用捲動只剩 0.03–0.12,等於沒差。

所以贏的可能不是紙,是分頁。分頁式 PDF 跟 E-ink 就很接近紙了,無限捲動的網頁差很多。這裡要提醒一下,Delgado 2018 的調節分析認為捲動不顯著,跟 2025 這篇衝突,而且 2025 這篇還沒有人複製過。

那差在哪?最有說服力的解釋不是眼睛累。是你在螢幕上會高估自己看懂了多少,高估之後就提早收工,不會回頭重讀。Clinton 受訪時就是這樣講的。這也解釋了為什麼限時會放大效果:時間一緊,最不會回頭的就是那些以為自己懂了的人。

還有一個滿反直覺的。Delgado 對 2000 到 2017 年做迴歸,發現紙的優勢是逐年變大的。如果原因真的是大家還不習慣數位,那應該越來越小才對。

第二個地方:作答時會不會動筆

Prisacari & Danielson (2017) 拿大學普通化學做過電腦版跟紙本版測驗的比較。成績沒差,主觀認知負荷也沒差。但學生在紙本測驗用草稿紙的比例明顯比較高,難題上更明顯。

Pengelley, Whipp & Rovis-Hermann (2023) 用 263 個西澳 9 年級學生做了重複量數的複製。結果分三層,引用的時候三層都得講。

第一層,難題上紙本成績顯著較高,紙本所有題目的認知負荷跟草稿紙使用也都比較高。第二層,把工作記憶容量控制掉之後,主效果全部不再顯著,只剩「模式 × 難度」的交互作用還在。第三層最有意思:紙本測驗題目越難、草稿紙用得越多,電腦測驗剛好相反,題目越難反而用得越少。

作者的結論是「these results contradict previous findings that computer-based testing can be implemented without consequence for all learners」。

翻成白話就是:把題目搬到螢幕上,學生會在最該動筆的時候不動筆。成績不一定馬上掉,掉的是解題過程。

所以紙在這裡的價值不是「寫比較好」,是它讓動筆便宜到你不會想省。

第三個地方:畫圖

Wammes et al. (2016) 跨 7 個實驗發現,把詞畫出來的回憶率大概 45%,只寫下來大概 20%。效果穩到作者直接稱它 reliable and robust。

這件事平板也做得到。差別在摩擦。

你在紙上要畫個箭頭、框一個重點、拉一條線把兩個概念連起來,成本是零。在多數筆記 app 裡,你得先切工具、選顏色、調粗細。差距很小,但小差距決定了你到底會不會真的畫。

唯一站不住的,是「手寫筆記比較好記」

這是最多人用來說服自己回去用紙的理由。也是四個裡面唯一沒有共識的。

統合分析規模效果量設計與數位干擾的關係
Allen et al. 202014 篇 / 3,075 人r = −.142(d ≈ 0.25)含自陳與調查型研究,未分離干擾
Flanigan et al. 202424 研究 / 3,005 人g = 0.248,95% CI [0.181, 0.315]僅實驗與準實驗,但不以干擾為納入條件
Lau 202233 篇 / 88 個效果量g = 0.144,95% CI [0.023, 0.265]實驗與準實驗,中學+大學
Voyer et al. 202236 篇 / 77 個效果量g = −0.008,95% CI [−0.18, 0.16]研究目的明寫 unconfounded by distractions

排序看起來很整齊。研究設計越是把書寫媒介跟數位干擾分開,效果量就越小,到 Voyer 那份直接歸零。

Voyer 團隊自己在摘要裡也是這樣解釋的:

an apparent advantage of longhand notetaking reported in some previous studies can be explained at least partially by distractions from notetaking by other applications that are present only with digital devices.

他們還寫了一句學術論文裡很少見的話:「We began this meta-analysis fully expecting to find evidence favoring the use of longhand notetaking… two of us who are instructors often suggested to students at the beginning of each semester that longhand…」本來預期會做出支持手寫的結果,做出來卻是零。

不過這條排序只能說跟干擾假說一致,不算證明。四份研究在族群、設計、結果變項、檢索年代上同時都不一樣,不是控制到只差一個變項。

源頭那篇 Mueller & Oppenheimer (2014) 的狀況也比一般轉述得糟。Urry et al. (2021) 做了 142 人的預註冊複製,原始研究只有 65 人。最招牌的概念應用題從 g = 0.34 變成 g = −0.13,方向整個翻過來,而且跟原始效果有顯著差異,t(139.03) = −2.78, p = .003。Morehead et al. (2019) 的複製更誇張,連完全不做筆記的那組都沒有顯著落後。

那有什麼是每次都成立的?有,就一個:打字的人字數比較多,跟講者的逐字重疊率比較高。Urry 複製出來的逐字重疊是 g = −0.85,原始 −0.93,兩者沒有顯著差異(p = .326)。這項乾淨地複製了。

這對「該不該用紙」其實不是壞消息,只是換個理由。問題大概不在手的動作,在打字太順,順到你會不知不覺變成在轉錄。紙做的事是把輸入頻寬壓下來,逼你選。

拿「手寫會刻進腦子裡」去說服自己,反而是站在最弱的那塊地上。

那個腦波研究撐不起大家的解讀

2024 年被轉爛的 Van der Weel & Van der Meer 高密度 EEG 研究,發現手寫的時候 theta 跟 alpha 頻段的腦區連結性明顯高於打字。很多人把它轉述成「科學證明手寫比較好學」。

去看方法段會發現三件事。所謂「手寫」是拿數位筆寫在觸控螢幕上,不是紙。打字條件是右手食指單指輸入。每個 trial 25 秒,只錄前 5 秒 EEG,而且整篇沒有任何記憶或學習測驗。

它能支持的是「用筆的動作比按鍵複雜」。撐不起「手寫讓你考得比較好」,更撐不起「紙優於螢幕」——它的手寫條件本身就在螢幕上。

六種混合模式

Han et al. (2021) 在 DIS 給過正式定義:hybrid paper-digital interface 指「任何把數位或電子功能嵌入實體紙、使紙可作為輸入或輸出裝置的介面」。下面六種是我自己整理的,不是引用他們的分類。

模式做法代表工具主要摩擦
1 紙進數位出紙上寫 → 掃描 OCR → 進筆記庫Rocketbook、Mathpix同步稅、OCR 看字跡
2 數位出題、紙上作答app 排程出題,紙上推導Anki + 紙、Skritter 出詞紙上默寫app 拿不到你寫錯什麼
3 數位素材、紙上加工影片 PDF 在螢幕,畫圖筆記在紙康乃爾筆記、sketchnote幾乎沒有
4 紙當介面紙是控制器不是筆記Plickers只適合教室
5 疊合即時同步寫的當下就同步Anoto 點陣紙、SpARklingPaper硬體摩擦致命
6 類紙數位保留手寫、放棄實體紙reMarkable / Supernote / BOOX裝置成本

模式 2 我覺得被低估得最厲害,而且它有直接證據撐著。它做的事就是把螢幕悄悄關掉的動筆行為放回去。不用掃描,所以沒有同步成本。

模式 3 靠的是前面講的畫圖效果,紙的價值就是摩擦低到可以忽略。

模式 4 在資源不夠的教室特別好用。Plickers 讓學生拿印好的 QR 卡,把要選的那個答案朝上舉起來,老師拿手機掃全班就好。等於把「每人一台裝置」壓成「每人一張紙」。

模式 5 在實驗室裡最漂亮,實務上最容易死。Stanford HCI 有一份做了兩年的課堂研究,18 個學生裡 8 個放棄了 Anoto 數位筆。理由不是軟體不好用,是筆太笨重、每天要充電。硬體的摩擦把軟體的好處全部蓋掉。

裝置與現成方案:reMarkable、Supernote、BOOX 與台日兩地的商業版

E-ink 手寫平板在這個分析裡要往上調一級。它一次買到兩件有證據的事:沒有 app store,還有分頁翻頁。下面是 2026-08-05 各家官網價。

裝置價格螢幕
reMarkable Paper Purefrom $39910.3" 黑白 226 PPI,360 g
reMarkable Paper Pro Movefrom $4497.3" 彩色 264 PPI,230 g
reMarkable Paper Profrom $62911.8" 彩色 229 PPI,525 g
Supernote Nomadfrom $3297.8"另購 $65 起
Supernote Manta$50510.7"另購 $65 起
BOOX Go Color 7 (Gen II)$289.997" 彩色另購 $45.99 起
BOOX Note Air5 C$529.9910.3" Kaleido 3,Android 15另購 $45.99 起

比價的時候最容易漏掉筆。reMarkable 三款都含 Marker,Supernote 跟 BOOX 都要另外加 $46 到 100。另外 reMarkable Connect 訂閱是 $3.99/月(50 天試用),不少比較站寫成 $2.99,以官網為準。

台灣現成的數位那半邊,是因材網(教育部,做知識結構診斷)跟均一教育平台(39,000+ 影片、91,000+ 習題)。均一自己的案例庫就收了〈用差異化、紙本與數位結合幫助每個孩子成功〉這種教師訪談,現場的做法本來就是混的。

日本兩大通信教育剛好是兩條路線的商業對照。進研ゼミ小学講座讓家長在〈チャレンジタッチ〉(平板為主,但本身就含一部分紙教材)跟〈チャレンジ〉(紙本為主)之間選,兩邊共用「赤ペン先生」人工批改。小 4 年繳分別是 68,400 円跟 70,400 円——紙本那邊反而比較貴。它另外有一份紙本題本〈テスト100点問題集〉,一年只寄 2 次,官方講明用途是「学校と同じように鉛筆で書く実践練習」。這就是模式 2 的商業版。

スマイルゼミ走的是純平板、完全沒有紙,月額 3,630 円起加平板 10,978 円。有意思的是它的賣點之一:「アプリやゲームができないから誘惑がなく集中できる」。一個純數位產品把「沒有干擾」當主打,剛好跟 Voyer 的假說收在同一點上。

反過來,進研ゼミ 也講了紙做不到的事:「書き順を判定できるのはデジタルならでは」。筆順跟とめ・はね的即時判定,確實只有數位做得到。

怎麼開始

最省事的組合是模式 2 加模式 3,而且不要掃描。app 只管排程跟出題,紙管推導跟畫圖。沒有同步成本、沒有裝置成本,有證據的好處大致都留著,已知會失敗的地方也都避開了。

如果你只打算改一件事,那件事不是換筆。是把要精讀的長文從捲動式螢幕搬到紙、或搬到分頁式 E-ink。這是整片文獻裡樣本最大、效果量也最大的一條。

願意花錢的話,買一台沒有 app store 的 E-ink 平板。

真正會決定你的方案能不能活下來的,只有三件事。

第一,同步是手動還是自動。手動代表每天多一件事,通常三週後就放棄了。第二,紙是資產還是消耗品,這決定你要不要 OCR。第三,哪一邊是唯一真相來源。兩邊都是的話,東西永遠找不到。

這篇的限制

有幾個地方是真的沒定論,寫出來比藏起來好。

「複習會放大還是抹平手寫優勢」這題無解,而且是兩邊都太脆弱。Lau 的多變量模型顯示複習把優勢從 g ≈ +0.47 壓到 +0.05(Review 係數 −0.414, p = .009),但同一個變項在單變量模型不顯著(p = .091),而且只用到 33 篇裡的 14 篇。Lau 自己都寫「it is possible that it is simply an artifact」。Flanigan 的結論剛好相反,有複習 g = 0.421、沒複習 0.208,但那格只有 9 個效果量。

手寫優勢是不是集中在概念題,也沒定論。Flanigan 的資料裡概念題最小(0.199),Urry 的資料裡概念題最大(0.14)。方向相反,而且兩邊都不顯著。

捲動那條在我的建議裡權重最高,但它只有一份研究,還沒被複製過,而且跟 Delgado 2018 的調節分析衝突。

最根本的問題來自 Lau 的方法論批評。他把它叫做 fundamental problem of modality research:你把受試者隨機分派到某個書寫媒介的時候,也間接把他分派到一種書寫風格,兩者拆不開。而 33 篇裡只有 2 篇把書寫風格當實驗因子操弄,transcription capacity「as far as I can tell has never been controlled for in a note-taking study」。

講白一點,這整片文獻可能一直以為自己在測媒介,其實測到的是媒介誘發的行為。

他對外部效度的判詞也值得原文引用:

while the effect size observed in this systematic review and meta-analysis is probably true, we do not know much about how these findings, based on a set of narrowly designed studies, will translate into a more practical context.

多數研究長這樣:一支 10 到 15 分鐘、陌生內容的影片講座,作者自編的短測驗,立刻考或最多一週後考。沒有任何一份是「用某套混合系統學一學期」。

所以這篇的所有建議,都是從短期實驗推論出來的組合,不是被直接測過的方案。

參考資料