杜聖聰:別急著吃AI的棉花糖
(圖/AI生成)
(圖/AI生成)
■ 二點六八萬名學生長期追蹤
三位經濟學者最近的一份研究,把用AI寫作業會不會讓學生變笨這個爭論,往前推進了一大步。
他們追蹤中國一個百萬人口縣、跨九個學科、涵蓋七年級到十二年級共26,811名學生,時間長達30個月,從2022年9月一路看到2025年6月,剛好橫跨ChatGPT出現前後的關鍵時間點。
研究設計採用雙重差分法,利用不同學生開始使用AI的時間差來做自然實驗,盡量排除單純的相關性干擾,讓數字比一般網路傳言更有份量。
■ 作業變漂亮考試成績卻退步
結果看起來很誘人。
學生用AI寫作業之後,作業分數平均提高18%,完成時間從64分鐘縮短到45分鐘,效率明顯上升,老師和家長看到成績單,第一反應大概都會很滿意。
但半年後的每月閉卷考,成績卻反過來下降20%,再拉長到高中和大學入學考試,差距擴大到18%到24%,而且要等將近兩年,這個懲罰才會完整顯現。作業變漂亮,考試卻變差,這個矛盾正是整篇研究最核心的發現。
■ 八成學生把作業全部外包了
研究者進一步拆解這群學生的行為,發現大約八成使用AI的學生,模式很接近把作業直接外包出去,完成時間異常短,分數卻異常高,這群人考試成績掉得最重。
剩下大約兩成的學生,即使用了AI,花的時間跟沒用AI的同學差不多,考試成績幾乎沒有惡化。
換句話說,真正造成傷害的,是省掉思考過程這個動作,AI本身只是工具,關鍵在使用的人怎麼用它。
■ 社會科目受傷程度最為嚴重
再往細部看,社會科受傷最深,其次是理科,語言科相對輕微,初中生比高中生嚴重,成績原本較好的學生比落後的學生受創更大,男生比女生嚴重。
研究者講得很直接,效率高不等於學得好,作業真正的目的,是要從裡面學到東西。這句話讀起來雲淡風輕,但放進台灣的補習班文化和考試制度裡,其實非常沉重。
■ 史丹佛棉花糖實驗告訴我們
看到這份研究,我想起心理學史上最有名的「棉花糖實驗」。
史丹佛大學的心理學家沃爾特.米歇爾,在1960年代末找來一群四歲左右的孩子,每人面前放一顆棉花糖,告訴他們可以馬上吃掉,也可以忍住15分鐘不吃,忍住的話就能多拿到一顆。
幾十年後的追蹤發現,當年能忍住不吃的孩子,長大後在學業表現、社交能力、情緒穩定上普遍比較好。
這個結果後來成為教育心理學裡談自制力最經典的例子,雖然近年也有學者重新檢驗,認為效果沒有原本想得那麼強,家庭背景可能才是真正的關鍵,但「延遲滿足」這個概念,至今仍被視為學習與成長裡很重要的一塊。
■ 延遲享樂才是真正的大贏家
把兩份研究放在一起看,會發現它們講的其實是同一件事。
急著吃眼前那顆棉花糖的孩子,換算到今天的教室裡,就是打開AI直接要答案,作業馬上變漂亮、時間馬上省下來,看起來立刻獲利。
忍住不吃、等待第二顆棉花糖的孩子,換算過來就是那兩成願意花時間自己想、把AI當工具使用的學生,他們眼前看不到明顯的效率優勢,但半年後的考卷、兩年後的入學考,才是那顆真正比較大的棉花糖。
學習這件事,本質上一直是一場延遲滿足的考驗,AI只是把這個考驗變得更誘人也更容易失守。
■ AI該陪你想別讓它幫你寫
我在課堂上這幾年一直觀察學生交出來的報告,經AI潤過的段落,句子確實漂亮很多,邏輯也順,但一問細節,常常接不上來。
這份研究把我一直隱約感覺到的現象,用扎實的數據講清楚了,AI拿來直接要答案,等於幫學生把思考這一步跳過去,短期看起來很有效率,長期卻在掏空理解力。如果把AI當成一個會回答問題、會提示思路、會挑錯的家教,自己還是要動腦把推理走一遍,效果可能完全不同。
所以真正該問的問題,其實是每次打開對話框的時候,我們是選擇馬上吃掉那顆棉花糖,還是願意再等一下,把第二顆也拿到手。這個選擇,可能比我們想的更早就決定了幾年後的成績。
資料來源:
David Strömberg、Victor Lei、Yanhui Wu(2026),《The Generative AI Learning Penalty: Evidence from Chinese Secondary Education》,CEPR Discussion Paper No. 21577。
https://www.facebook.com/share/p/1AmmJDm8FV/?mibextid=wwXIfr
Copyright © 2022~2026 好好聽文創傳媒股份有限公司 All Rights Reserved.