生成式 AI 究竟會讓人變聰明還是變笨?一份來自斯德哥爾摩大學與香港大學三位經濟學家、發表於《經濟學人》的最新長期追蹤研究給出震撼答案:在中國中部針對 2.7 萬名初高中生長達 30 個月的實證研究顯示,學生使用 AI 後作業分數平均提升了 18%、撰寫時間縮短 30%。
或許這樣看起來對成績的表現還不錯?不過,繼續往下觀察,到了閉卷考試時,這批學生的成績卻比完全不用 AI 的同學大幅下滑了 20%,相當於 1.4 個標準差的學習懲罰。
這項實證打破了過去「AI 工具能有效輔助學習」的樂觀迷思,揭示出「作業分數越高、真實考試跌得越慘」的嚴峻脫鉤現象。

30個月追蹤2.7萬名中學生,長期依賴AI後成績成線下跌趨勢

這份名為《生成式 AI 學習懲罰》(Generative AI Learning Penalty)的研究,樣本涵蓋人口逾百萬縣城的 5 所國中與 4 所高中,共計 26,811 名學生,覆蓋當地九成中學生群體,從 2022 年 9 月一路追蹤至 2025 年 6 月。
研究團隊透過線上作業提交系統精確記錄每位學生的解題耗時,並與全縣月考、升學考試資料庫對接,配合回收率超過 96% 的問卷,完整還原 AI 滲透軌跡。
數據顯示,學生使用 AI 的比例從 2022 年的近乎為零,一路飆升至 2025 年的 80%,其中兩次關鍵激增點分別精準落在 DeepSeek V2.5 與 R1 模型的發表期。
然而,隨之而來的學科衝擊極為顯著:社會科學領域成績跌幅達 27%,數學科下滑 22%,英文科下降 17%,國文科則下滑 9%。更值得注意的是,國中生受影響程度比高中生高出四成,且原本成績最頂尖的資優生在長期依賴 AI 後,考試退步幅度最為劇烈。

使用AI六個月後,沒有學生願意長時間自主思考作業
許多人主張「只要用法正確,將 AI 當作虛擬家教而非作弊工具就不會退步」。
研究最初確實發現,若學生將作業時間維持在 50 至 65 分鐘、僅把 AI 當引導工具,考試表現與不用 AI 者無異。然而,這種自律的「模範使用」狀態根本無法持久——剛接觸 AI 時僅 58% 學生選擇將思考外包,但使用滿 5 個月後,外包比例激增至 81%,完全外包率更達到 50%。
到了使用滿 6 個月後,全體 2.6 萬名樣本中,竟然沒有任何一位學生願意花超過 65 分鐘自主思考作業。AI 真正剝奪的,正是強度最高、最需要大腦建構邏輯的心智試錯歷程。
當作業秒拿滿分、家長點讚、系統反饋一片大好時,畸形的激勵機制便徹底摧毀了學生的深度思考習慣。

此外,麻省理工學院(MIT)媒體實驗室的腦電波實驗亦發現,依賴 ChatGPT 寫作的受試者神經連結強度最多衰退 55%,事後高達 83% 的人甚至無法複述自己文章中的任何一句話,陷入嚴重的「認知負債」。
微軟與卡內基美隆大學調查亦指出,工作者對 AI 越具信心,自我查核與邏輯檢驗的投入越少;METR 機構對資深軟體工程師的測試更顯示,多數開發者在脫離 AI 工具後已無法維持原有的工作水準。

AI 並未降低人類的先天智商,而是直接抽走了「讓大腦變聰明」的心智鍛鍊工序。當計算、推演與除錯等核心認知過程全數卸載給演算法,使用者表面上晉升為「審核把關者」,實質上卻失去了看穿黑箱錯誤的底層判斷力。學生的危機尚有每月閉卷考試作為照妖鏡,而職場成年人若失去這道警鐘,心智能力的退化恐怕將更為隱蔽且不可逆。
- 延伸閱讀:業界首款!趨勢科技推出 TrendLife Kaleida 全家 AI 防護:隱私、安全、學習三合一
- 延伸閱讀:Google 在 Gemini App 推出「學習筆記」功能,打造個人化 AI 學習輔導平台
- 延伸閱讀:AI 助攻還是自廢武功?Anthropic 研究顯示:過度依賴 AI 恐阻礙新技能學習
- 延伸閱讀:Google Translate 導入更多 Gemini AI 功能,強化學習與語境理解能力
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!