經濟合作暨發展組織 OECD 史上最大規模的 PISA 測驗顯示,每天用 AI 寫作業的學生成績比不用的學生低 28 分,但每週用一次的學生表現反而最好。
(前情提要:紐約宣布 60 萬高中以下學生禁止使用 AI 一年:培養獨立思考與社交能力)
(背景補充:洛杉磯突禁止 37 萬學生 AI,學區董事會事前不知情)
這是用 76 萬名學生換來的數字:從不或幾乎不用 AI 寫作業的學生,科學測驗拿下 509 分;每天或幾乎每天用 AI 的學生,僅有 481 分,差距 28 分,相當於一年半的教學量。
史上最大的一次測驗
OECD 在 9 月 8 日發布《PISA 2025 測驗結果》,這是生成式 AI 普及之後,第一次進行的 PISA 測驗,樣本涵蓋 91 個國家與經濟體、超過 76 萬名 15 歲學生,範圍橫跨科學、數學、閱讀三個領域,是 PISA 有史以來規模最大的一次。
寫作文打草稿這件事上,從不或幾乎不用 AI 的學生拿下 509 分,每天或幾乎每天用 AI 的學生僅有 481 分,經過社經地位調整後,差距是 28 分,相當於一年半的教學量。攤開全部用途平均計算,AI 用戶與非用戶的科學成績差距約 20 分,等於一年的學習量。
台灣在這次測驗名列前茅,與新加坡、中國多個省市、愛沙尼亞、日本、韓國、澳門、英國並列頂尖群組。但 OECD 也提出警訊:2015 年到 2025 年這十年間,PISA 閱讀成績下滑 28 分,數學下滑 22 分,低表現學生的比例從 16% 升到 20%,這條下滑曲線在 AI 普及後並沒有停下來。
問題不在 AI,在卡關
為什麼會這樣?OECD 教育與技能主管史萊賀給出的解釋很直白:看運動比賽不會讓人變健康,要靠自己下場運動才行。學習也一樣,不是發生在消費內容的那一刻,而是發生在大腦與新教材角力的過程裡。
這個過程有個名字,叫認知外包(cognitive offloading)。簡單來說就是,學生把困難的任務丟給 AI 處理,自己不再想辦法。寫作文卡住的那五分鐘、讀完一段文章要自己歸納重點的那個瞬間,正是學習真正發生的地方。
AI 把這段卡關直接抽掉,作業準時交出去了,但腦子沒有經歷那場角力,什麼都沒留下。
史萊賀主張,AI 應該扮演鷹架而非柺杖。簡單來說就是,鷹架是幫學生搭起來、讓他能靠自己爬到更高的地方;柺杖則是讓人不用練走路,直接被抬著走。科技若能引發或強化這場認知掙扎,學生會進步;科技若是直接繞過這個階段,代價就是那 28 分。
這也解釋了為什麼分數差距集中在打草稿、做摘要這類原本最需要自己動腦的任務上,AI 接手的正是學習裡最費力、也最有價值的那一段。真正被抽走的不是分數,是那段本該屬於學生自己的思考過程。
適量是解方,過量是代價
但這組數字不是一面倒。在用 AI 幫助我學習這項用途上,每週用一次的學生表現最好,成績約 500 分,同時勝過從不使用與每天使用的兩端,呈現一條倒 U 型曲線:適量有效,過量有害,用一次跟用上癮,是兩回事。
另一個數字更值得注意:每天使用 AI 的學生裡,如果課堂上定期受過如何評估 AI 生成資訊的訓練,科學成績會回升 13 分,超過半年的教學量。換句話說,問題不是 AI 本身,是用的人有沒有被教過怎麼判斷 AI 給的答案能不能信。
目前 OECD 國家有 46% 的學生每週至少用一次 AI 聊天機器人,但全球每天使用的比例仍低於 20%,各國差異極大:日本約 40% 的學生從不或幾乎不用,越南僅約 4%。這個落差,決定了各國接下來要做的選擇:是直接禁止,還是花時間教會學生怎麼用,兩條路現在各國都在同時試。
📍相關報導📍
MIT 校長:有了 AI 還要唸大學嗎?高等教育的歷史大斷點

