口試因防 AI 作弊而復興,但把它當試金石會製造新的不公平
2026/08/19
書面作業無法驗證作者身分,於是口試回來了。而學者提出的提醒是:口試是好的評量工具,但它不是好的測謊工具。
先說它的價值。口試最強的地方在於即時性與可追問——教師能就學生的答案繼續往下問,而理解與背誦的差別在追問三層之後幾乎無所遁形。它也能揭露書面成品掩蓋的東西:一個學生交出了完美的分析,但說不出為什麼選這個方法,這個落差在紙面上看不到。
問題出在把它當成「證明你沒用 AI」的關卡。這個定位會產生幾種副作用。
其一是能力混淆。口試同時測量了學科理解與口語表達能力,而後者的個別差異極大且與學科能力無關。內向、口吃、有社交焦慮或使用非母語的學生,在同樣的理解程度下會表現得明顯較差——而在防弊定位下,這種表現落差容易被解讀成「他大概是用 AI 寫的」。
其二是壓力效應。當口試的隱含前提是「證明自己清白」,學生進場時的心理狀態與一般評量完全不同。焦慮會實質損害提取記憶的能力,形成惡性循環:越是緊張越答不出來,越答不出來越像有問題。
其三是實務成本。逐一口試在大班制課程中的時間成本極高,而為了控制時間縮短每人的口試長度,又會削弱它最有價值的追問深度。
較合理的定位是把口試放回評量本身:不是用來檢驗誠信,而是用來測量書面形式測不到的能力——即時推理、面對追問的調整、對自己論點的掌握程度。同時提供必要的調整:給予準備時間、提前公布提問方向、對有需求的學生提供替代形式。
這也呼應了近期關於 AI 時代評量設計的討論——有效的方向是設計出能顯露真實思考的作業,而非把每種形式都改造成防弊工具。當防弊成為主要動機,評量的教育功能通常是第一個被犧牲的。
對台灣的高教與技職現場而言,口試本就是常見的評量形式。真正該檢視的是它被賦予了什麼任務——若只是為了確認學生沒用 AI,投入的成本很可能換不到相應的效果。