01
老師是最大的變數,所以 AI 對老師負責。
英國教育基金會(EEF)2025 年的語言學習快速證據評估,把教學者的專業排在任何課程或工具之上。我們把它當成設計限制,而不是恭維。老師審閱每一份生成的練習才會發布,可以加上指示引導生成器,也會在家長看到之前先為一對一報告加註。系統承擔勞力——生成十五種練習類型、批改開放式作答、在音素層級評分發音——判斷留給人。
EEF,語言學習快速證據評估,2025
教學法先行。這一頁說明證據怎麼說,以及我們據此做了什麼。

Language Boss 不是一個對準英語的通用 AI 產品。它的每一個部分,都在回應一項關於第二語言如何被學會的具體發現——從課堂中最關鍵的因素是什麼,到一個字在初次接觸後能存活多久。以下是推理過程,附上出處。
01
英國教育基金會(EEF)2025 年的語言學習快速證據評估,把教學者的專業排在任何課程或工具之上。我們把它當成設計限制,而不是恭維。老師審閱每一份生成的練習才會發布,可以加上指示引導生成器,也會在家長看到之前先為一對一報告加註。系統承擔勞力——生成十五種練習類型、批改開放式作答、在音素層級評分發音——判斷留給人。
EEF,語言學習快速證據評估,2025
02
同一份評估指出,高投入負荷的取徑——豐富、真實、能引發投入的輸入——勝過死記與脫離語境的文法練習。因此練習取自班級自己的對話、段落與單字,而不是通用題庫;後段的階段要求學生產出語言,而不是選出語言。看圖描述要他用目標句型描述場景,語音對話則把他放進沒有腳本的談話裡。
EEF,語言學習快速證據評估,2025
03
每個概念都會走過四個認知階段,改編自 Bloom 分類法並調整為第二語言習得的脈絡。一組練習會帶學生在同一個文法點上走完四階,而這正是「考試時認得出」與「對話時用得出來」之間的差別。
辨識
學生能認出這個概念嗎?
引導產出
在支援下他能使用它嗎?
限制式創作
他能在有結構的情境中運用它嗎?
自由創作
他能獨立使用它嗎?
Bloom 分類法(1956),為第二語言習得改編
04
單字與文法依 SM-2 排程演算法回來。與一般字卡 App 的差別在於輸入:不是二元的對錯,而是學生把這個字說出來解釋,AI 評估準確度、清晰度與舉例品質,反應太慢還會扣分。接下來的間隔反映的是掌握程度,不是猜對與否。系統也會追蹤先前的答案,所以重複自己並不會換來更長的間隔。
P. Woźniak,SuperMemo SM-2 演算法,1990
05
語音在音素層級評估準確度、流暢度與完整度,對照學生自選的美式、英式或澳式英語。口型圖示範沒發好的音該怎麼形成,雙語系評估會結合一種以上口音模型的音素資料,而且每一次評估都保留下來——所以一學期的發音趨勢是一張圖表,不是一個印象。
透過 Azure Cognitive Services 進行音素層級評估
06
每一次 AI 呼叫都帶著一份脈絡側寫:程度、繳交紀錄、一對一分析、老師觀察、字卡記憶保留、班級進度與他說過的興趣。A1 與 B2 回答同一份練習,評分方式不同。老師註記「連接詞偏弱」的學生,會拿到針對連接詞的練習。這不是把「適性學習」當成打勾項目,而是要補上二十人班級不可能給的個別關注。
學生脈絡引擎,套用於生成與批改
語言學習快速證據評估:教學者的專業是最重要的因素;高投入負荷的意義導向取徑最有效;包含遊戲的多感官學習不可或缺。
Education Endowment Foundation,2025
SM-2,現代複習排程背後的間隔演算法,並以 AI 評定的複習品質取代二元計分。
P. Woźniak,SuperMemo,1990
從辨識到自由創作的四階段歷程,改編自 Bloom 分類法並調整為第二語言習得。
Bloom 等人,1956
主要是 Education Endowment Foundation 2025 年的語言學習快速證據評估,它指出教學者的專業是最重要的因素、高投入負荷的意義導向取徑最有效,以及包含遊戲的多感官學習不可或缺。每一項發現都對應到一個具體的設計決定,本頁逐一說明。
在音素層級,分別評估準確度、流暢度與完整度,對照學生自選的美式、英式或澳式英語。口型圖示範沒發好的音該怎麼形成,而且每一次評估都保留下來,讓一學期的趨勢看得見。
差在輸入。不是二元的對或錯,而是由學生解釋這個字,AI 評估準確度、清晰度與舉例品質,反應太慢還會扣分。這個品質分數驅動 SM-2 的間隔,所以排程反映的是理解深度,而不是點對了一次。