第 4 課模組一:提示工程基本功 13 分鐘· 程度: 進階

思維鏈與分步指令:讓 AI 先想清楚才作答

應用題算錯、長任務做一半就散掉,多數不是模型不夠強,而是你讓它太早下結論。本課示範用分步指令、自我檢查與任務拆解三種做法穩住輸出。

Read in English

一句話答案:AI 答錯應用題,多數不是因為它不懂,而是因為你讓它在第一個字就開始寫答案。叫它先把步驟寫出來,錯誤率與可檢查性會同時改善。

一條中三數學題,兩種問法

一位中三數學老師在校對自己出的測驗卷,想確認答案。她問:

一件貨品原價 480 元,先加價兩成,再減價兩成,最後售價是多少?答案是?

AI 回:「480 元,因為加兩成再減兩成會抵銷。」——這是典型的直覺陷阱,答案錯了(正確是 460.8 元)。老師如果趕時間,就把錯答案印進了答案紙。

換一個問法:

你是香港中學數學科教師的校對助手。
任務:計算下面這條題目的答案,用於中三測驗卷的答案紙。
題目:一件貨品原價 480 元,先加價兩成,再減價兩成,最後售價是多少?
輸出格式:先逐步列出計算過程,每步一行並註明該步在做甚麼;算完之後另起一段,用一句話說明學生最容易在哪一步出錯;最後一行才寫「最終答案」。
限制:不要在列出步驟之前給出答案;如果你發現題目本身有歧義(例如「減價兩成」的基數不明確),先指出歧義並標示「待教師核實」,不要自行假設。

這次的輸出會逐步做:480 × 1.2 = 576,576 × 0.8 = 460.8,並且指出學生最常見的迷思正是「以為兩成抵銷」——這一句直接可以寫進教案的迷思概念欄。

原理

模型是逐字生成文字的。如果它的第一個字就是答案,那個答案是在幾乎沒有運算的情況下產生的,靠的是「這類題目看起來像甚麼答案」。當你要求它先寫步驟,每一步都成為下一步的上下文,運算就真的在文字裏發生了。

打個比方:你叫一個學生「心算」,他會憑感覺說一個數;你叫他「把算式寫出來」,他寫的過程本身會迫使他慢下來,而且你能看見他錯在哪一步。分別不在於學生變聰明,而在於思考被外化了。

新一代的推理型模型已經在內部做這件事,不必你提醒。但在教學場景,把步驟寫出來仍然有兩個不可替代的價值:步驟本身就是教材,以及教師要看得見推理才敢用。想了解推理型模型的機制,見 LLM 教室

範本一:先步驟,後結論

適用於任何需要驗算或需要展示過程的科目。

你是香港中學[科目]教師的校對助手。
任務:解答下面的題目,並產出一份可以給學生看的解題示範。
脈絡:[年級],本單元學習重點是[重點],學生已學[先備知識],尚未學[未學內容]。
輸出格式:三個部分——(一)逐步解法,每步一行並註明該步的數學依據或概念;(二)一句話指出學生最常在哪一步出錯及原因;(三)最終答案,單獨一行。
限制:必須在第(一)部分完成之後才給出答案;只可使用學生已學的方法;若題目本身有歧義或數據不足,先指出並標示「待教師核實」,不要自行補上假設。

題目:[貼上題目]

範本二:換一個角色檢查

第二回合是提升準確度最划算的一步。把第一回合的輸出貼進新一輪對話,並且不要說那是 AI 寫的。

你是香港中學[科目]科的資深評卷員。
任務:按下面的評分準則,逐項檢查這份解答是否正確與完整。
脈絡:這是[年級][單元]的測驗答案紙草稿,將派給學生,所以準確度比流暢度重要。
評分準則:[貼上準則,或列出每步應得的分數]
輸出格式:表格三欄——步驟編號、判斷(正確 / 有誤 / 表述不清)、如有問題請說明問題在哪。表格之後用三句以內總結整份答案是否可以派發。
限制:逐項檢查,不要整體評論;如果某一步你無法確定對錯,標示「待教師核實」而不要猜;不要重寫整份答案,只指出問題所在。

解答:[貼上第一回合的輸出]

範本三:把長任務拆成四步

小五常識科要規劃一個六節課的探究單元。一句話要求全部,結果必然是每項都很淺。

你是香港小學常識科教師的單元規劃助手。我們會分四步完成,現在只做第一步,做完等我確認才繼續。
任務(第一步):為小五「香港的廢物處理」六節課探究單元,設計整體架構。
脈絡:每節 35 分鐘,全班 30 人,將分六組。學習重點是「比較不同廢物處理方法的成本與影響」,並在第六節作小組匯報。
輸出格式:表格六行對應六節課,四欄——節次、本節聚焦問題、學生活動、產出。表格之後用三點說明六節之間的遞進邏輯。
限制:每節只可有一個聚焦問題;不要現在就寫工作紙或評分準則,那是第三步與第四步;涉及具體回收數據或政策細節的地方,標示「待教師核實」讓教師按最新資料填寫。

第二步要簡報大綱,第三步要工作紙,第四步要評分準則,每一步都以上一步的產出為脈絡。這個流程在 第 6 課:備課提示 會完整示範。

常見錯誤

  • 在同一句話裏又要步驟又要簡短。 「一步一步解釋,但請簡短」互相矛盾,模型會選擇簡短,你就失去了步驟。想要短,在步驟做完之後另外要求一句總結。
  • 用「你確定嗎」來檢查。 這句話最常見的效果是模型改掉一個本來正確的答案去迎合你。要檢查就換角色、給準則、要求逐項。
  • 拆任務但不帶脈絡。 分四次問卻每次重開新對話,第三步的工作紙就會與第一步的架構對不上。同一個對話串內接續,或者把上一步的產出貼進去。
  • 把思維鏈直接印給學生。 模型寫的步驟往往包含它的自我修正與冗語。要當教材用,必須多加一句格式要求:「用學生看得懂的語氣重寫這份解法,每步不超過兩句。」

進階變化

  • 換科目:中國語文科可用於拆解文言文句子——「先逐字解釋,再逐句語譯,最後才說全段大意」;通識與公民科可用於論證——「先列出正反雙方各三個論點及其理據,再評估哪一方較強並說明準則」。
  • 換年級:小學生看的步驟要更短。在限制一行加「每步一句,不超過 15 字,並在每步前加編號與方格」。
  • SEN 調適:對專注力不足或執行功能較弱的學生,步驟拆解本身就是最有效的調適。要求輸出「每步一個指令、每步附一個完成指標(學生怎樣知道自己做完了這一步)」。
  • 當作診斷工具:把學生的錯誤答案貼進去,要求「指出學生是在哪一步開始偏離,並推斷他的迷思概念是甚麼」,但同時限制「不要代學生重寫答案」。這一招在 第 9 課 會再展開。

下一課把這幾課的做法固定下來,變成全校可以共用的預設:第 5 課:系統提示與校本角色設定

本課重點

  • 要求模型先列步驟再給結論,等於逼它把推理寫出來,錯在哪一步教師一眼看得到。
  • 分兩回合做同一件事最有效:第一回合作答,第二回合換一個角色檢查自己的答案。
  • 複雜的備課任務要拆成三至四個獨立提示,每個提示的產出成為下一個的輸入,不要一句話要求全部。
  • 新一代推理型模型會自行思考,所以價值由「令它想得對」轉為「令步驟看得見,可以當教材用」。

常見問題

對純粹求對答案而言,新一代推理模型多數不需要。但教學用途仍然需要,因為你要的不只是答案,而是可以展示給學生看的步驟,以及可以讓你檢查的推理過程。

關鍵在於換角色。用同一個身分問「你對嗎」多數得到「對」;改為「你現在是評卷員,請按評分準則逐項檢查下面這份答案」,並且不提示那是它自己寫的,挑出的問題會實在得多。

表面上是,實際上省時。一次過要求四項產出,通常要來回修改五六次;拆成四次,每次一改即中,總時間更短,而且中途發現方向不對可以及早轉向。

訂閱教育 AI 通訊

每月一封:給香港學校的 AI 教學實戰文章、平台更新與撥款資訊。隨時可取消。

我們只會用此電郵寄送通訊,不會分享給第三方。