xAI Grok(4.6 / 4.3 / Grok Build):性價比不錯,但學生場景要先做內容安全評估
xAI 現行旗艦 Grok 4.6 於 2026 年 8 月 12 日推出,50 萬 token 上下文、每 100 萬 token 2 / 6 美元,並新增 xhigh 推理級別。本頁整理 Grok 4.6、4.5、4.3 與 Grok Build 的分工,說明超過 20 萬 token 的加倍計價陷阱,以及為甚麼香港學校在學生場景使用前應先評估它與 X 平台內容的關係。
非原生供應商,可透過 Poe 呼叫。Grok 與 X 平台內容緊密結合,學校在學生場景使用前應先自行評估內容安全政策。
一句話答案:Grok 4.6 的價錢只有 OpenAI 旗艦的五分之一,長上下文與推理能力足以應付學校工作;但它在 Edor.ai 只能經 Poe 呼叫,而它與 X 平台內容的緊密結合,使它成為四家美國供應商中最需要學校先做內容安全評估的一家。
這是甚麼:一家後來居上的供應商
xAI 由 Elon Musk 於 2023 年創立,是四家主要美國供應商中最年輕的一家。它的第一個引起業界注意的版本是 2025 年 7 月的 Grok 4,自此以大約每季一次的節奏迭代,到 2026 年已經在前沿模型的討論中站穩位置。
它與其他三家最明顯的分別有兩點。第一是定價策略:同級能力之下,xAI 的牌價一貫比 OpenAI 與 Anthropic 低一截,2 / 6 美元大約是 GPT-6 Astra 的五分之一。第二是產品定位:Grok 與 X 平台深度整合,官方提供 X 搜尋作為工具,回應風格亦一向強調較少的限制。
第二點正是學校必須先處理的地方。對開發者而言,較少限制意味着更靈活;對一所要向家長交代的學校而言,它意味着需要額外的評估工序。這不是要勸退,而是要把次序講清楚:先評估、後開通,而不是先開通、後觀察。
現行陣容:三檔通用型號加兩個專用型號
Grok 4.6 是現行旗艦,2026 年 8 月 12 日推出,50 萬 token 上下文,定價每 100 萬 token 輸入 2 美元、輸出 6 美元。它新增了 xhigh 推理級別,即在 low、medium、high 之上再多一檔,讓需要長鏈推理的任務可以要求模型想得更久。這裡有一個與 OpenAI 相同的成本陷阱:請求一旦達到 20 萬 token,整筆按 4 / 12 美元計算。官方文件亦註明 Grok 4.6 的知識截止日期為 2026 年 2 月 1 日,不啟用搜尋工具時它並不知道之後發生的事。
Grok 4.5(2026 年 7 月)是 4.6 的直接前身,同為 50 萬 token 上下文與 2 / 6 美元。Grok 4.3(2026 年 5 月)則是上下文最長、成本最低的一檔:100 萬 token、1.25 / 2.50 美元,對純粹的長文件整理反而更划算。
另外兩個是專用型號。grok-build-0.1(2026 年 6 月)是 Grok Build 編碼代理的預設型號,26 萬 token 上下文、1 / 2 美元,資訊科技科教編程時可作參考。grok-voice-think-fast-2.0(2026 年 8 月)是語音對語音型號,但如下文所述,平台目前接觸不到它。完整的版本、日期與價格對照,見本頁下方自動生成的系列表。
優點:對學校而言最實際的四點
- 同級能力下價錢明顯較低。2 / 6 美元讓「大量批改、大量出題」這類工作在成本上可行,不必為了省錢而降級到能力不足的小型號。
- 上下文分檔實用。需要最強推理時用 4.6 的 50 萬 token,單純要塞進大量文件時改用 4.3 的 100 萬 token 且更便宜,這個分工比一味升級旗艦有效。
- 推理級別可調到 xhigh。批改需要逐點論證的通識或歷史答題時,把推理級別調高換取更完整的理據,是一個實際可用的旋鈕。
- 文件透明。xAI 的定價頁把長上下文加倍規則、工具呼叫收費、批量折扣都逐項列明,IT 主任要做成本估算時有清楚依據。
缺點與局限:必須先說清楚的部分
- 內容安全需要學校自行評估。這是最重要的一點。Grok 的回應風格與 X 平台內容的整合,與香港學校對未成年學生的期望之間存在落差。學校應在使用前完成評估並留下書面紀錄,而不是事後補做。
- 在本平台不是原生供應商。只能經 Poe 呼叫,請求會經過多一個第三方,私隱評估要把 Poe 一併納入,學校亦無法直接管理 xAI 的帳戶條款。
- 超過 20 萬 token 整筆加倍。50 萬 token 的上下文看似寬裕,但真的用到 20 萬以上時成本會跳一級。把整個學期的教材一次貼進去並不划算,正確做法是用 RAG 只取相關段落。
- 語音模型接觸不到。xAI 有語音對語音型號,但經 Poe 只能拿到聊天型號,口語練習仍要靠 OpenAI 或 Azure OpenAI。同樣地,校本知識庫需要的 embedding 模型也不在這條路線上。
- 中文教育場景的實測較少。相對於 OpenAI 與 Claude,Grok 在香港課程用語、繁體中文寫作回饋上的公開實測資料少得多。學校若要用於中文科,建議先自行做小規模對照測試再決定。
適用場景
教師:大量出題、英文寫作回饋、需要長鏈論證的批改(例如公民與社會發展科的資料回應題)、以及長文件的比對整理。因為單價低,這些「量大」的工作最能發揮它的成本優勢。
學生:我們的建議是先不要。在完成內容安全評估並取得學校管理層書面同意之前,學生對話應維持在已評估過的供應商上。若學校完成評估後決定開通,務必保留平台的四層守門與教師監控,並把導師模式的提示層級上限調得比預設更保守。
IT 主任:成本估算時不要只看 2 / 6 美元。實際要計的是 Poe 的方案費用、20 萬 token 門檻後的加倍計價,以及工具呼叫(例如網頁搜尋)的另行收費。另外請把內容安全評估寫成一份可存檔的文件,這在日後的家長查詢或校外評核時會用得上。
教育場景實測提示
以下提示可直接複製到 Edor.ai 的教師工具或任何 Grok 介面試用。留意「限制」那幾句,它才是讓輸出可用的關鍵:
你是香港中學公民與社會發展科教師。以下是一位中四學生就「香港的人口老化」資料回應題所寫的答案。
輸出:先指出答案中哪些論點有資料支持、哪些只是斷言;再按「理解資料」、「論證」、「表達」三項各給 1 至 5 分並各寫兩句評語;最後給三個改善方向。
限制:用繁體中文(香港用語);不要代學生補寫論點;不要引入題目資料以外的統計數字;若你想引用任何數據而不確定其出處,請寫「請教師核實」。
[貼上題目資料與學生答案]
你是香港小學英文科教師。請為小四學生設計一份 20 分鐘的閱讀理解工作紙,主題是「一位社區清潔工人的一天」。
輸出:一篇約 180 字的短文、五條理解題(兩條直接檢索、兩條推論、一條個人回應)、一份教師用的評改要點。
限制:用香港學校常用的英文書寫規範;短文詞彙控制在小四程度;不要出現需要學生查字典才明白的專有名詞;若你不確定某個香港職業或部門的正式英文名稱,請寫「請教師核實」而不要自行創作。
在 Edor.ai 的可用性
xAI 不是 Edor.ai 的原生供應商。平台原生支援的五條路線是 OpenAI、Azure OpenAI、Anthropic、Poe 與本地 Ollama,所以學校要在平台內用 Grok,唯一路線是經 Poe 供應商呼叫。管理員在後台填入 Poe 金鑰後,可在支援的型號清單中選用 Grok 系列;平台沒有獨立的 xAI 金鑰欄位。
在開通之前,我們會建議學校先完成一份內容安全評估,由 IT 主任與相關科主任共同簽署。Grok 與 X 平台內容的整合是它與其他供應商最實質的分別,而香港學校面對的是未成年學生與家長期望,這個落差需要由學校自己判斷並記錄,平台無法代為決定。評估完成後,一個穩妥的次序是先限定在教師工具,累積一個學期的實際觀察,再討論是否擴展。
其餘條件與其他經 Poe 的供應商相同:所有呼叫仍經過平台的四層守門與 ai_audit_logs 稽核紀錄;而 Poe 沒有 embedding 與語音模型,校本知識庫與口語練習必須另有 OpenAI 或 Azure OpenAI 金鑰。
替代方案
- 想要原生支援、一條金鑰覆蓋聊天、embedding 與語音 → 看 OpenAI。
- 想要原生支援、且寫作回饋較穩定 → 看 Anthropic Claude。
- 同樣經 Poe 呼叫但單價更低、多模態更完整 → 看 Google Gemini。
- 想先弄清楚四家的定位差異 → 讀 四家主流供應商的橫向比較,或 AI 安全:幻覺與提示注入風險。
同一家的不同系列
同一供應商往往同時維持旗艦、主力、輕量與推理多條產品線,價格可以相差十倍以上。
| 型號 | 定位 | 發佈日期 | 上下文長度 | 輸入 / 輸出 | 說明 |
|---|---|---|---|---|---|
| Grok 4.6 | 旗艦 | 2026-08-12 | 500K | $2 / $6 | 現行旗艦,50 萬 token 上下文,新增 xhigh 推理級別。請求超過 20 萬 token 時整筆加倍計價(4 / 12 美元)。 |
| Grok 4.5 | 旗艦 | 2026-07 | — | — | 4.6 的直接前身,同為 50 萬 token 上下文與 2 / 6 美元定價。 |
| Grok 4.3 | 主力 | 2026-05 | 1,000K | $1.25 / $2.5 | 上下文最長的一檔(100 萬 token),成本亦最低,適合長文件整理。 |
| grok-build-0.1 | 編碼 | 2026-06 | 256K | $1 / $2 | Grok Build 編碼代理的預設型號,26 萬 token 上下文。 |
| grok-voice-think-fast-2.0 | 多模態 | 2026-08 | — | — | 語音對語音型號,2026 年 8 月 5 日起成為 grok-voice-latest 指向的版本。 |
| Grok 4 | 旗艦 | 2025-07-09 | — | — | xAI 首次進入前沿模型競爭的版本,亦是 Poe 上長期可選的型號。 |
常見問題
單看牌價確實便宜,2 / 6 美元大約是 GPT-6 Astra 的五分之一。但有兩點要一併計算:一是請求超過 20 萬 token 時整筆按 4 / 12 美元計算;二是在校本平台內它只能經 Poe 呼叫,學校實際付的是 Poe 的方案費用,不是 xAI 的牌價。
Grok 的定位一向強調較少限制的回應風格,而且與 X 平台的內容緊密結合。這對成年開發者不成問題,但香港學校面對的是未成年學生與家長期望,兩者的容忍度不同。這不是說 Grok 不能用,而是說學校應該先評估、記錄評估結果,再決定用在哪些模組。
可以,而且這是我們建議的起點。教師工具的使用者是成年專業人員,輸出亦會經教師自己覆核。先在教師端試用一個學期、累積實際觀察,再討論是否擴展到學生端,是比較穩妥的次序。
xAI 確實有語音對語音型號,但平台接觸 Grok 的唯一路線是 Poe,而 Poe 供應的是聊天型號。口語練習需要語音辨識與語音合成,現時仍要由 OpenAI 或 Azure OpenAI 提供。
對絕大部分學校工作綽綽有餘。一整份校本課程綱要加上兩年試題,通常也用不到 20 萬 token。反而要留意的是不要為了「反正塞得下」就把整個學期的教材一次貼進去,那會踩中加倍計價的門檻;正確做法是用 RAG 只取相關段落。
文中價格與規格數據截至 2026-09
- · 本文所有價格、功能與規格以上列官方文檔為準;供應商可隨時調整,請於採購前自行覆核。
- · 文中提及的產品名稱與商標均屬其各自擁有者所有。Edor.ai 與該等公司並無合作、代理或贊助關係。
- · 本文為教育用途的獨立整理與評測,不構成任何採購建議或法律意見。
- · 涉及學生個人資料的應用,請按學校政策及《個人資料(私隱)條例》(PDPO)自行評估後才使用。
延伸閱讀
- 四大美國模型供應商橫評:OpenAI、Anthropic、xAI、Google 哪一家適合學校?
2026 年 9 月,四家美國前沿供應商的旗艦價格由每 100 萬 token 0.75 美元到 10 美元,相差 13 倍。本文以香港學校最關心的六條軸線(價格、上下文、中文處理、內容安全、平台可用性、成本陷阱)做橫評,並解釋為甚麼「最強的模型」通常不是學校應該用的模型。
- 2026 全模型橫評:15 家供應商、一套學校用的選型框架
由 OpenAI、Anthropic、Google、xAI、Meta、Mistral,到 DeepSeek、Qwen、Kimi、GLM、MiniMax、豆包、混元、文心,再加上編碼專用的 Cursor Composer。本文以同一套學校用量估算,把 15 家供應商的價格、上下文、開放權重與實際可用性放在同一張表上,並提供一套四問選型框架。