AI 模型資料庫

主流大型語言模型一覽:規格、價格與本平台支援狀態

由 OpenAI、Anthropic、Google、xAI 到 DeepSeek、Qwen、Kimi、GLM 等,逐個列出現行旗艦型號、發佈時間線、上下文長度、API 定價,以及在 Edor.ai 內可否使用。所有數據附官方文檔連結,方便學校自行覆核。

價格為官方公佈的 API 定價(美元 / 每 100 萬 tokens),不代表學校在 Edor.ai 的實際支出——我們的方案以學校年費計算,不按 token 收費。

文中價格與規格數據截至 2026-09

原生支援

OpenAI

GPT-6 Astra
發佈日期
2026-09-03
上下文長度
1,050K tokens
API 定價
$10 / $50

原生供應商。平台預設使用 OpenAI,並同時用其 embedding、語音辨識與語音合成模型支援知識庫與口語練習;管理員可在後台改用其他模型。

查看詳細介紹
原生支援

Anthropic(Claude)

Claude Fable 5.1
發佈日期
2026-09-01
上下文長度
1,000K tokens
API 定價
$10 / $50

原生供應商。Claude 在中文寫作回饋與長文件理解上表現穩定,但沒有 embedding 與語音模型,校本知識庫與口語練習仍需另填 OpenAI 或 Azure 金鑰。

查看詳細介紹
經 Poe

Google(Gemini)

Gemini 3.8 Flash
發佈日期
2026-09-02
上下文長度
1,049K tokens
API 定價
$0.75 / $3.75

非原生供應商。學校可透過 Poe 供應商呼叫 Gemini 系列;Google 的開源權重系列 Gemma 亦可用 Ollama 在校內自架。若學校已購買 Google Workspace for Education,兩者可並行使用。

查看詳細介紹
經 Poe

xAI(Grok)

Grok 4.6
發佈日期
2026-08-12
上下文長度
500K tokens
API 定價
$2 / $6

非原生供應商,可透過 Poe 呼叫。Grok 與 X 平台內容緊密結合,學校在學生場景使用前應先自行評估內容安全政策。

查看詳細介紹
經 Ollama 自架開源權重 · Apache 2.0

Meta(Muse / Llama)

Muse Glimmer 30B
發佈日期
2026-08-09
上下文長度
131K tokens
API 定價
$0.35 / $1.5

非原生供應商,但 Meta 的開源權重型號是校內自架最實際的選擇之一:Muse Glimmer 30B 以 Apache 2.0 發佈,可用 Ollama 或 LM Studio 在單張消費級顯示卡上運行,學生資料完全不出校網。注意 Meta 於 2026 年 4 月已把前沿產品線由 Llama 改為閉源的 Muse Spark,Llama 系列現屬舊版本。

查看詳細介紹
經 Ollama 自架開源權重 · Apache 2.0

Mistral AI

Mistral Large 3
發佈日期
2025-12
上下文長度
256K tokens
API 定價
$0.5 / $1.5

非原生供應商。Mistral 全線以 Apache 2.0 發佈,是歐洲資料治理框架下最常被引用的選擇;小型 Ministral 3B / 8B 特別適合校內舊機或無網絡環境自架。

查看詳細介紹
暫不支援

Cursor Composer(Anysphere)

Composer 2.5
發佈日期
2026-05-18
上下文長度
官方未公佈
API 定價
$0.5 / $2.5

不適用於校本平台。Composer 是 Cursor 編輯器內建的編碼專用模型,官方說明寫明只能在 Cursor 的產品內使用,沒有可當作模型端點呼叫的推論 API。Cursor 另有 Cloud Agents API 與 SDK,但那是用來在 Cursor 的環境內驅動編碼代理,不能當成一般對話模型接進學與教平台;它亦不是為課堂或學生場景設計。教師若在資訊科技科教編程,可把 Cursor 當成教具;平台的模型選擇則應在下列其他供應商之中。

查看詳細介紹
經 Ollama 自架開源權重 · MIT

深度求索(DeepSeek)

DeepSeek-V4.1-Flash
發佈日期
2026-09-10
上下文長度
1,000K tokens
API 定價
$0.15 / $0.6

非原生供應商。學校若要用 DeepSeek,現實做法是以 Ollama 在校內伺服器跑蒸餾或量化版本,資料完全不出校網;直接呼叫 DeepSeek 官方 API 屬跨境傳輸,須先做私隱評估。

查看詳細介紹
經 Ollama 自架開源權重 · 自訂授權 / Apache 2.0(視型號)

阿里巴巴通義千問(Qwen)

Qwen3.8-Max
發佈日期
2026-09-03
上下文長度
1,000K tokens
API 定價
$2 / $6

非原生供應商。Qwen 是中文能力最受肯定的開源系列,Edor.ai 的 Ollama 建議清單已包含 qwen2.5:14b;較新的 Qwen3.8-27B 以 Apache 2.0 發佈,官方稱可在 24GB 顯示記憶體運行,是校內自架處理中文教材的實用選擇。旗艦 Qwen3.8-Max 為閉源雲端 API,屬跨境傳輸,學生資料須先評估。

查看詳細介紹
暫不支援開源權重 · Kimi K3 License

月之暗面(Kimi)

Kimi K3
發佈日期
2026-07-16
上下文長度
1,000K tokens
API 定價
$3 / $15

目前未接入。Kimi K3 雖公開權重,但 2.8 萬億參數(啟動約 1,040 億)遠超一般學校伺服器可負擔的規模,校內自架並不現實;官方 API 位於中國內地,屬跨境傳輸。學校若只想試用其長文件能力,建議由教師以個人帳戶處理已去識別化的材料。

查看詳細介紹
經 Ollama 自架開源權重 · MIT(GLM-5.2 與 5.3-Flash)

智譜 Z.ai(GLM)

GLM-5.3
發佈日期
2026-08-14
上下文長度
1,000K tokens
API 定價
$1.4 / $4.4

非原生供應商。GLM 是少數把大型模型以 MIT 授權發佈的團隊(GLM-5.2 與 GLM-5.3-Flash),對想完全自主部署的辦學團體有吸引力;但參數規模仍需伺服器級硬件,而各版本權重的開放時間並不一致,採購前請以官方 Hugging Face 頁面核實。

查看詳細介紹
暫不支援開源權重 · 自訂授權(見 Hugging Face model card)

MiniMax(稀宇科技)

MiniMax M3
發佈日期
2026-06
上下文長度
1,000K tokens
API 定價
$0.3 / $1.2

目前未接入。MiniMax M3 走「稀疏注意力 + 低成本長上下文」路線,約 4,280 億總參數但每 token 只啟動約 230 億,是同級中最便宜的長上下文模型之一;不過官方 API 在中國內地,授權條款亦需逐項核對,學校若要用建議先由 IT 主任做私隱與授權評估。

查看詳細介紹
暫不支援

字節跳動豆包(Doubao)

Doubao Seed 2.1 Pro
發佈日期
2026-06-23
上下文長度
256K tokens
API 定價
官方未公佈

目前未接入,亦不建議香港學校用於學生場景。豆包只透過火山引擎(中國內地)供應,權重不公開,定價以人民幣計(Seed 2.1 Pro 為每 100 萬 token 6 元輸入 / 30 元輸出),而且服務條款與資料處理地點都以內地法規為框架。學校如需中文能力,自架 Qwen 或 GLM 的開源權重是更可控的路線。

查看詳細介紹
經 Ollama 自架開源權重 · Apache 2.0

騰訊混元(Hunyuan)

Hunyuan Hy4 Preview
發佈日期
2026-08-28
上下文長度
1,000K tokens
API 定價
$0.83 / $?

非原生供應商,但值得留意:混元 Hy4 Preview 以 Apache 2.0 這種完全寬鬆的授權發佈 7,700 億參數(啟動 490 億)權重,授權條款比 GLM-5.3 或 Kimi K3 的自訂授權更清晰。實際自架仍需伺服器級硬件;直接呼叫騰訊雲 API 則屬跨境傳輸。

查看詳細介紹
暫不支援開源權重 · ERNIE 4.5 系列開源;5.x 未公開

百度文心一言(ERNIE)

ERNIE 5.1
發佈日期
2026-08
上下文長度
128K tokens
API 定價
$0.55 / $?

目前未接入。文心一言的主要優勢是與百度搜尋結合的即時資料,但這正好是香港學校最需要謹慎的部分:搜尋來源、內容政策與資料處理地點都以內地框架為主。上下文長度亦只有 12.8 萬 token,遠低於同期其他旗艦。

查看詳細介紹

最新發佈時間線

各供應商近期公開的型號,由新至舊排列。模型換代速度極快,學校採購時應要求供應商說明「模型升級是否已包含在年費之內」。

  1. 2026-09-10DeepSeek-V4.1-FlashDeepSeek · 旗艦現行型號,552B 參數 MoE 架構但推理時只啟動 8B(prefill)至 16B(decode),原生支援圖像。0.15 / 0.60 美元為非高峰價,高峰時段加倍。
  2. 2026-09-03GPT-6 AstraOpenAI · 旗艦現行旗艦。reasoning.effort 由 low 到 max 五級;超過 272K input 的請求整筆按 2 倍輸入價計算。
  3. 2026-09-03Qwen3.8-Max-0902Alibaba Qwen · 旗艦旗艦的最新後訓練快照,2.4 萬億總參數 MoE、每 token 啟動約 950 億,支援文字、圖像與影片輸入。此快照只提供雲端 API,未公開權重。
  4. 2026-09-02Gemini 3.8 FlashGoogle · 旗艦現行主力型號,thinking_level 可設 low / medium / high。0.75 / 3.75 美元為導入價,2027 年 1 月 1 日起升至 1.50 / 7.50 美元。
  5. 2026-09-02Gemini 3.8 Flash CyberGoogle · 旗艦資安專用型號,只透過 Fairwind 計劃向受信任的防守方開放。
  6. 2026-09-01Claude Fable 5.1Anthropic · 旗艦現行最強型號,adaptive thinking 永久開啟。快取讀取降至每 100 萬 token 0.25 美元,是全系列最低。
  7. 2026-08-28Hunyuan Hy4 PreviewTencent Hunyuan · 旗艦7,700 億總參數、490 億啟動參數,100 萬 token 上下文,Apache 2.0;騰訊自家盲測評比中略勝 GLM-5.3 與 Kimi K3。
  8. 2026-08-26Qwen3.8-FlashAlibaba Qwen · 輕量1,250 億總參數、60 億啟動參數的小型 MoE,上下文由 256K 擴展至 100 萬,價格極低。
  9. 2026-08-26GLM-5.3-FlashZhipu AI / Z.ai (GLM) · 輕量3,200 億總參數、180 億啟動參數的原生多模態 MoE,以 MIT 授權發佈,推廣價每 100 萬 token 0.075 / 0.25 美元(標價 0.15 / 0.50)。
  10. 2026-08-21Doubao-Seed-EvolvingByteDance Doubao · 旗艦每周至少更新一次的動態迭代型號,以固定 Model ID 呼叫即取得最新版本。
  11. 2026-08-16DeepSeek-V4-Pro / V4-FlashDeepSeek · 旗艦V4 世代,首次引入高峰/非高峰定價。2026 年 9 月 14 日起 V4-Pro 請求改為路由至 V4.1-Flash。
  12. 2026-08-14Qwen3.8-27BAlibaba Qwen · 開源權重278 億參數密集視覺語言模型,Apache 2.0,官方稱可在 24GB 顯示記憶體運行——對學校自架而言是這批模型中最現實的一個。
  13. 2026-08-14GLM-5.3Zhipu AI / Z.ai (GLM) · 旗艦現行旗艦,主打編碼與代理工作,與 GLM-5.2 同價。旗艦權重的開放進度以官方 Hugging Face 頁面為準。
  14. 2026-08-13Gemini 3.7 FlashGoogle · 主力與 3.8 同價的上一版,六周內三次 Flash 迭代中的第二次。

學校應該怎樣看這張表

  • 不要只看價格。教師工具每日產生的 token 量有限,真正的成本差異來自「是否要為每位教師另買授權」。
  • 上下文長度決定 AI 一次能讀多少校本材料,但長上下文不等於記得清楚——請一併參考 LLM 教室關於「迷失在中間」的一課。
  • 開源權重的價值不在免費,而在可以放進學校自己的伺服器,讓學生資料完全不離開校網。
  • 支援狀態會隨我們接入新供應商而更新;若學校有指定模型要求,請在報價階段提出,我們會評估可行性。
訂閱教育 AI 通訊

每月一封:給香港學校的 AI 教學實戰文章、平台更新與撥款資訊。隨時可取消。

我們只會用此電郵寄送通訊,不會分享給第三方。