GLM-5.3-Flash API 台幣費用試算 2026 — 多模態輸入、輕量高性價比
GLM-5.3-Flash(智譜/Z.ai)已上線,支援文字、圖片、影片輸入,價格是本文比較的三個模型裡最低。本文整理 USD/NT$ 對照價目、與旗艦版 GLM-5.3 的取捨,以及適合/不適合的使用情境。
查詢日:2026-09-02(台北時間)。 評測數據來自 Artificial Analysis 官網即時頁面;定價以 BazaarLink models 頁顯示的 USD 單價為準,匯率採 1 USD = NT$ 31.5。
GLM-5.3-Flash 是智譜(Z.ai)GLM-5.3 系列的輕量版,支援文字、圖片、影片輸入,100 萬以上 token 上下文,主打長 context 與多模態的高性價比。同日上架的旗艦版 GLM-5.3(純文字)智慧指數更高。BazaarLink 兩個模型都已上架,可用 glm-5.3-flash 與 glm-5.3 呼叫。
Bottom line up front: GLM-5.3-Flash 是本文三個模型裡最便宜的一個——輸入單價只有 Qwen3.8-Max 的十三分之一——但智慧指數也相應較低(57 分)。旗艦版 GLM-5.3 智慧指數 60 分、跟 Kimi K3 並列中國陣營第一,但只支援純文字。
想用台幣計費 + 統編開發票呼叫 GLM-5.3 系列?BazaarLink 提供 OpenAI-compatible 路由,模型單價相同,加 10% 充值服務費,解決台灣公司報帳痛點。詳見 AI API 在台灣公司報帳完整指南。
第三方評測:Artificial Analysis Intelligence Index
(資料源自 Artificial Analysis 官網模型頁,查詢日 2026-09-02)
| 模型 | Intelligence Index | 輸出速度 | 支援多模態 |
|---|---|---|---|
| GLM-5.3(Max,旗艦) | 60(與 Kimi K3 並列,較 GLM-5.2 進步 7 分) | — | 否(純文字) |
| Kimi K3(Max,對照) | 60 | 37.6 tokens/秒 | 是(圖片) |
| GLM-5.3-Flash | 57 | 42.8 tokens/秒 | 是(圖片、影片) |
GLM-5.3-Flash 分數(57)低於旗艦 GLM-5.3(60)與 Kimi K3(60),但換到多模態支援(圖片+影片輸入)與明顯更低的價格。這是典型的旗艦/輕量版取捨:要純文字最高分選 GLM-5.3,要多模態+低成本選 Flash 版。
價格對照(USD ↔ NT$)
| 模型 | Input USD/MTok | Output USD/MTok | NT$ 輸入 | NT$ 輸出 | vs Qwen3.8-Max |
|---|---|---|---|---|---|
| GLM-5.3-Flash | $0.15 | $0.50 | NT$ 4.7 | NT$ 15.8 | 0.075× |
| GLM-5.3(旗艦) | $1.40 | $4.40 | NT$ 44.1 | NT$ 138.6 | 0.7× |
| Qwen3.8-Max(對照) | $2.00 | $6.00 | NT$ 63 | NT$ 189 | 1.0×(基準) |
GLM-5.3-Flash 快取讀取 $0.03/MTok(NT$ 0.95);GLM-5.3 快取讀取 $0.26/MTok(NT$ 8.2)。本表單價與 BazaarLink models 頁一致,無模型 markup,最新單價見 BazaarLink Models。
場景試算:高頻多模態內容處理(NT$/月)
假設條件:每天 2,000 次圖片/影片內容分析(社群審核、電商商品分類)、每次 input 4,000 token(含多模態內容)+ output 300 token。
- 月任務數:2,000 × 30 = 60,000 次
- 月 input token:60,000 × 4,000 = 240,000,000(240 MTok)
- 月 output token:60,000 × 300 = 18,000,000(18 MTok)
費用(GLM-5.3-Flash):
- Input:240 × NT$ 4.7 = NT$ 1,128
- Output:18 × NT$ 15.8 = NT$ 284
- 合計:NT$ 1,412/月(≈ USD 45)
→ 同樣量級改用 Qwen3.8-Max(純文字對照,無視多模態需求):NT$ 18,660/月(貴超過 13 倍)。高頻、簡單、多模態的分類任務,GLM-5.3-Flash 這種輕量模型的價格優勢非常明顯——沒必要為這類任務動用旗艦模型。
規格
| GLM-5.3-Flash | GLM-5.3(旗艦) | |
|---|---|---|
| 上下文長度 | 1,310,720 tokens | 1,310,720 tokens |
| 輸入模態 | 文字、圖片、影片 | 文字 |
| 輸出 | 文字 | 文字 |
| 模型 ID | glm-5.3-flash(別名 z-ai/glm-5.3-flash) | glm-5.3(別名 z-ai/glm-5.3) |
⚠️ 上架公告當時列的上下文長度是 1,048,576 tokens,目前 BazaarLink 目錄顯示已更新為 1,310,720 tokens(以本文查詢日 2026-09-02 的即時目錄為準)。
怎麼呼叫
curl https://bazaarlink.ai/api/v1/chat/completions \
-H "Authorization: Bearer sk-bl-YOUR_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'
要用旗艦版,把 model 換成 glm-5.3 即可,OpenAI SDK 相容,不用改其他程式碼。
什麼情況該選哪一個
選 GLM-5.3-Flash:
- 需要圖片或影片輸入
- 高頻、簡單、對錯誤容忍度較高的任務(分類、摘要、審核)
- 成本是主要考量
選 GLM-5.3(旗艦):
- 純文字、需要最高正確性的推理或程式任務
- 智慧指數需求高於 Flash 版能提供的水準,但預算又低於 Kimi K3/Fable 5.1
兩者都不選:
- 需要視覺理解 + 高智慧指數兩者兼具——目前這個組合要在 Kimi K3(圖片,60 分)或更貴的模型裡找
來源與查詢紀錄
- Artificial Analysis:GLM-5.3-Flash 模型頁(查詢日 2026-09-02)
- BazaarLink Models:GLM-5.3-Flash(單價與規格;查詢日 2026-09-02)
- 延伸閱讀:AI API 費用怎麼在台灣公司報帳?2026 完整指南、DeepSeek API 台幣費用試算 2026
FAQ
GLM-5.3-Flash 的模型 ID 是什麼?
模型 ID 是 `glm-5.3-flash`,相容別名 `z-ai/glm-5.3-flash`。旗艦版是 `glm-5.3`(別名 `z-ai/glm-5.3`)。透過 BazaarLink 呼叫時把 `model` 參數設成對應的 ID 即可,OpenAI SDK 相容。
GLM-5.3-Flash 跟旗艦版 GLM-5.3 怎麼選?
需要圖片或影片輸入、或成本是主要考量時選 Flash 版;只需要純文字、要最高正確性時選旗艦版(智慧指數 60 分,比 Flash 版高 3 分,但只支援文字輸入)。
GLM-5.3-Flash 支援哪些輸入格式?
文字、圖片、影片輸入,文字輸出,上下文長度 1,310,720 tokens(上架公告當時寫的是 1,048,576 tokens,目前目錄已更新)。
GLM-5.3-Flash 為什麼這麼便宜?
Flash 版是輕量化模型,用更小的運算成本換取更低的智慧指數分數(57 分 vs 旗艦版 60 分)。適合高頻、簡單、對錯誤容忍度較高的任務,不適合需要最高正確性的複雜推理。
BazaarLink 上的 GLM-5.3 系列單價跟官方一樣嗎?
一樣,BazaarLink 不對模型單價加價(priceMultiplier = 1.0)。差異在計費方式:BazaarLink 用預付 USD 餘額、可開立台灣統一發票,充值時收取 10% 服務費。