BazaarLinkBazaarLink
登入
所有文章
發布時間 2026-09-02 · · 作者BazaarLink · GLM-5.3-Flash · GLM-5.3 · Z.ai · 智譜 · Artificial Analysis · 台幣換算

GLM-5.3-Flash API 台幣費用試算 2026 — 多模態輸入、輕量高性價比

GLM-5.3-Flash(智譜/Z.ai)已上線,支援文字、圖片、影片輸入,價格是本文比較的三個模型裡最低。本文整理 USD/NT$ 對照價目、與旗艦版 GLM-5.3 的取捨,以及適合/不適合的使用情境。

查詢日:2026-09-02(台北時間)。 評測數據來自 Artificial Analysis 官網即時頁面;定價以 BazaarLink models 頁顯示的 USD 單價為準,匯率採 1 USD = NT$ 31.5

GLM-5.3-Flash 是智譜(Z.ai)GLM-5.3 系列的輕量版,支援文字、圖片、影片輸入,100 萬以上 token 上下文,主打長 context 與多模態的高性價比。同日上架的旗艦版 GLM-5.3(純文字)智慧指數更高。BazaarLink 兩個模型都已上架,可用 glm-5.3-flashglm-5.3 呼叫。

Bottom line up front: GLM-5.3-Flash 是本文三個模型裡最便宜的一個——輸入單價只有 Qwen3.8-Max 的十三分之一——但智慧指數也相應較低(57 分)。旗艦版 GLM-5.3 智慧指數 60 分、跟 Kimi K3 並列中國陣營第一,但只支援純文字。

想用台幣計費 + 統編開發票呼叫 GLM-5.3 系列?BazaarLink 提供 OpenAI-compatible 路由,模型單價相同,加 10% 充值服務費,解決台灣公司報帳痛點。詳見 AI API 在台灣公司報帳完整指南

第三方評測:Artificial Analysis Intelligence Index

(資料源自 Artificial Analysis 官網模型頁,查詢日 2026-09-02)

模型Intelligence Index輸出速度支援多模態
GLM-5.3(Max,旗艦)60(與 Kimi K3 並列,較 GLM-5.2 進步 7 分)否(純文字)
Kimi K3(Max,對照)6037.6 tokens/秒是(圖片)
GLM-5.3-Flash5742.8 tokens/秒是(圖片、影片)

GLM-5.3-Flash 分數(57)低於旗艦 GLM-5.3(60)與 Kimi K3(60),但換到多模態支援(圖片+影片輸入)與明顯更低的價格。這是典型的旗艦/輕量版取捨:要純文字最高分選 GLM-5.3,要多模態+低成本選 Flash 版。

價格對照(USD ↔ NT$)

模型Input USD/MTokOutput USD/MTokNT$ 輸入NT$ 輸出vs Qwen3.8-Max
GLM-5.3-Flash$0.15$0.50NT$ 4.7NT$ 15.80.075×
GLM-5.3(旗艦)$1.40$4.40NT$ 44.1NT$ 138.60.7×
Qwen3.8-Max(對照)$2.00$6.00NT$ 63NT$ 1891.0×(基準)

GLM-5.3-Flash 快取讀取 $0.03/MTok(NT$ 0.95);GLM-5.3 快取讀取 $0.26/MTok(NT$ 8.2)。本表單價與 BazaarLink models 頁一致,無模型 markup,最新單價見 BazaarLink Models

場景試算:高頻多模態內容處理(NT$/月)

假設條件:每天 2,000 次圖片/影片內容分析(社群審核、電商商品分類)、每次 input 4,000 token(含多模態內容)+ output 300 token。

  • 月任務數:2,000 × 30 = 60,000 次
  • 月 input token:60,000 × 4,000 = 240,000,000(240 MTok)
  • 月 output token:60,000 × 300 = 18,000,000(18 MTok)

費用(GLM-5.3-Flash):

  • Input:240 × NT$ 4.7 = NT$ 1,128
  • Output:18 × NT$ 15.8 = NT$ 284
  • 合計:NT$ 1,412/月(≈ USD 45)

→ 同樣量級改用 Qwen3.8-Max(純文字對照,無視多模態需求):NT$ 18,660/月(貴超過 13 倍)。高頻、簡單、多模態的分類任務,GLM-5.3-Flash 這種輕量模型的價格優勢非常明顯——沒必要為這類任務動用旗艦模型。

規格

GLM-5.3-FlashGLM-5.3(旗艦)
上下文長度1,310,720 tokens1,310,720 tokens
輸入模態文字、圖片、影片文字
輸出文字文字
模型 IDglm-5.3-flash(別名 z-ai/glm-5.3-flashglm-5.3(別名 z-ai/glm-5.3

⚠️ 上架公告當時列的上下文長度是 1,048,576 tokens,目前 BazaarLink 目錄顯示已更新為 1,310,720 tokens(以本文查詢日 2026-09-02 的即時目錄為準)。

怎麼呼叫

curl https://bazaarlink.ai/api/v1/chat/completions \
  -H "Authorization: Bearer sk-bl-YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

要用旗艦版,把 model 換成 glm-5.3 即可,OpenAI SDK 相容,不用改其他程式碼。

什麼情況該選哪一個

選 GLM-5.3-Flash:

  • 需要圖片或影片輸入
  • 高頻、簡單、對錯誤容忍度較高的任務(分類、摘要、審核)
  • 成本是主要考量

選 GLM-5.3(旗艦):

  • 純文字、需要最高正確性的推理或程式任務
  • 智慧指數需求高於 Flash 版能提供的水準,但預算又低於 Kimi K3/Fable 5.1

兩者都不選:

  • 需要視覺理解 + 高智慧指數兩者兼具——目前這個組合要在 Kimi K3(圖片,60 分)或更貴的模型裡找

來源與查詢紀錄

FAQ

GLM-5.3-Flash 的模型 ID 是什麼?

模型 ID 是 `glm-5.3-flash`,相容別名 `z-ai/glm-5.3-flash`。旗艦版是 `glm-5.3`(別名 `z-ai/glm-5.3`)。透過 BazaarLink 呼叫時把 `model` 參數設成對應的 ID 即可,OpenAI SDK 相容。

GLM-5.3-Flash 跟旗艦版 GLM-5.3 怎麼選?

需要圖片或影片輸入、或成本是主要考量時選 Flash 版;只需要純文字、要最高正確性時選旗艦版(智慧指數 60 分,比 Flash 版高 3 分,但只支援文字輸入)。

GLM-5.3-Flash 支援哪些輸入格式?

文字、圖片、影片輸入,文字輸出,上下文長度 1,310,720 tokens(上架公告當時寫的是 1,048,576 tokens,目前目錄已更新)。

GLM-5.3-Flash 為什麼這麼便宜?

Flash 版是輕量化模型,用更小的運算成本換取更低的智慧指數分數(57 分 vs 旗艦版 60 分)。適合高頻、簡單、對錯誤容忍度較高的任務,不適合需要最高正確性的複雜推理。

BazaarLink 上的 GLM-5.3 系列單價跟官方一樣嗎?

一樣,BazaarLink 不對模型單價加價(priceMultiplier = 1.0)。差異在計費方式:BazaarLink 用預付 USD 餘額、可開立台灣統一發票,充值時收取 10% 服務費。

立即體驗 BazaarLink

台幣計費・統一發票・主流 AI 模型・OpenAI 相容 API

免費註冊 / 登入企業採購洽詢
相關文章
Claude Fable 5.1 · Fable 5.1 · Claude API · Anthropic 定價 · 台幣換算 · Artificial Analysis
Claude Fable 5.1 API 台幣費用試算 2026 — AA 智慧排名第一、完整規格
Kimi K3 · Moonshot AI · Kimi API · Artificial Analysis · 台幣換算 · AI API 定價
Kimi K3 API 台幣費用試算 2026 — AA 智慧指數 60 分、100 萬 token 上下文
Qwen3.8-Max · Qwen API · 阿里雲 · Artificial Analysis · 台幣換算 · AI API 定價
Qwen3.8-Max API 台幣費用試算 2026 — AA 智慧指數 58 分、深度推理旗艦
客服
客服
您好!有什麼可以協助?
請留下訊息,我們會盡快回覆。