2026 AI API 價格比較:GPT-5.6、Claude、Gemini、DeepSeek 台幣對照表,快取/批次/促銷/回饋四種折扣怎麼疊(含成本試算)
14 個主流模型每百萬 token 的 USD/NT$ 對照、輸出/輸入倍數、三個場景四家並排的月費試算,以及四種真實存在的折扣機制——快取讀取價、促銷價、批次 API、離峰半價——哪些直購才有、哪些 BazaarLink 有、哪一種只有我們有(用量回饋)。2026-09-15 依線上目錄與官方頁查證。
查詢日:2026-09-15。 表中單價為 BazaarLink Models 頁公開的客戶單價,與各家官方牌價相同;快取價取自同一目錄;匯率採 1 USD = NT$ 31.5(與站內其他價目文一致)。各家官方頁改得很勤,動手前請再對一次。
搜「AI API 價格」「成本」「折扣」「促銷」會撈到同一批文章,因為這四件事在台灣是同一個問題:每百萬 token 到底多少錢、我的場景一個月要花多少、有哪些方法讓它更少。 這篇把四家主流模型放在同一張表,用同一組場景試算,再把「折扣」拆成四種真實存在的機制——包括 BazaarLink 沒有的那兩種。
先給結論:
- 主力模型同價:GPT-5.6 Sol 與 Claude Sonnet 5 都是 $2/$10。料金選不出來,要看品質與延遲。
- 輸出單價才是帳單主角:多數模型輸出是輸入的 5 倍,生成型工作負載要先看右邊那欄。
- 「折扣」有四種,兩種要直購才有:快取讀取(BazaarLink 有,多數模型是輸入價的 10%)、促銷價(有,鏡射官方)、批次 API 五折(我們沒有)、DeepSeek 離峰半價(直購才有)。另外一種只有我們有:用量回饋。
- 最便宜與最貴差 50~125 倍:模型選擇對成本的影響大過任何折扣。
跨家價目對照表(USD/NT$,每百萬 token)
| 模型 | 家 | 定位 | 輸入 | 輸出 | NT$ 輸入 | NT$ 輸出 |
|---|---|---|---|---|---|---|
| GPT-6 Astra | OpenAI | 最上位 | $10.00 | $50.00 | NT$ 315 | NT$ 1,575 |
| GPT-5.6 Sol | OpenAI | 旗艦主力 | $2.00 | $10.00 | NT$ 63 | NT$ 315 |
| GPT-5.6 Terra | OpenAI | 主力 | $2.00 | $12.00 | NT$ 63 | NT$ 378 |
| GPT-5.6 Luna | OpenAI | 輕量 | $0.20 | $1.20 | NT$ 6.3 | NT$ 38 |
| Claude Opus 4.8 | Anthropic | 最上位 | $5.00 | $25.00 | NT$ 158 | NT$ 788 |
| Claude Sonnet 5 | Anthropic | 主力 | $2.00 | $10.00 | NT$ 63 | NT$ 315 |
| Claude Haiku 4.5 | Anthropic | 輕量 | $1.00 | $5.00 | NT$ 32 | NT$ 158 |
| Gemini 3.1 Pro | 長文脈主力 | $2.00 | $12.00 | NT$ 63 | NT$ 378 | |
| Gemini 3.8 Flash | 主力(促銷價至 2026-12-31) | $0.75 | $3.75 | NT$ 24 | NT$ 118 | |
| Gemini 3.5 Flash-Lite | 輕量 | $0.30 | $2.50 | NT$ 9.4 | NT$ 79 | |
| Gemini 2.5 Flash-Lite | 極輕量 | $0.10 | $0.40 | NT$ 3.2 | NT$ 13 | |
| DeepSeek V4 Pro | DeepSeek | 主力 | $2.40 | $4.80 | NT$ 76 | NT$ 151 |
| DeepSeek V4 Flash | DeepSeek | 輕量 | $0.20 | $0.40 | NT$ 6.3 | NT$ 13 |
| Qwen3.7 Flash | Qwen | 免費層模型 | $0.030 | $0.13 | NT$ 0.9 | NT$ 4.1 |
三個從表上直接看得出的事:最上位(GPT-6 Astra $10/$50)與最便宜付費模型(DeepSeek V4 Flash $0.20/$0.40)差 50 倍與 125 倍;DeepSeek V4 Pro 輸入 $2.40 是主力級、輸出 $4.80 卻只有 Sonnet 的一半以下,生成量大的用途效果很不一樣;Gemini 3.8 Flash 的 $0.75/$3.75 是官方標註到 2026-12-31 的價格,做預算要留意。
為什麼帳單比你算的貴:先看輸出,再看快取
| 模型 | 輸出/輸入倍數 |
|---|---|
| GPT-6 Astra | 5.0 倍 |
| GPT-5.6 Sol | 5.0 倍 |
| GPT-5.6 Terra | 6.0 倍 |
| GPT-5.6 Luna | 6.0 倍 |
| Claude Opus 4.8 | 5.0 倍 |
| Claude Sonnet 5 | 5.0 倍 |
| Claude Haiku 4.5 | 5.0 倍 |
| Gemini 3.1 Pro | 6.0 倍 |
| Gemini 3.8 Flash | 5.0 倍 |
| Gemini 3.5 Flash-Lite | 8.3 倍 |
| Gemini 2.5 Flash-Lite | 4.0 倍 |
| DeepSeek V4 Pro | 2.0 倍 |
| DeepSeek V4 Flash | 2.0 倍 |
讀長文寫短答(摘要、分類、抽取)是輸入主導;短問長答(文章生成、程式生成、輸出思考過程的推理模型)是輸出主導。先確定自己是哪一種,再看表,不然會選到「輸入很便宜、輸出很貴」的模型。
四種折扣機制:哪些直購才有、哪些我們有、哪些只有我們有
| 機制 | 怎麼運作 | 直購官方 | BazaarLink |
|---|---|---|---|
| 快取讀取價(prompt caching) | 重複出現的前綴(system prompt、對話歷史、長文件)第二次以後按快取價計 | 各家有 | 有。多數模型快取讀取=輸入價 10%(見下表) |
| 促銷價 | 官方期間限定價 | 有 | 有,鏡射官方(例:Gemini 3.8 Flash 至 2026-12-31) |
| 批次 API 五折 | 非即時、24 小時內回、輸入輸出對半 | OpenAI、Anthropic、Google 有 | 沒有 |
| 離峰半價 | DeepSeek 直購在非尖峰時段全部模型半價(尖峰=UTC 週一到五 01–04、06–10,即台北 09–12、14–18) | DeepSeek 有 | 沒有,我們是固定價 |
| 用量回饋 | 當月消費跨門檻發固定金額,達到的門檻累加,$500 以上再回 10%(DeepSeek 20%) | 沒有 | 只有我們有,規則 |
| 代理商企業折扣 | 談出來的折數 | — | 企業方案有,折數不公開,本文不寫 |
如果你的工作負載是「不急、量大、可以等 24 小時」,批次 API 是最大的一筆折扣,而那要直購。 這句話我們不繞過去。
我們的快取價(輸入價的幾折)
| 模型 | 輸入 | 快取讀取 | 讀取=輸入的 | 快取寫入 |
|---|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | 10% | $12.50 |
| GPT-5.6 Sol | $2.00 | $0.20 | 10% | $2.50 |
| GPT-5.6 Terra | $2.00 | $0.20 | 10% | $2.50 |
| GPT-5.6 Luna | $0.20 | $0.020 | 10% | $0.25 |
| Claude Opus 4.8 | $5.00 | $0.50 | 10% | $6.25 |
| Claude Sonnet 5 | $2.00 | $0.20 | 10% | $2.50 |
| Claude Haiku 4.5 | $1.00 | $0.10 | 10% | $1.25 |
| Gemini 3.1 Pro | $2.00 | $0.20 | 10% | $0.38 |
| Gemini 3.8 Flash | $0.75 | $0.075 | 10% | — |
| Gemini 2.5 Flash-Lite | $0.10 | $0.010 | 10% | $0.083 |
| DeepSeek V4 Pro | $2.40 | $0.14 | 6% | — |
| DeepSeek V4 Flash | $0.20 | $0.030 | 15% | — |
快取寫入在 GPT 與 Claude 系列是輸入價的 1.25 倍——只有前綴會重複出現超過一次,快取才划算。
三個場景,同一組假設,四家並排(月費)
假設全部用 30 天、不計快取;快取的效果單獨在下一節示範。
客服 Bot:500 對話/天,每對話 3 輪,每輪 300 in/150 out
月 token:輸入 13.5 M、輸出 6.75 M。
| 模型 | 月費 USD | 月費 NT$ |
|---|---|---|
| DeepSeek V4 Flash | $5.4 | NT$ 170 |
| GPT-5.6 Luna | $10.8 | NT$ 340 |
| Gemini 3.5 Flash-Lite | $20.9 | NT$ 659 |
| Gemini 3.8 Flash | $35.4 | NT$ 1,116 |
| Claude Haiku 4.5 | $47.2 | NT$ 1,488 |
| Claude Sonnet 5 | $94.5 | NT$ 2,977 |
| GPT-5.6 Terra | $108 | NT$ 3,402 |
同一件事,最便宜到最貴差 20 倍。
文件批次:100 篇/天,每篇 6,500 token 讀、800 token 摘要
月 token:輸入 19.5 M、輸出 2.4 M。
| 模型 | 月費 USD | 月費 NT$ |
|---|---|---|
| Gemini 2.5 Flash-Lite | $2.9 | NT$ 92 |
| DeepSeek V4 Flash | $4.9 | NT$ 153 |
| GPT-5.6 Luna | $6.8 | NT$ 214 |
| Gemini 3.5 Flash-Lite | $11.8 | NT$ 373 |
| Gemini 3.8 Flash | $23.6 | NT$ 744 |
| Claude Haiku 4.5 | $31.5 | NT$ 992 |
同一件事,最便宜到最貴差 11 倍。
長文件分析:50 份/天,每份 50,000 token、輸出 2,000
月 token:輸入 75 M、輸出 3 M。
| 模型 | 月費 USD | 月費 NT$ |
|---|---|---|
| DeepSeek V4 Flash | $16.2 | NT$ 510 |
| Gemini 3.8 Flash | $67.5 | NT$ 2,126 |
| Claude Sonnet 5 | $180 | NT$ 5,670 |
| GPT-5.6 Sol | $180 | NT$ 5,670 |
| Gemini 3.1 Pro | $186 | NT$ 5,859 |
| DeepSeek V4 Pro | $194 | NT$ 6,124 |
| Claude Opus 4.8 | $450 | NT$ 14,175 |
同一件事,最便宜到最貴差 28 倍。
快取能省多少:用客服 Bot 示範
客服 Bot 的每一輪輸入裡,system prompt 與前幾輪歷史是重複的。假設 60% 的輸入 token 命中快取、用 Claude Sonnet 5:
- 不用快取:13.5 × $2.00 + 6.75 × $10.00 = $94.5/月
- 用快取:13.5 × (40% × $2.00 + 60% × $0.20) + 6.75 × $10.00 = $79.9/月
- 省 15%。輸出那一半不動,所以整體省的比例永遠小於快取折數本身。
快取的細節(哪些模型有、前綴怎麼算、最短長度)另有專文:Prompt caching 是什麼、能省多少。
怎麼選:依用途,不依品牌
| 用途 | 先看 | 建議起點 |
|---|---|---|
| 分類、抽取、摘要(輸入主導) | 輸入單價 | Gemini 3.5 Flash-Lite、DeepSeek V4 Flash、GPT-5.6 Luna |
| 客服、翻譯、中等複雜 | 輸出單價+快取 | Gemini 3.8 Flash、Claude Haiku 4.5 |
| 生成長文、程式 | 輸出單價 | DeepSeek V4 Pro(輸出 $4.80)、Sonnet 5 |
| 長文件、長上下文 | 輸入單價+上下文長度 | Gemini 3.1 Pro(輸入 $2、1M 上下文) |
| 最高品質、不計成本 | — | GPT-6 Astra、Claude Opus 4.8 |
| 先接通、先驗證 | 免費層 | Qwen3.7 Flash(免費層,每分鐘 10 次、每天 50 次) |
台幣、發票、回饋:帳單之外的三件事
- 台幣計價與統一發票:直購是 USD 海外收據;BazaarLink 以台幣儲值、符合資格的付款渠道可開統一發票(個人/統編)。報帳流程見這篇。
- 用量回饋:當月在同一方案(OpenAI GPT/Gemini/DeepSeek)的消費跨過 $20/$50/$100/$200/$500 各回 $2/$3/$5/$10/$30(DeepSeek 為 $4/$6/$10/$20/$60),超過 $500 再回 10%(DeepSeek 20%)。$20 以下沒有、$500 以上才穩定,完整規則。
- 金鑰花費上限:每把 API 金鑰可設支出上限,到了就擋,不是告警。
各家單獨的台幣價目文
GPT-5 系列、Claude、Gemini(含免費額度)、DeepSeek;免費額度總整理見這篇。
FAQ
AI API 哪一家最便宜?
2026-09-15 時最便宜的付費主流模型是 DeepSeek V4 Flash($0.20/$0.40 每百萬 token),輕量級還有 Gemini 2.5 Flash-Lite($0.10/$0.40)與 GPT-5.6 Luna($0.20/$1.20)。主力級 GPT-5.6 Sol 與 Claude Sonnet 5 同價($2/$10)。最上位 GPT-6 Astra 是 $10/$50。價格差 50~125 倍,模型選擇對成本的影響大過任何折扣。
AI API 有什麼折扣?
四種真實存在的機制:快取讀取價(重複前綴按快取價計,多數模型是輸入價的 10%)、官方促銷價(如 Gemini 3.8 Flash 至 2026-12-31)、批次 API 五折(非即時、24 小時內回,OpenAI/Anthropic/Google 直購有)、DeepSeek 離峰半價(直購,非尖峰時段全模型半價)。BazaarLink 有前兩種,沒有批次與離峰;另外有只有我們才有的用量回饋。
BazaarLink 的價格比直購貴嗎?
文字模型的客戶單價與各家官方牌價相同(Models 頁公開,本文表格即為該價)。差別在台幣計價、統一發票、一把金鑰叫多家、用量回饋;批次 API 與 DeepSeek 離峰半價則是直購才有,這兩種在本文明寫。
Prompt caching 能省多少?
看輸入裡有多少重複前綴。以客服 Bot、Claude Sonnet 5、60% 輸入命中快取為例,月費從約 $94.5 降到約 $79.9,省約 15%。輸出那一半不受快取影響,所以整體省的比例永遠小於快取折數本身;GPT 與 Claude 的快取寫入是輸入價的 1.25 倍,前綴要重複出現超過一次才划算。
輸入和輸出哪個比較貴?
輸出。多數模型輸出是輸入的 5 倍左右,Gemini 3.5 Flash-Lite 超過 8 倍。讀長文寫短答的用途看輸入價,短問長答(生成、程式、推理模型的思考過程)看輸出價,先分清楚再比。
用量回饋是打折嗎?
不是。它是里程碑固定回饋:當月在同一方案的消費跨過 $20/$50/$100/$200/$500 各發一筆固定金額,達到的門檻累加,超過 $500 再回 10%(DeepSeek 20%)。$20 以下沒有,門檻之間會被稀釋,$500 以上才穩定在 10%。免費層與自帶金鑰的用量不算。