DeepSeek V4.1 Flash 該不該從 V4 Flash 換過去?單價、圖片輸入與台幣試算
DeepSeek V4.1 Flash 的輸出單價是 V4 Flash 的 3 倍($1.20 vs $0.40/百萬 tokens),多付的部分換到圖片輸入與更好的推理。本文用台幣試算兩者差多少、什麼情況才值得換過去,並記錄 max_tokens 給太小會拿到空字串的實測坑。上下文 1,048,576 tokens,可開台灣統一發票。
查詢日:2026-09-11(台北時間)。 定價以 BazaarLink models 頁顯示的 USD 單價為準,匯率採 1 USD = NT$ 31.5 試算。本文只寫已在站上實際驗證過的規格。
DeepSeek V4.1 Flash 已在 BazaarLink 上線,模型代號 deepseek-v4.1-flash。它是 DeepSeek 系列第一個採用 Causal Encoder-Decoder(CED) 架構的稀疏混合專家模型,輸入時啟用 8B 參數、輸出時 16B。
Bottom line up front: 這是站上「百萬級上下文 + 看得懂圖 + 單價低於 $0.5/M 輸入」三者兼具的少數選項。輸入 $0.30/M、輸出 $1.20/M、快取讀取 $0.006/M,上下文 1,048,576 tokens,單次最大輸出 384,000 tokens,支援文字與圖片輸入。適合要餵長文件或截圖、又不想付旗艦模型價格的場景。
規格摘要
| 項目 | DeepSeek V4.1 Flash |
|---|---|
| 模型代號 | deepseek-v4.1-flash(完整寫法 deepseek/deepseek-v4.1-flash) |
| 上下文視窗 | 1,048,576 tokens |
| 單次最大輸出 | 384,000 tokens |
| 輸入模態 | 文字、圖片 |
| 輸出模態 | 文字 |
| 推理 | 預設產生 reasoning tokens,可用 reasoning_effort 調整 |
| 其他參數 | tools、structured outputs、response_format、seed、logprobs、top_k、min_p 等 |
價格與台幣試算
| 項目 | USD/百萬 tokens | NT$/百萬 tokens |
|---|---|---|
| 輸入 | $0.30 | NT$ 9.45 |
| 輸出 | $1.20 | NT$ 37.80 |
| 快取讀取 | $0.006 | NT$ 0.189 |
實際情境試算(未使用快取):
| 情境 | 輸入 | 輸出 | USD | NT$ |
|---|---|---|---|---|
| 單次問答 | 2K | 1K | $0.0018 | NT$ 0.06 |
| 讀一份 50 頁文件並摘要 | 50K | 2K | $0.0174 | NT$ 0.55 |
| 每日 1,000 次客服對話 | 3K×1000 | 500×1000 | $1.50 | NT$ 47.3 |
| 餵滿 1M 上下文問一次 | 1M | 4K | $0.3048 | NT$ 9.60 |
快取讀取只要輸入價的 2%。重複前綴(system prompt、固定文件、few-shot 範例)的工作負載,把可快取的部分放在最前面能省下大部分輸入成本。
與同系列 deepseek-v4-flash 的差別
| v4-flash | v4.1-flash | |
|---|---|---|
| 上下文 | 1,048,576 | 1,048,576 |
| 圖片輸入 | ❌ | ✅ |
| 輸入 | $0.20/M | $0.30/M |
| 輸出 | $0.40/M | $1.20/M |
純文字任務 v4-flash 仍然便宜得多(輸出價只有三分之一),不要因為版本號比較新就整批換過去。DeepSeek 全系列(V4 Pro、V4 Flash、V3.2、R1)的台幣價目與三個場景試算,見 DeepSeek API 台幣費用試算。只有在你確實需要圖片輸入、或需要 v4.1 的推理品質時,多付的那部分才有意義。
怎麼呼叫
BazaarLink 是 OpenAI 相容介面,把 base URL 指過來、改模型名稱即可,既有程式碼不用改。
curl https://api.bazaarlink.ai/v1/chat/completions \
-H "Authorization: Bearer $BAZAARLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash",
"messages": [{"role": "user", "content": "把這份會議紀錄整理成三個決議事項"}],
"max_tokens": 2048
}'
圖片輸入用標準的 image_url 內容區塊:
{
"model": "deepseek-v4.1-flash",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "這張圖表的趨勢是什麼?"},
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}
]
}],
"max_tokens": 1024
}
⚠️ 一個實測踩到的坑:max_tokens 給太小會拿到空字串
這是推理模型,思考產生的 token 會算在輸出裡。我們上架驗證時用 max_tokens: 8 打了一筆,結果 8 個 token 全被思考用完,finish_reason 回 length、content 是空字串。
所以:max_tokens 要留足夠給「思考 + 回答」兩段,短回覆也建議至少幾百。要壓成本就用 reasoning_effort 控制思考長度,而不是把 max_tokens 調小 —— 後者只會讓你付了錢卻拿不到答案。
台幣計費與統一發票
BazaarLink 由台灣公司集聯科技有限公司營運,可開立台灣電子統一發票,二聯式與三聯式皆可,實際開立依所選付款渠道確認。用台幣儲值、以統編報帳,不需要海外信用卡或美金帳戶。
什麼時候該直連 DeepSeek 官方、什麼時候走轉接比較划算,見 為什麼台灣開發者用 BazaarLink 叫 DeepSeek;公司報帳的完整流程見 AI API 在台灣公司報帳完整指南。
FAQ
DeepSeek V4.1 Flash 一個月大概要多少錢?
以每天 1,000 次客服對話(每次輸入 3K、輸出 500 tokens)估算,一天約 $1.50(NT$ 47),一個月約 $45(NT$ 1,418)。若 system prompt 固定且命中快取,輸入部分只算 2% 價格,實際會更低。
它和 deepseek-v4-flash 差在哪裡?該用哪一個?
上下文都是 1,048,576 tokens,主要差別是 v4.1 支援圖片輸入,但輸出價是 $1.20/M、v4 只要 $0.40/M。純文字任務用 v4-flash 便宜得多;只有確實需要看圖、或需要 v4.1 的推理品質時,多付的部分才划算。
為什麼我拿到的回覆是空字串?
這是推理模型,思考產生的 token 會算進輸出。若 max_tokens 設得太小,額度可能全部被思考用完,finish_reason 回 length 而 content 是空的。請把 max_tokens 留足夠給思考加回答,要控制成本請改用 reasoning_effort,而不是調小 max_tokens。
支援哪些圖片輸入格式?怎麼傳?
用 OpenAI 相容的 image_url 內容區塊,在 messages 的 content 陣列裡混合 text 與 image_url 兩種區塊即可。輸出一律是文字,這個模型不生成圖片。
可以開統一發票嗎?
可以。BazaarLink 由台灣公司集聯科技有限公司營運,可開立台灣電子統一發票,二聯式與三聯式皆可,實際開立依所選付款渠道確認。以台幣儲值、用統編報帳,不需要海外信用卡。