MiMo V2.6 Flash 與 Pro API 價格與規格:台灣開發者 2026
Bottom line up front: MiMo V2.6 Flash 的 input $0.14/1M tokens(約 NT$4.45),Pro 為 $0.435(約 NT$13.81);兩者都是 1,048,576-token context,支援文字、圖片、影片與音訊輸入。本文用 USD/NTD 31.75(未稅、2026-09-22)試算兩種月用量,並附相容 API 範例;Pro 的 AA Intelligence Index 為 46.3,Flash 尚未收錄。
MiMo V2.6 Flash 與 Pro API 價格與規格:台灣開發者 2026
查詢日:2026-09-22(台北時間)
資料來源:BazaarLink 公開模型目錄、/api/v1/models與客戶價格資料。
匯率:1 USD = NT$31.75;取 BazaarLink/models模型詳情頁當日顯示的 USD/NTD 匯率,未稅,更新於 2026/09/22。
BazaarLink 現已上架 MiMo V2.6 Flash 與 MiMo V2.6 Pro。/api/v1/models 實際回傳的公開 API ID 分別是 mimo-v2.6-flash 與 mimo-v2.6-pro;兩者都有 1,048,576-token context window(約 1M tokens),支援文字、圖片、影片、音訊輸入,輸出為文字。
Bottom line up front: 如果你要的是接近 1M tokens 的長上下文與多模態輸入,MiMo V2.6 Flash 是較低價的起點:input $0.14/1M tokens(約 NT$4.45),output $0.28(約 NT$8.89);MiMo V2.6 Pro 為 input $0.435(約 NT$13.81)、output $0.87(約 NT$27.62)。兩者 context window 都是 1,048,576 tokens;Pro 的 AA Intelligence Index 為 46.3,而 Flash 目前尚未收錄分數。
第三方評測:Artificial Analysis Intelligence Index
(資料源自 Artificial Analysis 模型頁,查詢時間 2026-09-22)
| 模型 | Intelligence Index |
|---|---|
| MiMo V2.6 Flash | AA 目前尚未收錄這個型號的分數(查詢時間 2026-09-22) |
| MiMo V2.6 Pro | 46.3 |
Flash 的分數目前沒有可引用的 AA 型號資料;這裡明確標示未收錄,不把缺少資料解讀成性能預測。Pro 的 46.3 只是一個公開評測參考,實際效果仍應用自己的 prompt、模態與工作流程驗證。
規格摘要
| 項目 | MiMo V2.6 Flash | MiMo V2.6 Pro |
|---|---|---|
| 公開 API ID | mimo-v2.6-flash | mimo-v2.6-pro |
| Context window | 1,048,576 tokens(約 1M) | 1,048,576 tokens(約 1M) |
| 輸入模態 | 文字、圖片、影片、音訊 | 文字、圖片、影片、音訊 |
| 輸出模態 | 文字 | 文字 |
| 推理 | 支援 | 支援 |
| 公開模型目錄 | /api/v1/models 可查 | /api/v1/models 可查 |
客戶價格
以下價格都是每 1M tokens;NT$ 欄位以 USD × 31.75 計算,四捨五入至小數點後兩位。
| 模型 | Input USD | Input NT$ | Output USD | Output NT$ | Cache read USD | Cache read NT$ |
|---|---|---|---|---|---|---|
| MiMo V2.6 Flash | $0.14 | NT$4.45 | $0.28 | NT$8.89 | $0.0028 | NT$0.09 |
| MiMo V2.6 Pro | $0.435 | NT$13.81 | $0.87 | NT$27.62 | $0.0036 | NT$0.11 |
Cache read 是快取讀取用量的單價;本文的月費情境只計 input 與 output,沒有假設任何快取命中。若固定 system prompt、長文件或 few-shot 前綴會重複出現,請把快取讀取量獨立記錄,不要把它和一般 input 混成一個平均單價。
價格與台幣試算
以下兩個情境都以每次請求的實際 input、output tokens 計算,沒有把 1M context 當成每次都會自動填滿。NT$ 以 USD × 31.75 換算,未稅,四捨五入至小數點後兩位。
| 情境 | MiMo V2.6 Flash | MiMo V2.6 Pro |
|---|---|---|
| 情境一:每月 1,000 次 × 100k input + 2k output | $14.56/NT$462.28 | $45.24/NT$1,436.37 |
| 情境二:每月 50 次 × 800k input + 5k output | $5.67/NT$180.02 | $17.6175/NT$559.36 |
情境一:一般長文件工作流
每月 1,000 次、每次 100,000 input + 2,000 output:
情境二:接近 1M context 的長文工作流
每月 50 次、每次 800,000 input + 5,000 output。800k 已經接近 1M context,但仍未達 1,048,576-token 上限:
這兩個情境都不含 cache read;如果其中一部分 input 命中快取,應把命中 token 改用對應的 cache read 單價計算。實際帳單仍以每次請求回傳的 usage 為準。
相容 API 呼叫範例
下面範例使用 BazaarLink 的 /v1 base URL 與 /api/v1/models 實際回傳的短 model ID。BAZAARLINK_API_KEY 請放在環境變數,不要把真實金鑰寫進程式碼。
文字請求可以直接使用 mimo-v2.6-flash:
curl https://api.bazaarlink.ai/v1/chat/completions \
-H "Authorization: Bearer $BAZAARLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-flash",
"messages": [
{"role": "user", "content": "請把這份長文件整理成三個決策重點"}
],
"max_tokens": 2048
}'
Python 也只需要把 base URL 指向同一個 /v1 入口;這個例子使用 Pro:
import os
import requests
response = requests.post(
"https://api.bazaarlink.ai/v1/chat/completions",
headers={
"Authorization": f"Bearer {os.environ['BAZAARLINK_API_KEY']}",
"Content-Type": "application/json",
},
json={
"model": "mimo-v2.6-pro",
"messages": [{"role": "user", "content": "用繁體中文摘要這段文字"}],
"max_tokens": 2048,
},
)
response.raise_for_status()
print(response.json()["choices"][0]["message"]["content"])
多模態請求可以在同一個 content 陣列混合文字與 image_url。以下使用圖片 URL,輸出仍然是文字:
curl https://api.bazaarlink.ai/v1/chat/completions \
-H "Authorization: Bearer $BAZAARLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-flash",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "請說明這張圖表的主要趨勢"},
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}
]
}],
"max_tokens": 1024
}'
同樣的圖片內容也可以用 Python 傳送:
import os
import requests
payload = {
"model": "mimo-v2.6-pro",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "請讀取圖片並列出三個重點"},
{"type": "image_url", "image_url": {"url": "https://example.com/report.png"}}
]
}],
"max_tokens": 1024,
}
response = requests.post(
"https://api.bazaarlink.ai/v1/chat/completions",
headers={
"Authorization": f"Bearer {os.environ['BAZAARLINK_API_KEY']}",
"Content-Type": "application/json",
},
json=payload,
)
response.raise_for_status()
print(response.json()["choices"][0]["message"]["content"])
怎麼選
- 如果你重視價格,同時需要 1,048,576-token context 與多模態輸入,先用 MiMo V2.6 Flash 做小量對照。
- 如果你要把品質、推理與長文任務放在同一個工作流,且能接受較高的 input/output 單價,再比較 MiMo V2.6 Pro。
- 如果你的固定前綴會重複出現,先觀察 cache read 命中量;不要只用 context window 的最大值估算月費。
- 如果你的請求常常接近 1M tokens,請同時檢查輸出上限與實際 usage,因為 context window 是上限,不是固定扣款。
FAQ
MiMo V2.6 Flash 與 Pro 在 /api/v1/models 回傳的 model ID 是什麼?
目前公開 API 實際回傳的 id 是 mimo-v2.6-flash 與 mimo-v2.6-pro;兩者都是可直接放進 model 欄位的公開 ID。呼叫時以 /api/v1/models 回傳值為準。
兩個模型的 context window 多大?
兩者都是 1,048,576 tokens,約 1M tokens。這是單次請求可容納的上下文上限,不是每月額度,也不表示每次請求都會用滿。
兩個模型支援哪些輸入與輸出?
兩者都支援文字、圖片、影片、音訊輸入,輸出為文字。圖片可以用 image_url 內容區塊傳入;輸出不會是圖片。
MiMo V2.6 Flash 的客戶價格是多少?
每 1M tokens:input $0.14(約 NT$4.45)、output $0.28(約 NT$8.89)、cache read $0.0028(約 NT$0.09)。匯率是 1 USD = NT$31.75,未稅,更新於 2026-09-22。
MiMo V2.6 Pro 的客戶價格與 AA Intelligence Index 是多少?
每 1M tokens:input $0.435(約 NT$13.81)、output $0.87(約 NT$27.62)、cache read $0.0036(約 NT$0.11)。AA Intelligence Index 為 46.3;Flash 則是「AA 目前尚未收錄這個型號的分數」(查詢時間 2026-09-22)。
1M context 一次請求會用滿嗎?怎麼算費用?
不會自動用滿。1,048,576 是單次請求的 context window 上限,實際費用看 usage 裡真正的 input/output tokens;例如 800k input + 5k output 是 0.8M input + 0.005M output,Flash 為 $0.1134(約 NT$3.60),Pro 為 $0.35235(約 NT$11.18),再依實際快取命中量另算 cache read。
來源與查詢紀錄
- 公開模型 API:
GET /api/v1/models?output_modalities=all,查詢日 2026-09-22;回傳mimo-v2.6-flash與mimo-v2.6-pro,context length 均為 1,048,576,輸入模態含 image、video、audio,輸出為 text。 - 匯率與價格:BazaarLink
/models模型詳情頁顯示USD/NTD = 31.75、未稅、更新於 2026/09/22;Flash input/output/cache read 為 $0.14/$0.28/$0.0028,Pro 為 $0.435/$0.87/$0.0036。 - Artificial Analysis:MiMo V2.6 Pro 的 Intelligence Index 為 46.3;Flash 於查詢時間 2026-09-22 目前尚未收錄這個型號的分數。
相關文章: