Claude Haiku 5.5 vs DeepSeek・GLM・MiMo Flash 価格とAA指数
Claude Haiku 5.5 は入力 100 万トークンあたり $0.10 ですが、1 問あたりの出力量は多めです。DeepSeek V4.1 Flash・GLM-5.3-Flash・MiMo-V2.6-Flash と公式価格、Artificial Analysis の実測スコアを比較します。
調査日:2026 年 10 月 8 日(以下「10/08 時点」)。価格は各社の公式料金ページ、Intelligence Index と各ベンチマークのスコアは Artificial Analysis(以下 AA)のモデルページと比較ページ、BazaarLink の価格は公開モデルカタログ(/api/v1/models)から取得しています。価格・スコアはその後変更される可能性があるため、利用前に各ソースで確認してください。
Claude Haiku 5.5 は 10 月 7 日に公開され、入力は 100 万トークンあたり US$0.10 です。ただし低価格の小型モデルはこれだけではありません。DeepSeek V4.1 Flash、GLM-5.3-Flash、MiMo-V2.6-Flash も同じ価格帯にあります。この記事では 4 モデルの「価格」と「AA の実測能力」を 1 つの表にまとめ、単価が安くても総コストが安いとは限らない点を説明します。
結論
- 入力単価は Haiku 5.5 が最安ですが、適用されるのはプロンプトが 100K トークン以内の場合だけです。 100K トークンを超えると、入力・出力とも単価が 5 倍(US$0.50/US$2.50)になります。
- AA Intelligence Index:Haiku 5.5 は 43 点で 4 モデル中最高ですが、GLM-5.3-Flash(42)との差は 1 点です。 これは最大の推論強度(Max)での点数で、Medium では 34 点と他の 3 モデルを下回ります。
- 単価が安い=1 問あたりのコストが安い、ではありません。 Haiku 5.5(Max)は 1 問あたりの平均出力が約 162k トークンと 4 モデルで最多で、AA の実測では 1 問あたり平均 US$0.21。MiMo-V2.6-Flash は US$0.06 です。
- ターミナル/コーディングエージェント(Terminal-Bench 4.0)は Haiku 5.5 と GLM-5.3-Flash が同率最高(33%)。SaaS ワークフロー(AutomationBench-AA)は Haiku 5.5 が最低(35%)ですが、AA はこの数字が低く出ている可能性が高いとしています(理由は後述)。
価格比較(公式価格)
単位:米ドル、100 万トークンあたり。10/08 時点。「入力/出力/キャッシュヒット」の 3 列は各社の公式価格、右の 2 列は BazaarLink 価格です。
| モデル | 公式入力 | 公式出力 | 公式キャッシュヒット | BazaarLink 入力 | BazaarLink 出力 |
|---|---|---|---|---|---|
| Claude Haiku 5.5(プロンプト ≤100K) | 0.10 | 0.50 | 0.01 | 0.10 | 0.50 |
| Claude Haiku 5.5(プロンプト >100K) | 0.50 | 2.50 | 0.05 | 0.50 | 2.50 |
| DeepSeek V4.1 Flash(ピーク) | 0.30 | 1.20 | 0.006 | 0.30 | 1.20 |
| DeepSeek V4.1 Flash(オフピーク) | 0.15 | 0.60 | 0.003 | — | — |
| GLM-5.3-Flash | 0.15 | 0.50 | 0.03 | 0.15 | 0.50 |
| MiMo-V2.6-Flash | 0.14 | 0.28 | 0.0028 | 0.14 | 0.28 |
「—」は BazaarLink にその価格がないことを示します。
注意点:
- Haiku 5.5 はプロンプト長で 2 段階の価格です。 Anthropic の料金ページには「100,000 トークンを超えるプロンプト」に高い価格が適用されると明記されており、BazaarLink のカタログにも 100,000 トークン超の段階価格が登録されています。長い文書、長い会話、大量のツール出力ではこの境界を簡単に超えるため、実際のプロンプト長で試算してください。
- DeepSeek V4.1 Flash にはピーク/オフピーク価格があります。 公式料金ページによればオフピーク価格はピーク価格の半額で、ピーク時間は月〜金曜(中国の祝日を除く)の UTC 01:00–04:00 と 06:00–10:00(日本時間 10:00–13:00、15:00–19:00)です。BazaarLink のカタログ上の DeepSeek V4.1 Flash は単一価格で、数字は公式のピーク価格と同じです。
- GLM-5.3-Flash のキャッシュ保存は、Z.ai の料金ページで「期間限定無料」とされており、今後有料になる可能性があります。
- MiMo-V2.6-Flash は Xiaomi 公式のモデルページに人民元とドルの両方の価格があり、入力 ¥1、出力 ¥2、キャッシュヒット ¥0.02(100 万トークンあたり)です。ドル価格は上の表のとおりです。
- コンテキスト長:BazaarLink のカタログでは 4 モデルとも約 100 万トークン(MiMo-V2.6-Flash は 1,048,576)です。
Haiku 5.5 には 5 分キャッシュ書き込み US$0.125、1 時間キャッシュ書き込み US$0.20(プロンプト ≤100K、100 万トークンあたり)もありますが、他の 3 社の公式ページには同じ書き込み区分がないため、この表には書き込み価格を載せていません。
AA Intelligence Index と個別ベンチマーク
AA Intelligence Index(v4.3.2)は 10 の評価を総合したものです。AA のページでは Haiku 5.5 と DeepSeek V4.1 Flash に Max の推論強度が表示され、GLM-5.3-Flash と MiMo-V2.6-Flash には推論強度の表示がありません。10/08 時点:
| モデル | AA Intelligence Index | バー(1 マス ≈ 2 点) |
|---|---|---|
| 参考:Claude Sonnet 5.5 | 56 | ████████████████████████████ |
| Claude Haiku 5.5(Max) | 43 | █████████████████████▌ |
| GLM-5.3-Flash | 42 | █████████████████████ |
| DeepSeek V4.1 Flash(Max) | 39 | ███████████████████▌ |
| MiMo-V2.6-Flash | 38 | ███████████████████ |
| 参考:Claude Haiku 4.5(前世代) | 17 | ████████▌ |
Haiku 5.5 は前世代の Haiku 4.5 より 26 点高くなっています。Haiku 5.5 と GLM-5.3-Flash の差は 1 点で、明確な優劣とは読めません。
個別ベンチマーク(AA の実測。出力トークンは少ないほど節約、コストは AA が Intelligence Index を実行したときの平均):
| 項目 | Haiku 5.5(Max) | GLM-5.3-Flash | DeepSeek V4.1 Flash(Max) | MiMo-V2.6-Flash |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 33% | 33% | 27% | 23% |
| AA-Omniscience 指数 | 11 | 7 | −5 | −13 |
| AutomationBench-AA | 35%* | 60% | 69% | 64% |
| 1 問あたり平均出力トークン | 162k | 69k | 89k | 78k |
| 1 問あたり平均コスト | US$0.21 | US$0.25 | US$0.27 | US$0.06 |
- Terminal-Bench 4.0(ターミナル/コーディングエージェント、高いほど良い): AA の説明では、ソフトウェア・機械学習・科学などの分野にわたる複雑なターミナル作業 66 題です。
- AA-Omniscience(高いほど信頼できる): 指数の範囲は −100〜100。AA の説明は「正解を評価し、ハルシネーションにペナルティを与え、回答拒否にはペナルティなし」で、0 は正解と不正解が同数、マイナスは不正解のほうが多いことを意味します。
- AutomationBench-AA(SaaS ワークフロー、高いほど良い): シミュレートされた SaaS アプリ環境でエージェントがタスクを完了できた割合を測るもので、ガードレール違反のタスクは得点になりません。
* AA の注記: Haiku 5.5 の AutomationBench-AA 35% は低く出ている可能性が高いとされています。AA によると、公開前のテストでセーフティ拒否の問題によりモデルが過剰に拒否したためです。Anthropic が修正に取り組んでおり、AA は修正後に再実行して、スコアが上がると見込んでいます(AA の X への投稿の内容を、メディアの OfficeChai が伝えたものです)。再実行されるまで、この欄を他の 3 モデルとの比較に使うのは適切ではありません。
単価と総コストは別:1 問あたりのコスト
AA は同じ Intelligence Index の問題で、モデルごとの 1 問あたり平均出力量とコストを集計しています。
| モデル | 出力単価(100 万あたり) | 1 問あたり出力トークン | 1 問あたり平均コスト |
|---|---|---|---|
| Claude Haiku 5.5(Max) | US$0.50 | 162k | US$0.21 |
| DeepSeek V4.1 Flash(Max) | US$1.20(ピーク) | 89k | US$0.27 |
| GLM-5.3-Flash | US$0.50 | 69k | US$0.25 |
| MiMo-V2.6-Flash | US$0.28 | 78k | US$0.06 |
Haiku 5.5 の出力単価は GLM-5.3-Flash と同じですが、Max では 1 問あたり約 2.3 倍のトークンを出力するため、単価の優位の一部が相殺されます。MiMo-V2.6-Flash は単価も出力量も低く、1 問あたりのコストが最小です。実際のコストはピーク/オフピーク、キャッシュヒット率、プロンプト長によって変わります。
Haiku 5.5 は推論強度で点数もコストも変わる
Haiku 5.5 は推論強度を選べ、BazaarLink のカタログ上のデフォルトは medium です。AA は強度ごとに採点しています。
| 推論強度 | AA Intelligence Index | 1 問あたり平均コスト |
|---|---|---|
| Max | 43 | US$0.21 |
| High | 38 | US$0.08 |
| Medium | 34 | US$0.05 |
| Low | 29 | US$0.02 |
つまり「Haiku 5.5 は 43 点」は Max の話で、デフォルトの medium では AA の点数は 34 点。GLM-5.3-Flash(42)、DeepSeek V4.1 Flash(39)、MiMo-V2.6-Flash(38)を下回りますが、1 問あたりのコストもかなり低くなります。4 モデルを比べるときは推論強度を固定し、自分のタスクで検証してください。
どれを選ぶか
- プロンプトが主に 100K トークン以内で、この 4 つの中で AA の点数が最も高いものがほしい: Haiku 5.5(Max)。1 問あたりの出力量が多い点を許容できるか先に確認してください。
- 1 問あたりのコスト優先: AA のコストでは MiMo-V2.6-Flash が最安。AutomationBench-AA は 64%、Terminal-Bench 4.0 は 23% です。
- SaaS 自動化のようなワークフロー系タスク: 現時点の AA の AutomationBench-AA では DeepSeek V4.1 Flash が最高(69%)、MiMo-V2.6-Flash が 64%、GLM-5.3-Flash が 60%。Haiku 5.5 の数字は AA の再実行まで参考にしないでください。
- 長いプロンプト(100K トークン超)が多い: Haiku 5.5 は価格が 5 倍(入力 US$0.50、出力 US$2.50)になり、この 4 つの中で最安ではなくなります。他の 3 モデルにはこの段階料金はありません。
以上は AA の特定のベンチマーク構成と公式価格に基づくもので、あなたのタスクでの結果を保証するものではありません。代表的なタスクを選び、推論強度を固定して並べて検証してから決めてください。
BazaarLink でまとめて試す
4 モデルとも同じ OpenAI 互換エンドポイントで呼び出せ、model を変えるだけです。
for MODEL in claude-haiku-5.5 deepseek-v4.1-flash glm-5.3-flash mimo-v2.6-flash; do
curl -s https://bazaarlink.ai/api/v1/chat/completions \
-H "Authorization: Bearer $BAZAARLINK_API_KEY" \
-H "Content-Type: application/json" \
-d "{\"model\": \"$MODEL\", \"messages\": [{\"role\": \"user\", \"content\": \"プロンプトキャッシュとは何かを 3 文で説明してください。\"}]}"
done
最新の単価と仕様は BazaarLink モデルカタログ をご覧ください。Haiku 4.5 からの移行を検討している場合は、Claude Haiku 4.5 から 5.5 へ切り替えるべきかもあわせてどうぞ。
よくある質問
Haiku 5.5 の AA Intelligence Index 43 はどの設定ですか? Max の推論強度です。AA は強度ごとに採点しており、Max 43、High 38、Medium 34、Low 29 です。
Haiku 5.5 の AutomationBench-AA はなぜ 35% なのですか? AA は、公開前のテストでのセーフティ拒否の問題によりモデルが過剰に拒否したため、この数字は低く出ている可能性が高いとしています。Anthropic が修正中で、AA は修正後に再実行する予定です。
BazaarLink の DeepSeek V4.1 Flash にピーク/オフピーク価格はありますか? BazaarLink のカタログでは単一価格で、入力 US$0.30、出力 US$1.20 と、公式のピーク価格と同じです。公式 API のオフピーク価格はピークの半額です。
プロンプトが 100K トークンを超えるとどうなりますか? Haiku 5.5 は 100,000 トークンを超えるプロンプトで、入力・出力とも単価が 5 倍(US$0.50/US$2.50)になります。他の 3 モデルにはこの段階料金はありません。
これらのスコアは自分のタスクの結果を表しますか? そのままは表しません。AA の指数は AA 独自のベンチマーク構成です。自分のデータで並べて検証してください。
出典:Anthropic 料金ページ、DeepSeek 料金ページ、Z.ai 料金ページ、Xiaomi MiMo-V2.6-Flash モデルページ、AA の比較ページ Haiku 5.5 vs GLM-5.3-Flash・vs DeepSeek V4.1 Flash・vs MiMo-V2.6-Flash、AA の Haiku 5.5(Max)・High・Medium・Low・Haiku 5.5 リリースページ。調査日 2026 年 10 月 8 日。