BazaarLinkBazaarLink
ログイン
← すべての記事
公開日 2026-10-08 · · 著者:BazaarLink · Claude Haiku 5.5 · DeepSeek V4.1 Flash · GLM-5.3-Flash · MiMo-V2.6-Flash · モデル比較 · 料金

Claude Haiku 5.5 vs DeepSeek・GLM・MiMo Flash 価格とAA指数

Claude Haiku 5.5 は入力 100 万トークンあたり $0.10 ですが、1 問あたりの出力量は多めです。DeepSeek V4.1 Flash・GLM-5.3-Flash・MiMo-V2.6-Flash と公式価格、Artificial Analysis の実測スコアを比較します。

調査日:2026 年 10 月 8 日(以下「10/08 時点」)。価格は各社の公式料金ページ、Intelligence Index と各ベンチマークのスコアは Artificial Analysis(以下 AA)のモデルページと比較ページ、BazaarLink の価格は公開モデルカタログ(/api/v1/models)から取得しています。価格・スコアはその後変更される可能性があるため、利用前に各ソースで確認してください。

Claude Haiku 5.5 は 10 月 7 日に公開され、入力は 100 万トークンあたり US$0.10 です。ただし低価格の小型モデルはこれだけではありません。DeepSeek V4.1 Flash、GLM-5.3-Flash、MiMo-V2.6-Flash も同じ価格帯にあります。この記事では 4 モデルの「価格」と「AA の実測能力」を 1 つの表にまとめ、単価が安くても総コストが安いとは限らない点を説明します。

結論

  • 入力単価は Haiku 5.5 が最安ですが、適用されるのはプロンプトが 100K トークン以内の場合だけです。 100K トークンを超えると、入力・出力とも単価が 5 倍(US$0.50/US$2.50)になります。
  • AA Intelligence Index:Haiku 5.5 は 43 点で 4 モデル中最高ですが、GLM-5.3-Flash(42)との差は 1 点です。 これは最大の推論強度(Max)での点数で、Medium では 34 点と他の 3 モデルを下回ります。
  • 単価が安い=1 問あたりのコストが安い、ではありません。 Haiku 5.5(Max)は 1 問あたりの平均出力が約 162k トークンと 4 モデルで最多で、AA の実測では 1 問あたり平均 US$0.21。MiMo-V2.6-Flash は US$0.06 です。
  • ターミナル/コーディングエージェント(Terminal-Bench 4.0)は Haiku 5.5 と GLM-5.3-Flash が同率最高(33%)。SaaS ワークフロー(AutomationBench-AA)は Haiku 5.5 が最低(35%)ですが、AA はこの数字が低く出ている可能性が高いとしています(理由は後述)。

価格比較(公式価格)

単位:米ドル、100 万トークンあたり。10/08 時点。「入力/出力/キャッシュヒット」の 3 列は各社の公式価格、右の 2 列は BazaarLink 価格です。

モデル公式入力公式出力公式キャッシュヒットBazaarLink 入力BazaarLink 出力
Claude Haiku 5.5(プロンプト ≤100K)0.100.500.010.100.50
Claude Haiku 5.5(プロンプト >100K)0.502.500.050.502.50
DeepSeek V4.1 Flash(ピーク)0.301.200.0060.301.20
DeepSeek V4.1 Flash(オフピーク)0.150.600.003——
GLM-5.3-Flash0.150.500.030.150.50
MiMo-V2.6-Flash0.140.280.00280.140.28

「—」は BazaarLink にその価格がないことを示します。

注意点:

  • Haiku 5.5 はプロンプト長で 2 段階の価格です。 Anthropic の料金ページには「100,000 トークンを超えるプロンプト」に高い価格が適用されると明記されており、BazaarLink のカタログにも 100,000 トークン超の段階価格が登録されています。長い文書、長い会話、大量のツール出力ではこの境界を簡単に超えるため、実際のプロンプト長で試算してください。
  • DeepSeek V4.1 Flash にはピーク/オフピーク価格があります。 公式料金ページによればオフピーク価格はピーク価格の半額で、ピーク時間は月〜金曜(中国の祝日を除く)の UTC 01:00–04:00 と 06:00–10:00(日本時間 10:00–13:00、15:00–19:00)です。BazaarLink のカタログ上の DeepSeek V4.1 Flash は単一価格で、数字は公式のピーク価格と同じです。
  • GLM-5.3-Flash のキャッシュ保存は、Z.ai の料金ページで「期間限定無料」とされており、今後有料になる可能性があります。
  • MiMo-V2.6-Flash は Xiaomi 公式のモデルページに人民元とドルの両方の価格があり、入力 ¥1、出力 ¥2、キャッシュヒット ¥0.02(100 万トークンあたり)です。ドル価格は上の表のとおりです。
  • コンテキスト長:BazaarLink のカタログでは 4 モデルとも約 100 万トークン(MiMo-V2.6-Flash は 1,048,576)です。

Haiku 5.5 には 5 分キャッシュ書き込み US$0.125、1 時間キャッシュ書き込み US$0.20(プロンプト ≤100K、100 万トークンあたり)もありますが、他の 3 社の公式ページには同じ書き込み区分がないため、この表には書き込み価格を載せていません。

AA Intelligence Index と個別ベンチマーク

AA Intelligence Index(v4.3.2)は 10 の評価を総合したものです。AA のページでは Haiku 5.5 と DeepSeek V4.1 Flash に Max の推論強度が表示され、GLM-5.3-Flash と MiMo-V2.6-Flash には推論強度の表示がありません。10/08 時点:

モデルAA Intelligence Indexバー(1 マス ≈ 2 点)
参考:Claude Sonnet 5.556████████████████████████████
Claude Haiku 5.5(Max)43█████████████████████▌
GLM-5.3-Flash42█████████████████████
DeepSeek V4.1 Flash(Max)39███████████████████▌
MiMo-V2.6-Flash38███████████████████
参考:Claude Haiku 4.5(前世代)17████████▌

Haiku 5.5 は前世代の Haiku 4.5 より 26 点高くなっています。Haiku 5.5 と GLM-5.3-Flash の差は 1 点で、明確な優劣とは読めません。

個別ベンチマーク(AA の実測。出力トークンは少ないほど節約、コストは AA が Intelligence Index を実行したときの平均):

項目Haiku 5.5(Max)GLM-5.3-FlashDeepSeek V4.1 Flash(Max)MiMo-V2.6-Flash
Terminal-Bench 4.033%33%27%23%
AA-Omniscience 指数117−5−13
AutomationBench-AA35%*60%69%64%
1 問あたり平均出力トークン162k69k89k78k
1 問あたり平均コストUS$0.21US$0.25US$0.27US$0.06
  • Terminal-Bench 4.0(ターミナル/コーディングエージェント、高いほど良い): AA の説明では、ソフトウェア・機械学習・科学などの分野にわたる複雑なターミナル作業 66 題です。
  • AA-Omniscience(高いほど信頼できる): 指数の範囲は −100〜100。AA の説明は「正解を評価し、ハルシネーションにペナルティを与え、回答拒否にはペナルティなし」で、0 は正解と不正解が同数、マイナスは不正解のほうが多いことを意味します。
  • AutomationBench-AA(SaaS ワークフロー、高いほど良い): シミュレートされた SaaS アプリ環境でエージェントがタスクを完了できた割合を測るもので、ガードレール違反のタスクは得点になりません。

* AA の注記: Haiku 5.5 の AutomationBench-AA 35% は低く出ている可能性が高いとされています。AA によると、公開前のテストでセーフティ拒否の問題によりモデルが過剰に拒否したためです。Anthropic が修正に取り組んでおり、AA は修正後に再実行して、スコアが上がると見込んでいます(AA の X への投稿の内容を、メディアの OfficeChai が伝えたものです)。再実行されるまで、この欄を他の 3 モデルとの比較に使うのは適切ではありません。

単価と総コストは別:1 問あたりのコスト

AA は同じ Intelligence Index の問題で、モデルごとの 1 問あたり平均出力量とコストを集計しています。

モデル出力単価(100 万あたり)1 問あたり出力トークン1 問あたり平均コスト
Claude Haiku 5.5(Max)US$0.50162kUS$0.21
DeepSeek V4.1 Flash(Max)US$1.20(ピーク)89kUS$0.27
GLM-5.3-FlashUS$0.5069kUS$0.25
MiMo-V2.6-FlashUS$0.2878kUS$0.06

Haiku 5.5 の出力単価は GLM-5.3-Flash と同じですが、Max では 1 問あたり約 2.3 倍のトークンを出力するため、単価の優位の一部が相殺されます。MiMo-V2.6-Flash は単価も出力量も低く、1 問あたりのコストが最小です。実際のコストはピーク/オフピーク、キャッシュヒット率、プロンプト長によって変わります。

Haiku 5.5 は推論強度で点数もコストも変わる

Haiku 5.5 は推論強度を選べ、BazaarLink のカタログ上のデフォルトは medium です。AA は強度ごとに採点しています。

推論強度AA Intelligence Index1 問あたり平均コスト
Max43US$0.21
High38US$0.08
Medium34US$0.05
Low29US$0.02

つまり「Haiku 5.5 は 43 点」は Max の話で、デフォルトの medium では AA の点数は 34 点。GLM-5.3-Flash(42)、DeepSeek V4.1 Flash(39)、MiMo-V2.6-Flash(38)を下回りますが、1 問あたりのコストもかなり低くなります。4 モデルを比べるときは推論強度を固定し、自分のタスクで検証してください。

どれを選ぶか

  • プロンプトが主に 100K トークン以内で、この 4 つの中で AA の点数が最も高いものがほしい: Haiku 5.5(Max)。1 問あたりの出力量が多い点を許容できるか先に確認してください。
  • 1 問あたりのコスト優先: AA のコストでは MiMo-V2.6-Flash が最安。AutomationBench-AA は 64%、Terminal-Bench 4.0 は 23% です。
  • SaaS 自動化のようなワークフロー系タスク: 現時点の AA の AutomationBench-AA では DeepSeek V4.1 Flash が最高(69%)、MiMo-V2.6-Flash が 64%、GLM-5.3-Flash が 60%。Haiku 5.5 の数字は AA の再実行まで参考にしないでください。
  • 長いプロンプト(100K トークン超)が多い: Haiku 5.5 は価格が 5 倍(入力 US$0.50、出力 US$2.50)になり、この 4 つの中で最安ではなくなります。他の 3 モデルにはこの段階料金はありません。

以上は AA の特定のベンチマーク構成と公式価格に基づくもので、あなたのタスクでの結果を保証するものではありません。代表的なタスクを選び、推論強度を固定して並べて検証してから決めてください。

4 モデルとも同じ OpenAI 互換エンドポイントで呼び出せ、model を変えるだけです。

for MODEL in claude-haiku-5.5 deepseek-v4.1-flash glm-5.3-flash mimo-v2.6-flash; do
  curl -s https://bazaarlink.ai/api/v1/chat/completions \
    -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
    -H "Content-Type: application/json" \
    -d "{\"model\": \"$MODEL\", \"messages\": [{\"role\": \"user\", \"content\": \"プロンプトキャッシュとは何かを 3 文で説明してください。\"}]}"
done

最新の単価と仕様は BazaarLink モデルカタログ をご覧ください。Haiku 4.5 からの移行を検討している場合は、Claude Haiku 4.5 から 5.5 へ切り替えるべきかもあわせてどうぞ。

よくある質問

Haiku 5.5 の AA Intelligence Index 43 はどの設定ですか? Max の推論強度です。AA は強度ごとに採点しており、Max 43、High 38、Medium 34、Low 29 です。

Haiku 5.5 の AutomationBench-AA はなぜ 35% なのですか? AA は、公開前のテストでのセーフティ拒否の問題によりモデルが過剰に拒否したため、この数字は低く出ている可能性が高いとしています。Anthropic が修正中で、AA は修正後に再実行する予定です。

BazaarLink の DeepSeek V4.1 Flash にピーク/オフピーク価格はありますか? BazaarLink のカタログでは単一価格で、入力 US$0.30、出力 US$1.20 と、公式のピーク価格と同じです。公式 API のオフピーク価格はピークの半額です。

プロンプトが 100K トークンを超えるとどうなりますか? Haiku 5.5 は 100,000 トークンを超えるプロンプトで、入力・出力とも単価が 5 倍(US$0.50/US$2.50)になります。他の 3 モデルにはこの段階料金はありません。

これらのスコアは自分のタスクの結果を表しますか? そのままは表しません。AA の指数は AA 独自のベンチマーク構成です。自分のデータで並べて検証してください。


出典:Anthropic 料金ページ、DeepSeek 料金ページ、Z.ai 料金ページ、Xiaomi MiMo-V2.6-Flash モデルページ、AA の比較ページ Haiku 5.5 vs GLM-5.3-Flash・vs DeepSeek V4.1 Flash・vs MiMo-V2.6-Flash、AA の Haiku 5.5(Max)・High・Medium・Low・Haiku 5.5 リリースページ。調査日 2026 年 10 月 8 日。

BazaarLink を試す

台湾ドル決済・統一発票・主要 AI モデル・OpenAI 互換 API

無料で登録 / ログイン法人のお問い合わせ
関連記事
Gemini 4 Argon · Vending-Bench 2 · AIエージェント · Andon Labs · エージェントの安全性
Gemini 4 Argon、Vending-Bench 2で3位に。ただし供給元への虚偽を指摘
Claude · Sonnet 5.5 · Sonnet 5 · Anthropic · API移行
Sonnet 5.5は公式で30%高速・30%低コスト?移行前に直すAPI
Claude · Sonnet 5.5 · Sonnet 5 · モデル比較 · 料金
Claude Sonnet 5から5.5へ乗り換える?同価格の仕様と円換算
サポート
サポート
こんにちは。どのようなご用件でしょうか?
メッセージをお送りください。担当者より返信します。