【2026年版】AI API 料金比較 — GPT・Claude・Gemini・DeepSeek の単価と無料枠を実データで
GPT-5.6、Claude、Gemini、DeepSeek の API 料金を 100 万トークンあたりの単価で比較。無料枠の実際の上限、月額の試算、利用還元の適用条件まで、2026-09-14 時点の実データで整理しました。
AI API の料金を比較しようとすると、ベンダーごとに表記がばらばらで、**同じ土俵に並べた表がなかなか見つかりません。**この記事は 2026-09-14 時点の実際の課金単価を、100 万トークンあたりの USD で一枚に並べたものです。
前提:課金は USD 建てです。本記事では換算レートを固定して書くと古くなるため、円換算は載せていません。ご利用時のレートでご確認ください。
料金一覧(USD / 100万トークン)
| モデル | 入力 | 出力 | 位置づけ |
|---|---|---|---|
deepseek-v4-flash | $0.20 | $0.40 | 最安クラス。大量バッチ向け |
gpt-5.6-luna | $0.20 | $1.20 | GPT 系の軽量枠 |
gemini-3.5-flash-lite | $0.30 | $2.50 | 分類・要約の常用枠 |
gemini-3.8-flash | $0.75 | $3.75 | Gemini の主力 |
claude-haiku-4.5 | $1.00 | $5.00 | Claude の軽量枠 |
claude-sonnet-5 | $2.00 | $10.00 | Claude の主力 |
gpt-5.6-sol | $2.00 | $10.00 | GPT の主力 |
gpt-5.6-terra | $2.00 | $12.00 | 出力単価が高め |
gemini-3.1-pro-preview | $2.00 | $12.00 | 長文脈向け |
deepseek-v4-pro | $2.40 | $4.80 | 出力が安い。生成量が多い用途に強い |
claude-opus-4.8 | $5.00 | $25.00 | 最上位 |
gpt-6-astra | $10.00 | $50.00 | 最上位 |
この表から読み取れること
- 主力どうし(
claude-sonnet-5とgpt-5.6-sol)は $2/$10 で完全に同額です。料金で選べないので、品質とレイテンシで選ぶことになります。 deepseek-v4-proは入力が $2.40 と主力級なのに、出力が $4.80 と半額以下です。出力トークンが多い用途(長文生成、思考過程を出す推論)では効き方が大きく変わります。- 最上位と最安の差は入力で 50 倍、出力で 125 倍あります。モデル選定はどの機能よりもコストに効きます。
出力単価のほうが効く、という話
料金比較でよくある間違いが、入力単価だけを見ることです。ほとんどのモデルで 出力は入力の 5 倍前後、gemini-3.5-flash-lite に至っては 8 倍以上あります。
つまり、
- 長い文書を読ませて短く答えさせる用途(要約、分類、抽出)は入力が支配的
- 短く聞いて長く書かせる用途(記事生成、コード生成、推論の過程を出すモデル)は出力が支配的
自分のワークロードがどちらかを先に決めてから表を見ないと、安いはずのモデルで高くつきます。
月額の試算
ケース1:カスタマーサポート Bot(1日500会話)
1会話あたり3ターン、1ターン 入力300 / 出力150 トークンとすると、月45,000ターン = 入力 13.5M / 出力 6.75M トークン。
| モデル | 月額 |
|---|---|
deepseek-v4-flash | 約 $5.4 |
gemini-3.8-flash | 約 $35.4 |
claude-sonnet-5 | 約 $94.5 |
gpt-5.6-terra | 約 $108 |
同じ仕事で 20 倍の開きがあります。品質検証さえ通れば、ここが一番大きな削減余地です。
ケース2:文書バッチ処理(1日100件)
1件 約6,500トークンを読み、800トークンの要約を出す。月 入力 19.5M / 出力 2.4M トークン。
| モデル | 月額 |
|---|---|
deepseek-v4-flash | 約 $4.9 |
gpt-5.6-luna | 約 $6.8 |
gemini-3.5-flash-lite | 約 $11.9 |
claude-haiku-4.5 | 約 $31.5 |
この規模だと月額が 2 桁 USD に収まります。分類・要約に最上位モデルを使う理由はほとんどありません。
無料枠の実際
「無料枠」で検索すると各社の案内が出てきますが、条件はかなり違います。BazaarLink の無料枠は次のとおりです。
- 対象モデル:Qwen3.7 Flash(無料)
- 1分あたり10リクエスト、1日あたり50リクエスト
- クレジットカード不要
- 残高がある場合は上限が 2 倍
**これは「クレジットを配る」仕組みではありません。**特定モデルへの無料アクセスに回数制限がついたものです。動作確認、プロンプトの調整、CI での疎通テストには十分ですが、本番トラフィックを無料枠で賄う設計にはなっていません。
各社の無料枠には、期限切れ、既存有料契約者限定、クレジットカード必須といった条件がついていることがあります。**無料枠を渡り歩くより、本番に乗せたときの月額を先に見積もるほうが早いです。**上の試算表がその材料です。
利用還元(使うほど戻る仕組み)
対象となる有料利用には、残高としての還元があります。割引率ではなく、月間の対象消費が各しきい値を超えるたびに固定額が出る方式です。到達したしきい値はすべて加算されます。
| 月間の対象消費が超えると | OpenAI GPT / Gemini | DeepSeek |
|---|---|---|
| $20 | + $2 | + $4 |
| $50 | + $3 | + $6 |
| $100 | + $5 | + $10 |
| $200 | + $10 | + $20 |
| $500 | + $30 | + $60 |
| $500 を超えた分 | さらに 10% | さらに 20% |
**実質の還元率は一定ではありません。**しきい値ちょうどで最大になり、しきい値の間では薄まります。
| 月間の対象消費 | 還元 | 実質 |
|---|---|---|
| $19 | $0 | なし(最初のしきい値が $20) |
| $49 | $2 | 約 4.1% |
| $100 | $10 | 10% |
| $199 | $10 | 約 5.0% |
| $500 | $50 | 10% |
| $1,000 | $100 | 10% |
つまり **$500 以上で 10%(DeepSeek は 20%)に安定し、$20 未満では還元はありません。**上のケース2のような月額 1 桁 USD の使い方では、還元は考慮する意味がありません。単価で選んでください。
無料枠の利用、BYOK(自分のベンダーキー)の利用、サブスクリプションポイントで支払った利用は対象外です。UTC の暦月で締め、毎月リセットされます(繰り越しはありません)。規則と対象モデルの一覧は利用還元のページにあります。
自分のベンダーキーを使う場合
すでにベンダーと直接契約している、あるいはクレジットが残っている場合は、BYOK で自分の API キーを登録できます。そのキーが対象とするモデルの利用はベンダー側で、あなたのアカウントに、あなたの単価で課金されます。ルーティングやフェイルオーバー、キーごとの上限管理だけを利用する形です。ただし前述のとおり、BYOK の利用は還元の対象外です。
使い方
API は OpenAI 互換なので、環境変数を 2 つ変えるだけで動きます。
export OPENAI_API_KEY=sk-bl-YOUR_KEY
export OPENAI_BASE_URL=https://api.bazaarlink.ai/v1
from openai import OpenAI
client = OpenAI(base_url='https://api.bazaarlink.ai/v1', api_key='sk-bl-YOUR_KEY')
resp = client.chat.completions.create(
model='gemini-3.8-flash',
messages=[{'role': 'user', 'content': 'こんにちは'}],
)
LangChain や CrewAI などのフレームワークも同じ 2 つの環境変数を読むため、移行はたいてい設定変更だけで済みます。
まとめ
- 主力モデルは横並び(
claude-sonnet-5とgpt-5.6-solは同額)。料金では差がつきません。 - 出力単価を先に見る。入力単価だけの比較は、生成系の用途で必ず外します。
- 分類・要約に最上位モデルは要りません。軽量枠との差は 20 倍単位です。
- 無料枠は検証用。本番の月額を試算してから設計してください。
- 還元は月 $500 以上から効く仕組み。それ未満なら単価勝負です。
Claude Code の料金体系についてはこちらの記事で扱っています。
FAQ
AI API の料金はどのモデルが一番安いですか?
2026-09-14 時点で最安クラスは deepseek-v4-flash の 100万トークンあたり 入力 $0.20 / 出力 $0.40 です。軽量枠では gpt-5.6-luna が $0.20/$1.20、gemini-3.5-flash-lite が $0.30/$2.50。最上位の gpt-6-astra は $10/$50 で、最安との差は入力で 50 倍、出力で 125 倍あります。ただし品質要件を満たすかは用途ごとの検証が必要です。
Claude と GPT の API 料金はどちらが安いですか?
主力モデルどうしでは同額です。claude-sonnet-5 と gpt-5.6-sol はいずれも 100万トークンあたり 入力 $2 / 出力 $10 です。最上位では claude-opus-4.8 が $5/$25、gpt-6-astra が $10/$50 なので Claude のほうが安くなります。軽量枠は claude-haiku-4.5 が $1/$5、gpt-5.6-luna が $0.20/$1.20 で GPT 側が安いという形です。
Gemini API の料金はいくらですか?
100万トークンあたり、gemini-3.8-flash が 入力 $0.75 / 出力 $3.75、gemini-3.5-flash-lite が $0.30/$2.50、長文脈向けの gemini-3.1-pro-preview が $2/$12 です(2026-09-14 時点)。分類や要約であれば Flash-Lite で月額 2 桁 USD に収まるケースが多くなります。
無料枠だけで本番運用できますか?
できません。無料枠は Qwen3.7 Flash への無料アクセスで、1分あたり10リクエスト・1日あたり50リクエストの制限があります(クレジットカード不要、残高があれば上限 2 倍)。クレジットを配布する仕組みではないため、動作確認やプロンプト調整には十分ですが、本番トラフィックを賄う設計にはなっていません。
利用還元はどのくらい戻りますか?
月間の対象消費がしきい値を超えるたびに固定額が出る方式です。OpenAI GPT と Gemini は $20/$50/$100/$200/$500 でそれぞれ +$2/+$3/+$5/+$10/+$30、$500 超過分にさらに 10%。DeepSeek は +$4/+$6/+$10/+$20/+$60 で超過分に 20%。実質還元率は一定ではなく、$500 以上で 10%(DeepSeek 20%)に安定し、$20 未満では還元はありません。無料枠と BYOK の利用は対象外で、UTC 暦月ごとにリセットされます。
自分の API キーを使えますか(BYOK)?
使えます。自分のベンダー API キーを登録すると、そのキーが対象とするモデルの利用はベンダー側で、あなたのアカウントに、あなたの単価で課金されます。ルーティング、フェイルオーバー、キーごとの上限管理は利用できます。ただし BYOK の利用は利用還元の対象外です。