Sonnet 5.5は公式で30%高速・30%低コスト?移行前に直すAPI
Claude Sonnet 5.5についてAnthropic公式が述べる「30%高速」「タスク単価最大30%減」の条件、ベンチマーク数値、Sonnet 5.5へ移行する前に必ず直すAPI箇所を整理します。
データ確認日:2026年9月29日。本記事はAnthropicの一次情報のみを使用しています:Sonnet 5.5の発表、Claude Platformドキュメント:Sonnet 5.5の概要、What's new in Claude Sonnet 5.5。「公式によると」とある数値は、メーカー自身のテストと顧客報告であり、当社の実測ではありません。
Anthropicは2026年9月28日にClaude Sonnet 5.5を発表しました。公式は、Sonnet 5からの明確なアップグレードで、出力速度は30%以上高速、ほとんどの作業でタスクあたりのコストは最大30%減としています。以下は公式の紹介動画(Claude公式チャンネル)です。
結論
- 単価は変わらず、変わるのは「1つの作業を終えるのに使うトークン数」です。 公式の料金はSonnet 5と同じ(入力100万トークンあたり$2、出力$10)。「最大30%減」は、同じ作業をより少ないトークンとツール呼び出しで終えることによるもので、単価が下がるわけではありません。請求が30%減るかどうかは、ご自身の作業次第です。
- 公式ベンチマークはSonnet 5を大きく上回ります。 たとえばTerminal-Bench 4.0はSonnet 5.5が70.6%、Sonnet 5が10.3%。ただし推論強度の設定が揃っていない項目があります(下記)。
- 移行はモデルIDの書き換えだけでは済みません。 公式ドキュメントは、既存コードを壊す変更を5点挙げています(推論オフの書き方、ツールの強制指定、
temperatureなどのパラメータを含む)。本番投入の前に必ず検証してください。
速度とコストについての公式の主張
公式発表の主張は3層に分かれます。混同しないでください。
- 速度: 出力速度はSonnet 5より30%以上高速で、これまでで最速のSonnetとされています。
- タスクあたりのコスト: ほとんどの作業で最大30%減。理由は「同じことをより少ないトークンで終える傾向があるから」です。
- 特定のベンチマークでのコスト: 公式は、複数のベンチマークでSonnet 5.5がLowまたはMediumの推論強度でSonnet 5の最高スコアを上回り、タスクあたりのコストは約10分の1以下(CursorBench 4.0はLow、Terminal-BenchはMedium)としています。
3つ目は「同じスコアで比べたコスト」であり、普段の作業がすべて10分の1になるという意味ではありません。2つ目の「最大」も上限であって平均ではありません。
公式は複数の顧客の報告も掲載しています(各社が自分の環境で測った値で、互いには比較できません)。
| 報告者 | 公式が引用している数値 |
|---|---|
| Balyasny Asset Management | 財務タスク2,441件で、1回答あたり約12.1万トークン(Sonnet 5は49.7万トークン) |
| Box | 結果が2.4倍高速、総トークン12%減 |
| Zendesk | チケット処理が20%高速 |
| Atlassian | Rovo Agentsが最大30%高速 |
| Slack | オフラインのSlackbot評価の大半でSonnet 5を上回り、ステップ数も減少 |
| Lovable | 1つの作業を終えるシェル実行回数がSonnet 5の約半分 |
公式ベンチマーク(Sonnet 5.5、Sonnet 5、Opus 5.5)
| 評価 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0(エージェント型コーディング) | 70.6% | 10.3% | 66.4% |
| FrontierCode 1.1 Main(エージェント型コーディング) | 46.2%(Max) | 42.4% | 54.4% |
| CursorBench 4.0(エージェント型コーディング) | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1(ナレッジワーク、Elo) | 1844 | 1449 | 1846 |
| AA-Briefcase v1.1(ナレッジワーク、Elo) | 1811 | 1359 | 1822 |
| Humanity's Last Exam(ツールあり) | 64.5% | 54.9% | 67.7% |
| OSWorld 2.1(コンピュータ操作、partial) | 80.1% | 57.0% | 81.8% |
| Chartography(グラフ認識、ツールなし) | 61.6% | 15.6% | 64.4% |
表を読むときは、公式が脚注で示した条件に注意してください。Terminal-BenchのOpus 5.5の成績はXhigh強度です。FrontierCodeのSonnet 5.5はMax強度で、公式はMax強度ではコードレビュー用スキルの下でタイムアウトや余計な編集が起きたと述べています。GDPval-AAとAA-Briefcaseは公開前のバージョンで測定され、修正済みの構造化出力の不具合があり、公式はスコアがわずかに低く出ていると見込んでいます。つまり、これはメーカー公表の成績であり、強度やツール設定が異なるものを単純に比べることはできません。自分のタスクで再現できるかは、実際に試す必要があります。
料金の考え方(単価は同じ)
単価は入力$2/出力$10/キャッシュ読み取り$0.2/キャッシュ書き込み$2.5(100万トークンあたり)でSonnet 5と同じ。コンテキストは100万トークン、最大出力は12.8万トークンです(公式ドキュメント)。BazaarLinkのモデルカタログのclaude-sonnet-5.5も同じ単価です。円換算と2バージョンの並列比較はClaude Sonnet 5から5.5へ乗り換える?をご覧ください。
公式が言う「節約」は、ご自身の請求で確かめる必要があります。実際のタスクを20〜30件選び、同じプロンプトでSonnet 5と5.5の両方を実行し、入力/出力トークン、再試行回数、合格率を記録して、単価ではなく「完了したタスク1件あたり」のコストを比べましょう。
移行前に直すAPI(公式ドキュメント)
以下は公式のWhat's newドキュメントが挙げる変更です。これはAnthropicのAPIの挙動の説明です。BazaarLink経由で呼び出す場合は、ご自身の実際のリクエストで確認してから本番に反映してください。
- 推論オフの書き方が変わりました。 Sonnet 5.5で
thinking: {"type": "disabled"}を送ると400になります。事前の思考をオフにするには{"type": "between_tools"}を使い、推論強度はhigh以下に限られます(xhighやmaxでは400)。 - ツールの強制指定は非対応です。
tool_choiceをanyや特定のツール指定にすると400。使えるのはauto(既定)とnoneのみです。スキーマに合ったツール入力が必要な場合、公式はautoとstrict tool use、または構造化出力の利用を勧めています。 - 思考ブロックはモデルと会話に紐づきます。 各思考ブロックはどのモデルが生成したかを記録します。Sonnet 5.5はSonnet 5の思考ブロックを読めますが、Opus 5.5のものは読めず、他のモデルもSonnet 5.5のものを読めません。途中でモデルを切り替えると、切り替え以降のターンでは元の推論内容が使えません。また、思考ブロックを再送する前にsystemプロンプト、ツール、以前のメッセージを変更すると、新しいアカウントでは400になります。会話は追記のみにするのが公式の推奨です。
- 旧コンピュータ操作ツールは受け付けません。
computer_20251124は400になり、computer_toolset_20260801へ移行する必要があります。 - advisorツールの組み合わせが変わりました。 Sonnet 5.5を実行役にすると、Opus 4.8、Opus 4.7、Sonnet 5はアドバイザーにできず400になります。
エラーにはならないが挙動が変わる点が2つあります。
- ツール呼び出しの間のテキストが
thinkingブロックに入ります。 既定(display: "omitted")ではこのテキストは空で、ツール呼び出し間の説明をユーザーにストリーミングしているUIは、その間何も表示されず、エラーも出ません。 temperature、top_p、top_kを既定値以外にすると400になります。
推論強度も再調整されています。同じ強度でもSonnet 5と同じ思考量にはなりません。公式は強度のスイープをやり直すことを勧めています。基本はhighから。エージェント型のコーディングや複数ステップのツール利用は、明確なタスクならmediumから、難しいものはhighへ。チャットや遅延に敏感な用途はmediumかlowから始めます。
誰が乗り換えるべきか
まずSonnet 5.5を試してよい: 日常的なコーディング、バグ修正、文書やスライドの作成など、範囲が明確な作業(公式の位置づけ)で、速度やトークン使用量を重視する場合。
移行前にしっかり検証すべき:
- コードに
thinking: disabled、ツールの強制tool_choice、独自のtemperature、旧コンピュータ操作ツールがある。 - UIがツール呼び出し間のテキストを表示している。
- モデルをまたいで会話したり、履歴メッセージを編集したりする。
よくある質問
Sonnet 5.5はSonnet 5より安いですか?
単価は同じです。公式が言うのは「同じことをより少ないトークンで終える」ため、タスクあたりのコストが最大30%減るということで、実際の削減幅は作業によります。
公式の「30%高速」はどう測ったものですか?
公式発表は、出力速度がSonnet 5より30%以上高速とだけ述べています。顧客報告の数値(Zendeskの20%高速、Atlassianの最大30%高速など)は各社自身のテストです。実際のレイテンシはプロンプト長、出力長、推論強度によって変わります。
Sonnet 5を使い続けてもいいですか?
はい。移行する場合は、公式の移行ガイドのチェックリスト(上の5点はその破壊的変更)を確認し、推論強度のテストをやり直してください。
この記事のスコアは当社の測定ですか?
いいえ。すべてのベンチマークと顧客の数値はAnthropic公式の発表を引用したもので、公式の条件注記もそのまま残しています。
出典
- Anthropic:Introducing Claude Sonnet 5.5
- Claude Platformドキュメント:Claude Sonnet 5.5、What's new in Claude Sonnet 5.5
- 公式動画:Introducing Claude Sonnet 5.5(Claude公式YouTubeチャンネル)
モデルとトークン数を入力して API リクエストの料金を見積もれます。
料金計算を開く