結論 — Sonnet 5 から変わった 4 つの点と、立場ごとにやること

2026 年 9 月 28 日、Anthropic が Claude Sonnet 5.5 を公開しました。Claude 5.5 ファミリーの 2 番目のモデルで、公式発表 は「Sonnet 5 より 30% 以上速く動作し、ほとんどの作業でコストを最大 30% 抑えられる、明確なアップグレード」と位置づけています。Claude API のモデル ID は claude-sonnet-5-5 です。Sonnet 5 は引き続き提供され、廃止は 2027 年 6 月 30 日より前にはなりません。

Sonnet 5 を業務で使っている人にとって、変わった点は次の 4 つに絞れます。

  1. 単価は据え置き。「最大 30% 安い」は、使うトークン数が減った効果
  2. モデル ID の差し替え前に直す破壊的変更が 5 つある
  3. API の既定 effort は high のまま据え置きだが、再較正が必要
  4. サイバーセキュリティ向けの安全対策が Sonnet として初めて入り、別モデルへ切り替わる場面が増えた

やることは立場で分かれます。Claude Code をサブスクリプションで使っている人は、そのまま使いながら effort の設定を測り直せば足ります。API を自前のコードから呼んでいる人は、後述する 5 つの破壊的変更を確かめ、該当箇所を直してから切り替えます。Opus 5.5 と迷っている人は、作業の種類で振り分けます。Haiku 5.5 は「今後数週間のうちに」公開予定です。

Sonnet 4.6 以前から上げる場合は、公式の移行手順どおり先に Sonnet 5 への変更点を押さえてください。こちらは Claude Sonnet 5 とは — 9 月値上げ中止の記事 にまとめています。

ひと目でわかる Sonnet 5 → Sonnet 5.5 の変更点

まず全体像を表にします。数値は公式発表と 公式ドキュメント によります。

観点Sonnet 5Sonnet 5.5
Claude API のモデル IDclaude-sonnet-5claude-sonnet-5-5
料金 (100 万トークンあたり)入力 $2 / 出力 $10入力 $2 / 出力 $10 (据え置き)
キャッシュ読み$0.20$0.20 (据え置き)
既定 effort (API)highhigh (据え置きだが再較正が必要)
thinking の無効化disabled 指定で可能不可。between_tools のみ
forced tool use使える使えない
出力の速度基準Sonnet 5 より 30% 以上速い
コンテキスト / 最大出力100 万トークン / 128K100 万トークン / 128K
廃止予定早くても 2027 年 6 月 30 日早くても 2027 年 9 月 28 日

提供先は Claude API、Amazon Bedrock (anthropic.claude-sonnet-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry です。知識のカットオフは 2026 年 6 月、Thinking は Adaptive、Batch API はベータヘッダを付けると最大出力が 300K トークンまで伸びます。GitHub Copilot でも同日に GA となり、Anthropic と直接契約していない開発者にも同時に届いています。

Claude Code では、2.1.284 から /model で Sonnet を選んだときの既定バージョンが Sonnet 5.5 になりました。この変更と、2.1.280 で入った「Claude Code 全体の既定モデル」の変更は別物です。詳しくは後述の「Claude Code での既定モデル」で整理します。

料金 — 「最大 30%」は単価ではなくトークン削減

100 万トークンあたりの単価を Sonnet 5 と並べます (USD)。出典は 公式の料金ページ です。

項目Sonnet 5Sonnet 5.5
入力$2$2
出力$10$10
5 分のキャッシュ書き込み$2.50$2.50
1 時間のキャッシュ書き込み$4$4
キャッシュ読み$0.20$0.20
バッチ (入力・出力)50% 割引50% 割引

全項目が Sonnet 5 と同額です。報道でよく見る「最大 30%」は、この表の値下げではありません。公式発表 は「Sonnet 5.5 は使う出力トークンが大きく減っている」ことを根拠に挙げており、単価は変わらないまま、同じ作業をこなすのに必要なトークン数が減った分だけ実行コストが下がる構造です。9 月 22 日に発表された Opus 5.5 の「40% 安い」が単価そのものの値下げ (入力・出力は 20%、キャッシュ読みは 60%) とトークン削減の合算だったのとは、成り立ちが違います。Sonnet 5.5 の削減は、トークン量の変化という 1 点だけで説明できます。

削減幅は作業の中身で変わります。出力トークンの削減が効くのは、長い出力を書く作業や、同じ結論に至るまでの試行錯誤が減る作業です。短い質問に短く答えるような使い方では、削減の効果を体感しにくくなります。社内に「最大 30% 安い」とそのまま報告すると、後から実態と食い違って突っ込まれかねません。自社の作業で Sonnet 5 と Sonnet 5.5 を並べて実測してから報告するのが確実です。

Amazon Bedrock・Google Cloud の料金は各社が地域ごとに定めているため、各基盤の料金ページで確認してください。

FIXITFIXIT

単価が同じなら、上には「30% 安くなった」って報告していいの?

HayateHayate

そのままは危ないです。安くなるのはトークン量で、単価じゃないので。

FIXITFIXIT

じゃあ、実際どれだけ安くなるかは分からないってこと?

HayateHayate

自分の作業で Sonnet 5 と 5.5 を流して、実測値を見るのが早いです。

破壊的変更 — 差し替えで 400 になる 5 つの書き方

公式ドキュメントが挙げる破壊的変更は、thinking を無効化できない、forced tool use が使えない、thinking ブロックがモデルと会話に紐づく、computer_20251124 が Claude API と Google Cloud で使えない、advisor tool の組み合わせに制限が入る、の 5 つです。影響が及ぶかどうかは、使い方と基盤で分かれます。まず自分の行を探してください。

使い方thinking の無効化forced tool usethinking ブロックの紐づけcomputer_20251124advisor tool
自前の Messages API (Claude API)400400400 (条件付き)400400 (対象の組み合わせ時)
Amazon Bedrock400400400 (条件付き)引き続き使える400 (対象の組み合わせ時)
Google Cloud400400400 (条件付き)400400 (対象の組み合わせ時)
Microsoft Foundry・Claude Platform on AWS400400未公表未公表400 (対象の組み合わせ時)

Claude Code はリクエストを内部で組み立てるため、利用者側のコード修正は発生しません。確認が要るのは後述する effort です。自前で Messages API を呼んでいる実装だけ、以下を 1 つずつ確かめてください。

thinking を無効化できない

thinking: {"type": "disabled"} を指定すると 400 になります。代わりに between_tools を使いますが、対応する effort は low・medium・high のみで、xhigh・max では 400 になります。

{
  "model": "claude-sonnet-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "between_tools" },
  "output_config": { "effort": "medium" }
}

トークンを節約したかった箇所は、thinking を外すのではなく effort を下げて調整します。

forced tool use が使えない

tool_choice に any か tool を渡すと 400 になります。auto のまま strict tool use か structured outputs を使い、呼ばせたいツールはプロンプトで名指しします。この変更は Fable 5.1・Opus 5.5 と共通です。詳しい代替手段は Claude Fable 5.1 とは で扱っています。

thinking ブロックがモデルと会話に紐づく

Sonnet 5.5 は Sonnet 5・Opus 4.8・Haiku 4.5 以前の thinking ブロックを読めますが、Opus 5・Opus 5.5・Fable・Mythos 系列のブロックは読めません。また、Sonnet 5.5 の thinking ブロックはほかのどのモデルも読めません。会話の途中で Sonnet 5.5 から別モデルへ振り分けるルーターやフォールバックを持っている場合、切り替え後のモデルは Sonnet 5.5 の思考を引き継がずに動作します。読めないブロックは API が取り除くため、リクエスト自体はエラーになりません。

400 になるのは履歴を書き換えた場合です。2026 年 8 月 31 日 00:00 (UTC) 以降に作成されたアカウントでは、Claude API・Amazon Bedrock・Google Cloud で、システムプロンプト・ツール定義・過去のメッセージを会話の途中で書き換えたうえで thinking ブロックを再送すると、既定で 400 になります。会話を追記だけで組み立てている実装には影響しません。

computer_20251124 が Claude API と Google Cloud で使えない

computer use の旧ツール computer_20251124 は、Claude API と Google Cloud では 400 になります。ベータヘッダを外し、computer_toolset_20260801 のツールセットとして宣言し直します。Amazon Bedrock では旧ツールが Sonnet 5.5 でも引き続き動作するため、変更は要りません。

advisor tool の組み合わせ制限

advisor tool で Sonnet 5.5 を executor に使う場合、Opus 4.8・Opus 4.7・Sonnet 5 を advisor に指定すると 400 になります。使える advisor は Mythos 5.1・Fable 5.1・Mythos 5・Fable 5・Opus 5.5・Opus 5・Sonnet 5.5 自身です。旧世代のモデルを助言役に組み合わせている実装は、advisor 側のモデル ID を見直してください。

effort — API の既定 (high) が据え置きでも再較正が要る理由

プロンプトガイド によると、Sonnet 5.5 の API の既定 effort は Sonnet 5 と同じ high です。既定値そのものは下がっていませんが、同じ high でも Sonnet 5 と同じ量の思考にはならないため、effort を再較正するよう案内されています。なお、公式発表 によると、Claude Code と Claude のアプリでの既定 effort は medium です。

注意

API の既定が変わっていないからといって、effort の設定を見直さずに切り替えるのは避けてください。公式ガイドは「effort のスイープをやり直してください」と明記しています。エージェント的コーディングやマルチステップのツール利用では、範囲の決まったタスクは medium から始めて、難しい・長いタスクで high へ上げます。チャットや対話中心の作業は medium か low から始めます。

xhigh・max は、品質の向上を実際に測れた作業だけに使う位置づけです。公式ガイドは「max effort でのコーディングタスクのテストで、レビューサブエージェントの自発的な起動を止めるシステムプロンプトを加えたところ、セッション費用が約 3 割下がり、品質は変わらなかった」と報告しています。逆に言えば、そのシステムプロンプトを入れないまま xhigh・max effort を使うと、Sonnet 5.5 が Claude Code のコードレビュー機能を自発的に呼び出し、複数のサブエージェントに分けてレビューを走らせることで、費用が余分にかかる場合があるということです。effort を上げるほど品質も費用対効果も上がるとは限らない点は、次のベンチマークでも確認できます。

ベンチマーク — Sonnet 5・Opus 5.5 との差

公式発表のベンチマークを、Sonnet 5・Opus 5.5 と並べます。

ベンチマークSonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070.6%10.3%66.4%
FrontierCode 1.1 (Main)52.1% (xhigh) / 46.2% (max)42.4%54.4%
CursorBench 4.055.5%34.1%57.8%
GDPval-AA v2.1 (Elo)184414491846

Terminal-Bench 4.0 の Opus 5.5 の値 (66.4%) は xhigh effort での最高値であり、Sonnet 5.5 と同じ条件の数値ではない点に注意してください。GDPval-AA では、Sonnet 5.5 は Sonnet 5 より約 400 ポイント高く、Opus 5.5 とほぼ同水準まで並んでいます。

補足

Sonnet 5.5 は effort を max にすると、常に最高スコアになるとは限りません。公式発表の脚注は「High effort (Claude Platform での既定) では、Sonnet 5.5 は GPT-6 Sol の最高スコアに、タスクあたり約 5 分の 1 のコストで並ぶ。一方 Max effort では、Sonnet 5.5 が Claude Code のコードレビュー機能をより頻繁に自発的に実行し、レビューをサブエージェントに分割した結果、タイムアウトや範囲外の追加編集が起き、スコアが下がる場合があった」と説明しています。これは前段の「effort を上げるほど良いとは限らない」という注意点と同じ現象です。

OSWorld 2.1 (partial) では Sonnet 5.5 が 80.1%、Sonnet 5 が 57.0%、Opus 5.5 が 81.8% です。

Opus 5.5 との使い分け

公式発表 は役割分担を明確に書いています。Opus 5.5 が「careful judgment を要する複雑な作業」向けなのに対し、Sonnet 5.5 は「範囲の決まった日常の作業、バグ修正、資料・スライド・スプレッドシートの作成」で最も強いとされています。

flowchart LR
  A["Sonnet 5.5 (medium)"] -->|行き詰まる| B["Sonnet 5.5 (high)"]
  B -->|高い effort でも評価が届かない| C["Opus 5.5"]
  C -->|解けた| A

単価は Opus 5.5 が入力 $4・出力 $20 で、Sonnet 5.5 の入力 $2・出力 $10 のちょうど 2 倍です。両方を高い effort で使い続けると費用も近づくため、まず Sonnet 5.5 の medium から試し、要求の厳しい推論や長時間のエージェント作業、高い effort でも評価が届かないタスクだけ Opus 5.5 に振り分けるのが無難です。Opus と Sonnet の世代を問わない基本的な役割分担は Claude Opus 5 と Sonnet 5 の違い でも扱っています。

Claude Code での既定モデル — 2 つの変更を混同しない

Claude Code の既定モデルには、時期の異なる 2 つの変更が重なっています。

バージョン変更内容
2.1.280Pro・Team Standard プランの Claude Code 全体の既定モデル が Sonnet から Opus に変更 (Max・Team Premium・Enterprise と同じ扱いに)
2.1.284Sonnet を選んだときの既定バージョン が Sonnet 5.5 に変更

出典は Claude Code の CHANGELOG です。「Claude Code の既定が Opus になった」という話と、「Sonnet を選んだときのバージョンが 5.5 になった」という話は、対象が違う別々の変更です。Pro・Team Standard で Sonnet を主戦力にしている人は、/model sonnet で明示的に選び直す必要があります。この 2.1.280 の変更点は Claude Opus 5.5 とは で詳しく扱っています。

安全対策 — 別のモデルに切り替わる場面

Sonnet 5.5 はサイバーセキュリティの能力が Opus 5 並みに上がったため、Sonnet として初めて、サイバー向けの安全対策とフォールバックを備えて提供されています。安全カテゴリは cyber・bio・frontier_llm・reasoning_extraction・general_harms の 5 つです。

カテゴリ何が起きるか
cyberSonnet 5 へフォールバックして再試行
frontier_llmSonnet 5 へフォールバックして再試行
bio再試行せずブロック
reasoning_extraction再試行せずブロック
general_harms再試行せずブロック

Help Center によると、cyber 分類器がリスクの高い攻撃的サイバーセキュリティの依頼を検知すると Sonnet 5 へ切り替わり、frontier_llm (フロンティア LLM 開発関連の一部依頼) でも同様です。一方 bio (生物学) と reasoning_extraction (内部の推論を逐語的に引き出す依頼、いわゆる蒸留対策) は、別モデルへ切り替えずにそのまま止められます。general_harms (ほかの利用ポリシー領域) も、公式ドキュメント によるとサーバー側フォールバックの再試行対象外です。API では stop_reason: "refusal" とともに、stop_details にこれらの分類が入ります。

ソースコードの脆弱性発見のような防御的なセキュリティ作業は、Sonnet 5.5 のまま使えます。

自分の作業で差を測る手順

ここまでの数字はすべて Anthropic の測定です。自分の作業での差は、次の手順で確かめられます。

  1. 手元の課題から実際のタスクを 1 つ選ぶ。練習用の例題は使わない
  2. Claude Code の /model で Sonnet 5 と Sonnet 5.5 を切り替え、同じタスクを 1 回ずつ流す
  3. /usage で、ターン数・出力トークン・費用をそれぞれ記録する
  4. effort も試す。範囲の決まったタスクを medium と high で 1 回ずつ流し、必要なら xhigh も試す
  5. 3〜4 タスク分をそろえてから結論を出す

effort を再較正しないまま比べると、Sonnet 5 のときの感覚のまま effort を選んでしまい、正しい比較になりません。必ず medium からの再較正を済ませたうえで測ってください。

FIXIT の受け止め — 切り替えの順番を決めておく

整理すると、Sonnet 5.5 は単価を据え置いたまま、必要なトークン数を減らして実行コストを下げつつ、日常のコーディングと資料作成の水準を Opus 5.5 に近づけた更新です。一方で、API の既定 effort は表面上は変わらないのに再較正が要り、API の書き方の一部はそのままだとエラーになります。私たちは次の順で切り替えるのが無理がないと考えています。

  1. 対話で使う Claude Code から切り替え、/model で Sonnet 5.5 を選び直す
  2. 同じタスクを Sonnet 5 と Sonnet 5.5 で流し、/usage でターン数と費用を記録する
  3. API の本番は、破壊的変更の表で自分の行を確認し、該当箇所を直してから切り替える
  4. xhigh・max effort は既定にせず、品質の向上を実測できたタスクだけに限定する

Opus 5.5 が 9 月 22 日、Sonnet 5.5 が 9 月 28 日と、1 週間で 2 回の更新がありました。モデルが変わるたびに調べ直すより、「料金・破壊的変更・既定値・安全対策」の 4 点を確認する型を持っておくほうが、更新のたびの手間が小さく済みます。複数の AI コーディングエージェントを併用する運用設計は AI コーディングエージェントを併用する運用 でも扱いました。

次の一歩は、手元のタスクを 1 つ選び、Sonnet 5 と Sonnet 5.5 で 1 回ずつ流して /usage を見比べることです。報道の「最大 30%」ではなく、自分の作業での数字が手元に残ります。法人でのプラン選びは Claude Code を法人で導入するには を参照してください。

モデル更新のたびの移行・評価の運用をまとめて任せたい場合は AI 開発ツール定着支援 で、AI を組み込んだプロダクト開発そのものは AI 駆動開発 でお手伝いしています。個別のご相談は お問い合わせ から承っています。