結論 — Opus 5 から変わった 4 つの点と、立場ごとにやること

2026 年 9 月 22 日、Anthropic が Claude Opus 5.5 を公開しました。Claude 5.5 ファミリーの最初のモデルで、公式発表 は「ほとんどの作業で Claude Fable 5.1 の水準の成果を出し、Opus 5 より 40% 安く動かせる」と位置づけています。Claude API のモデル ID は claude-opus-5-5 です。Opus 5 は引き続き提供され、廃止は 2027 年 7 月 24 日より前にはなりません。

Opus 5 を業務で使っている人にとって、変わった点は次の 4 つに絞れます。

  1. 料金が下がった。入出力は 20%、キャッシュ読みは 60% 安い
  2. API の既定 effort が high から medium に下がった
  3. モデル ID の差し替え前に直す破壊的変更が 4 つある
  4. 安全対策で別のモデルへ切り替わる場面が増えた

やることは立場で分かれます。Claude Code をサブスクリプションで使っている人は、そのまま使いながら effort の設定だけを確かめれば足ります。API を自前のコードから呼んでいる人は、後述する 4 つの破壊的変更を確かめ、該当箇所を直してから切り替えます。Fable 5.1 を使っている人は、Opus 5.5 で足りるかを自分の作業で測ってから決めます。Sonnet 5.5 と Haiku 5.5 は「今後数週間のうちに」公開予定とされているので、Sonnet・Haiku が主体の人は待つ選択肢もあります。

Opus 4.8 以前から上げる場合は、公式の移行手順どおり先に Opus 5 への変更点を押さえてください。こちらは Claude Opus 5 とは — Opus 4.8 から何が変わったか にまとめています。

ひと目でわかる Opus 5 → Opus 5.5 の変更点

まず全体像を表にします。数値は公式発表と 公式ドキュメント によります。

観点Opus 5Opus 5.5
Claude API のモデル IDclaude-opus-5claude-opus-5-5
料金 (100 万トークンあたり)入力 $5 / 出力 $25入力 $4 / 出力 $20
キャッシュ読み$0.50 (入力の 0.1 倍)$0.20 (入力の 0.05 倍)
API の既定 efforthighmedium
thinking の無効化effort high 以下でのみ可能不可 (常にオン)
forced tool use使える使えない
出力の速度基準Opus 5 より 30% 以上速い
コンテキスト / 最大出力100 万トークン / 128K100 万トークン / 128K
廃止予定早くても 2027 年 7 月 24 日早くても 2027 年 9 月 22 日

提供先は Claude API、Amazon Bedrock (anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry です。知識のカットオフは 2026 年 6 月です。Claude Code では 2.1.280 から Opus 5.5 が既定の Opus モデルになり、同じ版で、Claude Code の Pro と Team Standard での既定モデルも Sonnet から Opus に変わりました。

料金 — 「40%」「25%」の中身を分けて読む

100 万トークンあたりの単価を Opus 5 と並べます (USD)。出典は 公式の料金ページ です。

項目Opus 5Opus 5.5
入力$5$4
出力$25$20
5 分のキャッシュ書き込み$6.25$5
1 時間のキャッシュ書き込み$10$8
キャッシュ読み$0.50$0.20
バッチ (入力 / 出力)$2.50 / $12.50$2 / $10
Fast mode (入力 / 出力)$10 / $50$8 / $40

報道でよく見る「40%」は、この表の値下げ幅ではありません。公式発表の 40% は、既定の設定で典型的な作業を流したときの実行コストの比較です。公式ブログ What a task costs on Opus 5.5 は、コストを動かす要因を「価格」と「モデルがこなす作業量」の 2 つに分けて説明しています。使い方による下がり幅の例として、公式ブログは次の数字を挙げています。

数字何を比べた数字か
最大 60%キャッシュ読みが大半のセッションで、入力側の費用が下がる幅
最大 20%キャッシュの無い短い質問に長い答えを返す使い方で、費用全体が下がる幅
約 31%同じトークン数のセッションで、価格差だけを比べた例

最大 60% は入力側だけ、最大 20% は費用全体を基準にした数字なので、1 本の幅としては読めません。公式ブログは、Claude Code の作業の多くがこの 2 つの例のあいだの形をしているとしています。長いエージェントのセッションほど入力の大半がキャッシュ読みになり、入力側の費用が大きく下がります。一方で Opus 5.5 は常に考えてから答えるため、1 回の回答で使うトークンが Opus 5 より増える場合があります。

サブスクリプションの話は 2 つに分けて読みます。1 つは値下げの反映で、Pro・Max・Team プランではキャッシュ済みの文脈も含めて上限が Opus 5 より約 25% 長持ちします。もう 1 つは 5 時間の使用量上限の引き上げで、こちらはシート課金の Enterprise も対象に含みます。あわせて上限のリセットが配布されました。Help Center によると、リセットは Settings の Usage にある「Reset for free」から使い、モバイルアプリとターミナル・IDE の Claude Code にはボタンがありません。プラン別の枠の考え方は Claude Fable 5 の料金プラン別ガイド で扱っています。

Fast mode は同じモデルを最大 2.5 倍の速度で動かす設定です。研究プレビューの扱いで、Claude API からのみ使え、バッチとも併用できません。なお Bedrock と Google Cloud の料金は各社が地域ごとに定めているため、各基盤の料金ページで確認してください。

FIXITFIXIT

じゃあ請求額は結局どれくらい下がるの?

HayateHayate

キャッシュ読みの比重で決まります。長いセッション中心なら大きく下がります。

FIXITFIXIT

それって、上には「40% 下がる」と報告していいってこと?

HayateHayate

そのままは使わないほうがいいです。同じ作業を 2 モデルで流して、実測値で報告しましょう。

破壊的変更 — Opus 5 のコードで確かめる 4 点

公式ドキュメントが挙げる破壊的変更は、thinking を無効化できない、forced tool use が使えない、thinking ブロックがモデルと会話に紐づく、computer_20251124 が Claude API と Google Cloud で使えない、の 4 つです。このうち最初の 3 つは Fable 5.1 にも当てはまります。影響が及ぶかどうかは、使い方と基盤で分かれます。まず自分の行を探してください。

使い方thinking の無効化forced tool usethinking ブロックの紐づけcomputer_20251124
自前の Messages API (Claude API)400400400 (条件付き)400
Amazon Bedrock400400400 (条件付き)引き続き使える
Google Cloud400400400 (条件付き)400
Microsoft Foundry・Claude Platform on AWS400400400 (条件付き)未公表

Claude Managed Agents については、モデル名の更新以外に変更は要らないと公式が明記しています。Claude Code は利用者がリクエストを組み立てないため、コードの修正は発生しません。確認が要るのは後述する effort です。

移行を自動化したい場合は、Claude Code で /claude-api migrate を実行します。このコマンドは、利用者が選んだ対象範囲 (作業ディレクトリ全体・サブディレクトリ・特定のファイル) に、モデル ID の差し替えと以下の書き換えを適用し、手で確かめる項目の一覧を返します。

thinking を無効化できない

thinking: {"type": "disabled"}thinking: {"type": "enabled", "budget_tokens": N} は、どちらも 400 になります。Opus 5 では effort が high 以下なら無効化できましたが、Opus 5.5 では effort にかかわらず思考が常にオンです。対処は thinking フィールドを外し、トークンを節約したかった箇所は effort を下げることです。

{
  "model": "claude-opus-5-5",
  "max_tokens": 16000,
  "output_config": { "effort": "low" }
}

応答は thinking ブロックから始まるため、content の先頭を本文として読んでいる実装は type で選ぶ形に直します。

forced tool use が使えない

tool_choiceanytool を渡すと 400 になります。トークン数を数えるエンドポイントも同じです。auto のまま strict tool use か structured outputs を使い、呼ばせたいツールはプロンプトで名指しします。代わりの手段の選び方は Claude Fable 5.1 とは で詳しく扱っています。

thinking ブロックがモデルと会話に紐づく

Opus 5.5 は Opus 5 以前の Opus・Sonnet・Haiku の thinking ブロックを読めますが、Fable と Mythos のブロックは読めません。逆方向では、Claude API で Opus 5.5 のブロックを読めるのは Fable 5.1 と Mythos 5.1 だけです。会話の途中で別のモデルへ振り分けるルーターやフォールバックを持っている場合、切り替え先が Fable 5.1・Mythos 5.1 以外なら、そのモデルは Opus 5.5 の思考を引き継がずに動作します。

もう 1 つの条件は履歴の書き換えです。2026 年 8 月 31 日 00:00 (UTC) 以降に作成されたアカウントでは、システムプロンプト・ツール定義・過去のメッセージを会話の途中で書き換えたうえで thinking ブロックを再送すると、既定で 400 になります。会話を追記だけで組み立てている実装には影響しません。

computer_20251124 が Claude API と Google Cloud で使えない

computer use の旧ツール computer_20251124 は、Claude API と Google Cloud では 400 になります。ベータヘッダを外し、computer_toolset_20260801 のツールセットとして宣言し直します。エージェントのループ側も、1 ターンに複数の tool_use を受け取る形に直す必要があります。Amazon Bedrock では旧ツールが Opus 5.5 でも引き続き動作するため、変更は要りません。

エラーにならない変化 — ツール呼び出しの合間の文章

Opus 5 では、ツール呼び出しの合間にモデルが書く文章は text ブロックで返っていました。Opus 5.5 では進捗更新の thinking ブロックとして返り、既定の display: "omitted" では中身が空です。リクエストは失敗しませんが、この文章を進捗表示に使っている画面は、ツール実行の間に何も表示しなくなります。戻すには display"updates" (ベータ) か "summarized" にします。

effort — 既定が medium に下がった

effort のドキュメント によると、Opus 5.5 の API の既定 effort は medium です。Opus 5 以前の Opus は high だったため、effort を指定していないリクエストは Opus 5 のときより 1 段下で動きます。加えて、同じ effort でも 1 ターンあたりの思考は Opus 5 より多く、特に xhigh と max で差が大きくなります。

一方で、既定が 1 段下がっても品質が下がるとは限りません。Anthropic の評価では、Opus 5.5 の medium はコーディングと知識作業で Opus 5 の high に並ぶか上回り、いくつかのコーディング評価では low でもそれに近い結果を、はるかに低い費用で出しています。medium で足りるか high が要るかは、評価セットで effort を振り直さないと分かりません。

注意

Claude Code では 2.1.280 から、/effort がモデルごとの設定になる前に保存した effort は、Opus 5.5 のような新しいモデルに適用されなくなりました。モデルごとの設定になる前に high を保存していても、利用者が水準を選び直すまで、Opus 5.5 は既定の水準から始まります。/effort status で今の水準を確かめてください。

公式ブログが示す Claude Code での使い分けは、範囲の決まった日常の作業は medium、medium で行き詰まったら high、名前の変更のような機械的な作業は low です。effort や thinking の設定を変えると、その会話のキャッシュが消えて次のリクエストで書き込みの料金がかかります。区切りのよいところで変えると、書き込みの料金が無駄になりません。API でも、トップレベルの effort をリクエスト間で変えるとキャッシュが無効になります。メッセージ単位で effort を変える機能 (ベータ) なら、キャッシュを保ったまま変えられます。

ベンチマーク — Opus 5 との差と Fable 5.1 との差を分けて見る

公式発表のベンチマークを、Opus 5 との差と Fable 5.1 との差に分けて並べます。差はポイントで、GDPval-AA だけは Elo スコアです。

ベンチマークOpus 5.5Fable 5.1Opus 5Opus 5 との差Fable 5.1 との差
Terminal-Bench 4.066.4%55.8%52.3%+14.1+10.6
FrontierCode v1.1 (Main)54.4%50.3%48.0%+6.4+4.1
CursorBench 4.057.8%51.8%46.6%+11.2+6.0
GDPval-AA v2.1184617351708+138+111
AutomationBench40.0%31.4%26.9%+13.1+8.6
Humanity's Last Exam (ツールあり)67.7%65.6%63.6%+4.1+2.1
Terminal-Bench-Science 0.158.7%52.6%29.0%+29.7+6.1
OSWorld 2.0 (partial)81.8%80.7%74.0%+7.8+1.1

表の Opus 5.5 の値は effort を max にした結果で、Terminal-Bench 4.0 だけは xhigh の結果です。安全対策が介入したタスクは別のモデルが完了させており、Opus 5.5 のスコアを押し下げている可能性があると注記されています。AutomationBench は Zapier が実施した結果で、フォールバックを使わずに走らせたため、安全対策の介入は失敗として数えられています。公式の表に並ぶ GPT-6 Astra は AutomationBench (41.4%) と Terminal-Bench-Science 0.1 (64.6%) で Opus 5.5 を上回っています。GPT-6 Astra の位置づけは GPT-6 Astra とは で扱いました。

既定の medium での結果も公表されています。FrontierCode は 54.6% で、max の 54.4% をわずかに上回り、GPT-6 Astra の最高値 53.3% を 1 タスクあたり約 5 分の 1 の費用で上回りました。CursorBench 4.0 は 52.5% で、max の Fable 5.1 (51.8%) と Opus 5 (46.6%) を上回っています。Terminal-Bench 4.0 では、既定の effort の Opus 5.5 が max の Opus 5 を約 5 分の 1 の費用で上回ったとされています。

補足

Anthropic 自身が、この水準ではベンチマークの差が実務での差を測る指標として信頼しにくくなったと書いています。Opus 5.5 と Fable 5.1 の差は表の数字より小さいとも述べています。

Fable 5.1 との使い分け — 上げる条件と戻す条件

公式のモデル一覧 は、迷ったら Opus 5.5 から始めるよう案内しています。Fable 5.1 を使うのは、要求の厳しい推論と長時間のエージェント作業、または Opus 5.5 を高い effort にしても評価が届かないときです。公式ブログはこれを、日々の作業で使える具体的な条件に落としています。

flowchart LR
  A["Opus 5.5 (medium)"] -->|行き詰まる| B["Opus 5.5 (high)"]
  B -->|同じ問題で 2 回つまずく| C["Fable 5.1"]
  C -->|解けた| A

公式ブログは、見守らない長時間の実行、コードベースに前例の無い問題、多数のサブエージェントを束ねる大きな変更を Fable 5.1 の出番として挙げています。対話的な作業は、待ち時間が短く費用も安い Opus 5.5 のほうが合います。

費用の差は作業の形で変わります。Fable 5.1 の単価は入力 $10・出力 $50 で Opus 5.5 の 2.5 倍ですが、キャッシュ読みは $0.25 で 1.25 倍にとどまります。差が小さいのはキャッシュ主体の長い実行、差が大きいのは出力を多く書く作業です。

切り替えは区切りのよいところで行います。キャッシュはモデルごとに持つため、切り替えた直後のリクエストは空のキャッシュから始まります。

逆に、コードを書かない調べものは Sonnet や Haiku に下ろすのが公式ブログの勧めです。検索して要約するサブエージェントや、ログとテスト結果の読み取りが該当します。Opus と Sonnet の分担は Claude Opus 5 と Sonnet 5 の違い でも扱っています。

FIXITFIXIT

Fable 5.1 はもう使わなくていいの?

HayateHayate

公式の推奨は、まず Opus 5.5 から始めることです。難所用に残す価値はあります。

FIXITFIXIT

じゃあ、どこで Fable 5.1 に上げればいいの?

HayateHayate

使い分けの目安は「high で同じ問題に 2 回つまずいたら」です。迷う時間が減ります。

安全対策 — 別のモデルに切り替わる場面

Opus 5.5 は能力が上がった分、Fable 5.1 に近い安全対策を備えています。特定の依頼では別のモデルが代わりに答えるか、依頼そのものが止められます。Help Center の記載を表にまとめます。

依頼の分野何が起きるか
サイバーセキュリティエクスプロイトの生成、バイナリの脆弱性スキャン、侵入テストOpus 4.8 が代わりに答える
生物学ウイルス学・毒性学・分子設計のデュアルユースの依頼Opus 5 が代わりに答える
フロンティア LLM の開発一部の ML アクセラレータ向けのカーネル開発などOpus 5 が代わりに答える
思考の引き出し (蒸留)内部の推論を逐語的に出力させる依頼など切り替えずに止める

切り替えは既定で有効で、切り替わったことは画面に表示されます。ソースコードの脆弱性スキャンや安全なコードの構築には Opus 5.5 をそのまま使えます。

API では、止められた依頼は stop_reason: "refusal" で返り、stop_detailscyberbioreasoning_extraction などの分類が入ります。サーバー側のフォールバックは reasoning_extraction で止められた依頼を再試行しません。

自分の作業で差を測る手順

ここまでの数字はすべて Anthropic の測定です。自分の作業での差は、公式ブログの手順で確かめられます。

  1. 手元の課題から実際のタスクを 1 つ選ぶ。練習用の例題は使わない
  2. Claude Code の /model で Opus 5 と Opus 5.5 を切り替え、同じタスクを 1 回ずつ流す
  3. /usage で、ターン数・出力トークン・費用をそれぞれ記録する
  4. effort も試す。難しいタスクを medium と high で 1 回ずつ、機械的なタスクを low で 1 回流す
  5. 3〜4 タスク分をそろえてから結論を出す

チーム単位で見る場合は、利用者ごとの推定費用を返す Claude Code Analytics API と、モデル別・キャッシュの有無別に費用を分ける Usage and Cost API を使います。

移行のタイミングでは、Claude Code の /claude-api prompt-audit で、古いモデル向けに書いた指示が残っていないかを点検できます。公式ブログの社内ベンチマーク (サポート用の 44 チケット) では、Opus 4.8 比で約 25% 減になりました。内訳は、Opus 5.5 の low に移して約 18%、prompt-audit でさらに 9% です。公式はこの数字を「期待値ではなく例」として示しています。

FIXIT の受け止め — 切り替えの順番を決めておく

整理すると、Opus 5.5 は単価を下げたうえで性能を Fable 5.1 の水準に寄せた更新です。一方で、既定の effort は黙って 1 段下がり、API の書き方の一部はそのままだとエラーになります。私たちは次の順で切り替えるのが無理がないと考えています。

  1. 対話で使う Claude Code から切り替え、/effort status で effort の水準を確かめる
  2. 同じタスクを Opus 5 と Opus 5.5 で流し、ターン数と費用を記録する
  3. API の本番は、破壊的変更の表で自分の行を確認し、該当箇所を直してから切り替える
  4. Fable 5.1 は常用から外し、「high で 2 回つまずいたら」の条件で呼ぶ

Opus 5 が 7 月、Fable 5.1 が 9 月 1 日、Opus 5.5 が 9 月 22 日と、2 か月で 3 回の更新がありました。毎回ゼロから調べ直すより、「料金・既定値・壊れる書き方・安全対策」の 4 点を確認する型を持っておくほうが、更新のたびの手間が小さく済みます。提供元の都合でモデルが入れ替わる場面への備えは Cursor の OpenAI モデル提供停止の記事 でも扱いました。

次の一歩は、手元のタスクを 1 つ選び、Opus 5 と Opus 5.5 で 1 回ずつ流して /usage を見比べることです。報道の 40% ではなく、自分の作業での数字が手元に残ります。法人でのプラン選びは Claude Code を法人で導入するには を参照してください。

モデル更新のたびの移行・評価の運用をまとめて任せたい場合は AI 開発ツール定着支援 で、AI を組み込んだプロダクト開発そのものは AI 駆動開発 でお手伝いしています。個別のご相談は お問い合わせ から承っています。