結論 — Haiku 4.5 から変わった 4 点と、立場ごとにやること

2026 年 10 月 7 日 (米国時間)、Anthropic が Claude Haiku 5.5 を公開しました。Claude 5.5 ファミリーの 3 つ目のモデルで、公式発表 は「Haiku 4.5 より平均で約 75% 安く動かせる」と位置づけています。Claude API のモデル ID は claude-haiku-5-5 です。

Haiku 4.5 を使っている人にとって、変わった点は次の 4 つに絞れます。

  1. 料金は、100K トークン以下のプロンプトなら Haiku 4.5 の 1/10。100K を超えると下げ幅は半分
  2. 同じ文章が約 30% 多いトークンに数えられるため、「約 75%」はそのまま自分の用途の下がり幅にならない
  3. モデル ID の差し替えだけでは 400 になる書き方がある
  4. Sonnet 5.5 のキャッシュ読み取りが、同じ日に半額になった

やることは立場で分かれます。Claude Code を使っているだけの人は、v2.1.293 以降に更新すれば足ります。API を自前のコードから呼んでいる人は、後述の破壊的変更を確かめ、プロンプトの長さを測り直してから切り替えます。Sonnet 5.5 を API で使っている人は、コードを直さなくても、キャッシュを使っていれば費用が下がります。

Sonnet 5.5 との使い分けは Claude Sonnet 5.5 とは、Opus 5.5 との関係は Claude Opus 5.5 とは にまとめています。

ひと目でわかる Haiku 4.5 → Haiku 5.5 の変更点

数値は 公式のモデル概要・料金ページ・移行ガイド によります。

観点Haiku 4.5Haiku 5.5
Claude API のモデル IDclaude-haiku-4-5-20251001claude-haiku-5-5
入力 (100 万トークンあたり)$1$0.10 (100K 以下) / $0.50 (100K 超)
出力 (100 万トークンあたり)$5$0.50 (100K 以下) / $2.50 (100K 超)
キャッシュ読み取り$0.10$0.01 (100K 以下) / $0.05 (100K 超)
コンテキスト / 最大出力200K / 64K100 万 / 128K
思考budget_tokens による手動指定Adaptive。effort で調整 (既定は medium)
キャッシュできる最小の長さ4,096 トークン512 トークン
提供終了の目安早くても 2026 年 10 月 15 日 (廃止予告なし)早くても 2027 年 10 月 7 日

提供先は Claude API、Amazon Bedrock (anthropic.claude-haiku-5-5)、Google Cloud、Microsoft Foundry、Claude Platform on AWS です。知識のカットオフは 2026 年 6 月です。公式は用途を「分類・抽出・ルーティング・サブエージェントの作業のような、大量で遅延に敏感な処理」としています。

料金 — 「平均で約 75% 安い」を分けて読む

単価と 100K トークンの境界

Haiku 4.5 と並べると、100K トークン以下のプロンプトは入力・出力・キャッシュ読み取りのすべてが 1/10 です。100K を超えるリクエストの単価は、入力 $0.50・出力 $2.50・キャッシュ読み取り $0.05 で、Haiku 4.5 の半額になります。バッチ API の 50% 割引は引き続き使え、100K 以下なら入力 $0.05・出力 $0.25 です。

境界の決まり方は、料金ページ の長いコンテキストの節に書かれています。要点は 3 つです。

  1. 判定はリクエスト単位。過去のリクエストの課金は変わらない
  2. プロンプトの長さは、キャッシュの読み取りと書き込みを含む入力トークンの合計
  3. 100K を超えたリクエストは、一部がキャッシュに当たっていても高い側の単価になる

公式発表は、Haiku 5.5 が特にお得なのは 100K 以下のプロンプトで、前の Haiku へのリクエストの約 90% がそこに収まっていたと説明しています。「平均で約 75%」は、この 2 段階の単価を踏まえた平均です。公式のページを読んだ範囲では、この平均の計算式までは書かれていません。社内に報告するときは、「平均で約 75%」をそのまま使わず、自分の用途の値を試算してください。

トークン数の増加を掛けた目安

単価の比較で見落としやすいのが、トークンの数え方です。Haiku 5.5 は Claude 4.7 以降と同じトークナイザを使い、公式の移行ガイド によると、同じ文章が Haiku 4.5 より約 30% 多いトークンに数えられます。増え方は内容で変わります。大きな画像も、高解像度の扱いになるため、より多くのトークンに数えられます。

この増加を掛けて、1 回のリクエストの費用を筆者が試算します。思考のトークン、キャッシュ、バッチは含めない概算です。

例Haiku 4.5Haiku 5.5下がり幅
入力 20,000・出力 1,000 トークン (Haiku 4.5 の数え方)約 $0.025入力 26,000・出力 1,300 で約 $0.0033約 87%
入力 150,000・出力 2,000 トークン (同上)約 $0.16入力 195,000・出力 2,600 で約 $0.10約 35%

短いプロンプトでは公式の平均より大きく下がり、長いプロンプトでは下がり幅がかなり小さくなります。もう 1 つの注意点が境界です。Haiku 4.5 で約 77K トークン (100K ÷ 1.3) 以上あったプロンプトは、Haiku 5.5 の数え方では 100K を超えうるため、同じ入力でも高い側の単価になります。長い資料を丸ごと渡す構成は、先に新しい数え方で測り直してください。

FIXITFIXIT

「約 75% 安い」なら、費用は 1/4 になるって報告していいの?

HayateHayate

そのままは危ないです。短いプロンプトならもっと下がるし、長いと半分もいきません。

FIXITFIXIT

じゃあ、どうやって自分の分を知ればいいの?

HayateHayate

使っているプロンプトの長さを、Haiku 5.5 の数え方で測るのが先です。

Sonnet 5.5 のキャッシュ読み取りは半額になった

同じ発表で、Sonnet 5.5 のキャッシュ読み取りが 100 万トークンあたり $0.20 から $0.10 に下がりました。公式発表は、この変更でエージェント的な作業の費用が約 20% 下がるとしています。料金ページ では、Sonnet 5.5 と Opus 5.5 のキャッシュ読み取りは基本の入力単価の 0.05 倍で、Sonnet 5.5 が $0.10、Opus 5.5 が $0.20 です。

項目変更前変更後
Sonnet 5.5 のキャッシュ読み取り$0.20$0.10
Sonnet 5.5 のキャッシュ書き込み$2.50 (5 分) / $4 (1 時間)据え置き
Opus 5.5 のキャッシュ読み取り$0.20据え置き

発表と料金ページには、期限の記載がありません。現在の料金表には通常の価格として載っています。効果が大きいのは、長い共通のプロンプトを繰り返し読ませる構成です。たとえば 50,000 トークンの共通部分をキャッシュから 100 回読むと、読み取りの費用は $1.00 から $0.50 になります。キャッシュを使っていない構成は、この変更の恩恵を受けません。

なお、Sonnet 5.5 の記事 の料金表は、この変更より前の値 ($0.20) で書かれています。

破壊的変更 — 差し替えで 400 になる書き方

移行ガイド は、Messages API を自前で呼んでいるコードについて、次の変更を挙げています。自分の書き方に当たるものを探してください。

書き方Haiku 5.5 での結果直し方
thinking: {"type": "enabled", "budget_tokens": N}400{"type": "adaptive"} にし、output_config.effort で調整
temperature・top_p・top_k の指定規定値以外は 400。top_k は値を問わず 4003 つとも外し、プロンプトで制御
最後がアシスタントの発言になるプリフィル400 (思考を切っていても)最後をユーザーの発言にし、形式は structured outputs などで指定
computer_20250124Claude API・Google Cloud で 400computer_toolset_20260801 に変更。Amazon Bedrock は computer_20251124
会話の途中で system・tools・過去の messages を書き換え、thinking ブロックを再送400 (条件付き)会話を追記だけで組み立てる
Amazon Bedrock での structured outputs利用できない形式をプロンプトで指定し、出力をコードで検証

temperature は含めるなら 1、top_p は含めるなら 0.99 である必要があり、両方を同時に指定しても 400 です。thinking ブロックの再送の検査は、2026 年 8 月 31 日 00:00 (UTC) より前に作ったアカウントでは、thinking.block_binding.prefix_mismatch_behavior を設定したリクエストだけが対象です。

挙動の変更もあります。応答が thinking ブロックから始まることがあるため、最初のブロックを答えとして読むコードは、type でブロックを選ぶように直します。thinking の本文は既定で空になり、要約を受け取るには display を "summarized" にします。過去のターンの thinking ブロックは文脈に残って入力トークンに数えられるため、複数ターンの会話では入力が増えます。また、安全分類器が依頼を断ることがあり、サーバー側のフォールバックは無いので、クライアントで stop_reason: "refusal" を扱う必要があります。Priority Tier は Haiku 5.5 では対応していません。

Claude Code のようにリクエストを内部で組み立てる利用では、これらのコード修正は要りません。Claude Code で /claude-api migrate を実行すると、公式が用意した移行用のスキルでコードの該当箇所を洗い出せます。

Claude Code での扱い

Claude Code のモデル設定 は、Haiku 5.5 に v2.1.293 以降が必要だと書いています。haiku のエイリアスの解決先はプロバイダで違います。

プロバイダhaiku の解決先
Anthropic APIHaiku 5.5
Claude Platform on AWS・Amazon Bedrock・Google Cloud・Microsoft FoundryHaiku 4.5

Haiku 5.5 は、すべてのプランで 100 万トークンのコンテキストで動作し、[1m] の接尾辞は要りません。同ドキュメントは、プロンプトが 100K トークンを超えたリクエストでは、Haiku 5.5 のトークンあたりの単価が上がると注記しています。Bedrock や Google Cloud 経由で Claude Code を使っている場合は、エイリアスが Haiku 4.5 を指すため、Haiku 5.5 を使いたいときの指定方法はモデル設定のドキュメントで確認してください。

Haiku 4.5 はいつまで使えるか

公式のモデル廃止ページ では、claude-haiku-4-5-20251001 の状態は Active で、廃止予告 (Deprecated) は出ていません。提供終了の目安は「早くても 2026 年 10 月 15 日」と書かれています。同ページは、公開済みのモデルについて廃止の少なくとも 60 日前に通知すると説明しています。

読み方に注意が要ります。「早くても」は下限で、この日に提供が終わるという意味ではありません。一方で、廃止予告が出た時点から少なくとも 60 日の猶予があるため、今すぐ慌てて切り替える必要もありません。使い続ける場合は、廃止ページとメールの通知を確認してください。Amazon Bedrock と Google Cloud は、独自に提供終了の日程を定めます。

ベンチマーク — Haiku 4.5・Sonnet 5.5 との差

公式発表 のベンチマークから、Haiku 4.5 と Sonnet 5.5 が載っている行を並べます。いずれも Anthropic の測定値です。

ベンチマークHaiku 5.5Haiku 4.5Sonnet 5.5
GDPval-AA v2.1 (Elo)16207351840
OSWorld 2.172.4%15.7%83.9%
Humanity's Last Exam (ツール無し)45.9%10.2%56.9%
Humanity's Last Exam (ツール有り)57.4%18.7%64.5%
Terminal-Bench 4.039.2%0.0%70.6%
Chartography (ツール無し)46.4%6.4%61.6%

Haiku 4.5 からは大きく伸びていますが、Sonnet 5.5 には全行で届いていません。特にエージェント的なコーディングを測る Terminal-Bench 4.0 は、39.2% と 70.6% で差が大きく残ります。表の数値は、発表ページに載っている条件での測定です。条件の細部は、ページで確かめてください。公式発表は、Haiku 5.5 を「Opus 5.5 や Sonnet 5.5 と組み合わせるサブエージェント」や、素早い検索・要約のような短く大量の作業に向くものと説明しています。

自分の用途で試算する手順

単価は変わっても、自分の費用が同じ割合で下がるとは限りません。次の手順で試算します。

  1. 呼び出しを用途ごとに分ける (分類・抽出・要約など)
  2. 用途ごとに、プロンプト・出力のトークン数を model を claude-haiku-5-5 にしたトークン計測で測る。Haiku 4.5 の計測値は使い回さない
  3. プロンプトが 100K を超えるリクエストの割合を確かめ、高い側の単価で別に計算する
  4. キャッシュを使っている用途は、読み取りと書き込みを分けて計算する
  5. 品質は、実際のデータで Haiku 4.5 の結果と並べて確かめる

実額は、必ず公式の料金ページで確認してから計算してください。単価は今後も変わりうるため、記事の数値を転記して固定するのは避けるのが無難です。

FIXIT の受け止め — 切り替えの順番を決めておく

整理すると、Haiku 5.5 は、100K 以下のプロンプトで単価を 1/10 にしつつ、コンテキストと出力を広げた更新です。一方で、トークン数の増加と 100K の境界が、費用の下がり幅を用途ごとに変えます。私たちは次の順で切り替えるのが無理がないと考えています。

  1. Claude Code は v2.1.293 以降に更新する
  2. API の本番は、破壊的変更の表で自分の行を確認し、該当箇所を直す
  3. 用途ごとのプロンプト長を新しい数え方で測り、100K の境界に近いものを洗い出す
  4. 品質と費用を、Haiku 4.5 と並べて確かめてから切り替える

次の一歩は、一番呼び出し回数が多い用途を 1 つ選び、プロンプトの長さを Haiku 5.5 の数え方で測ることです。報道の「約 75%」ではなく、自分の用途での数字が手元に残ります。LLM 全般の費用の抑え方は LLM のコスト最適化 で、法人でのプラン選びは Claude Code を法人で導入するには で扱っています。

モデルが更新されるたびの移行と評価の運用をまとめて任せたい場合は AI 開発ツール定着支援 で、AI を組み込んだプロダクト開発そのものは AI 駆動開発 でお手伝いしています。個別のご相談は お問い合わせ から承っています。