Claude Haiku 5.5 公開:10万トークン以下の単価は4.5の1/10、400につながる5つの変更とClaude Code

Claude Haiku 5.5 公開:10万トークン以下の単価は4.5の1/10、400につながる5つの変更とClaude Code

ミオ|AI大好きな後輩

ミオ|AI大好きな後輩

Anthropic が10月7日、小型モデルの新版 Claude Haiku 5.5(モデル ID は claude-haiku-5-5)を公開しました。100,000トークン以下のプロンプトなら単価は Haiku 4.5 の10分の1で、コンテキストは 1M トークンに広がり、Haiku で初めて effort(思考の量の指定)が使えます。一方で、Haiku 4.5 向けに書いたリクエストの一部は、モデル ID を替えただけでは 400 エラーになります。

Claude を API や Claude Code で使っていて、Haiku 4.5 を呼んでいるコードや設定がある人には、いつ・どこを直せば替えられるかが気になるところです。筆者は AI のモデルと開発ツールの仕様を、公式資料と照らして追ってきました。本稿は、Anthropic の発表・システムカード、Claude の docs の whats-new・移行ガイド・モデルの概要・廃止表・プロンプトのガイド・Amazon Bedrock のページ、Claude Code の model-config と sub-agents の docs と changelog、GitHub・Vercel・AWS の告知を10月8日の朝(日本時間)に取得して突き合わせ、料金・直す所・Claude Code での扱い・使える窓口を整理したものです。Haiku 4.5 を使っていなければ、既存コードの移行対応は不要です。Claude Code の haiku を Anthropic API 以外のつなぎ先で使っているだけなら、「Claude Code での扱い」の節から読めば足ります。

料金:単価の比と、公式の「平均約75%減」は別の数字

Haiku 5.5 の概要ページによると、単価はプロンプトの長さで2段階に分かれます(100万トークンあたり)。

  • 100,000トークン以下:入力 $0.10、出力 $0.50、キャッシュ読み取り $0.01、5分キャッシュの書き込み $0.125
  • 100,000トークン超:入力 $0.50、出力 $2.50、キャッシュ読み取り $0.05、5分キャッシュの書き込み $0.625
  • Batch API は入力と出力が半額

出力の単価も、出力の長さではなくプロンプトの長さで決まります。システムカードの費用の計算でも、1リクエストごとにそのプロンプトの長さで単価を当てています。

Anthropic の発表の料金表では、Haiku 4.5 は入力 $1.00、出力 $5.00、キャッシュ読み取り $0.10、キャッシュの書き込み $1.25 です。単価を比べると、100,000トークン以下で10分の1、超えると半分になります。

発表が「平均で約75%安い」とするのは、これとは別の計算です。発表の注記によると、Haiku 4.5 ではリクエストの9割が 100,000トークン以下で、さらに新しいトークナイザーで1つの作業に使うトークンがやや増える分を含めています。AWS の告知は、Anthropic によれば多くの作業で約75%安いとしています。長いプロンプトでは単価の割引率が小さいため、平均約75%減をそのまま自分の費用に当てはめることはできません。

取得した公式資料では、100,000トークンの判定にキャッシュから読んだトークンを含めるかどうかは明記されていません。

同じ日に、Sonnet 5.5 のキャッシュ読み取りも $0.20 から $0.10 に下がりました。発表は、これで Sonnet 5.5 が多くのエージェント作業で約20%安くなるとしています。

何が変わったか

whats-new と概要ページから、Haiku 4.5 との違いを拾います。

  • コンテキストは 1M トークン、出力は最大 128k トークン(Haiku 4.5 は 200k と 64k)
  • 思考は adaptive thinking で、既定でオン。effort は low・medium・high・xhigh・max の5段階(段階ごとの使い分けはプロンプトのガイドにある)で、既定は medium
  • 同じ文章が約30%多いトークンに数えられる。whats-new は Claude 4.7 以降と同じ新しいトークナイザーのためとしている
  • 安全のための分類器が要求を断ることがあり、stop_reason が refusal で返る
  • Priority Tier は使えない(移行ガイドによる)

トークンの増え方は、資料で尺度が違います。whats-new は同じ文章が約30%多く数えられるとし、発表の注記は1つの作業に使うトークンがやや増えると書いています。前者は文章の数え方、後者は作業あたりの使用量の話です。

発表は、Terminal-Bench 4.0 のような複雑なエージェントのコーディングには Sonnet 5.5 と Opus 5.5 のほうが向いているとし、Haiku 5.5 は要約・圧縮・サブエージェントのような範囲の狭い作業に向くと書いています。

廃止表では、Haiku 4.5 は現役(Active)のままで、退役は「Not sooner than October 15, 2026」、つまり2026年10月15日より前には退役しないとされています。

4.5 のコードを 5.5 に替える前に直す所

Haiku 4.5 向けのリクエストが次の書き方をしていると、モデル ID を替えただけでは済みません。前の5項目は、各項目に書いた条件で 400 につながる変更で、whats-new も「Breaking」に分類しています。最後の1項目はエラーにならず取り違える所で、受け取る側のコードが思考のブロックを答えと読み違えるおそれがあります。

Claude の docs の whats-new と移行ガイドをもとに、Haiku 4.5 向けのコードで直す所を筆者が左右の対に並べたものです。上の5行は whats-new が Breaking とする変更で、5行目の会話の書き換えは thinking ブロックを送り返す場合に限られ、2026年8月31日 00:00 UTC より前に作ったアカウントでは thinking.block_binding.prefix_mismatch_behavior を指定したときだけ 400 になります。2行目は既定以外の指定などが対象で、temperature は 1、top_p は 0.99 を単独で送る場合は通ります。top_k はどの値でも、temperature と top_p の併用も 400 です。4行目は Claude API と Google Cloud での扱いです。パラメータ名と値は本文の該当箇所を見てください。

  • 思考の予算を指定している:thinking に type: enabled と budget_tokens を送ると 400 です。effort で思考の量を決める形に替えます。thinking は省略するか type: adaptive にして、output_config.effort で段階を選びます
  • サンプリングの値を指定している:temperature・top_p・top_k の既定以外の値は 400 です。指定を外すのが基本で、移行ガイドによると temperature は 1、top_p は 0.99 なら通りますが、top_k はどの値でも、temperature と top_p を両方送っても 400 です
  • assistant の書き出しで終えている:最後を assistant の発言にして続きを書かせる prefill は、思考を切っていても 400 です。user の発言で終える形に替えます。出力の形を固定する目的なら、移行ガイドは structured outputs か、分類なら enum を持つツールを使うよう案内しています。Amazon Bedrock は structured outputs に対応していないため、ツールを使います
  • computer use の旧ツールを使っている:Claude API と Google Cloud では、computer_20250124 を宣言すると 400 です。toolset に切り替える(computer_toolset_20260801)必要があり、ベータヘッダーの computer-use-2025-01-24 も外します。移行ガイドによると、エージェントのループ側も、input.action ではなく各 tool_use ブロックの name と toolset_name で分岐し、結果に toolset_name を返す形に変える必要があります。fine-grained-tool-streaming-2025-05-14 のヘッダーを toolset と一緒に送ると、これも 400 です
  • 途中の会話を書き換えて送り直している:thinking ブロックを送り返すとき、それより前の system・tools・過去のメッセージを変えると 400 です。直し方は、会話は追記だけにすることです。ただし移行ガイドによると、2026年8月31日 00:00 UTC より前に作ったアカウントでは、thinking.block_binding.prefix_mismatch_behavior を指定したリクエストだけがこのエラーになります
  • 先頭のブロックを答えとして読んでいる:思考が既定でオンなので、思考を指定しないリクエストでも応答が thinking ブロックで始まることがあります。API はエラーを返しません。種類でブロックを選ぶ(type を見る)形に替えます

ほかに、思考のトークンは max_tokens に数えられます。Haiku 4.5 で思考なしに合わせた小さい max_tokens だと、思考の途中で止まり本文が返らないことがあります。思考の中身は既定で空になり、要約が欲しいときは display に summarized を指定します。保存した会話を、作ったアカウントでもそれにリンクしたアカウントでもないアカウントから送り直すと、thinking ブロックはモデルに届く前に捨てられ、エラーにならずにその思考抜きで処理されるので、会話は作ったアカウントか、それにリンクしたアカウントから送り直します。移行ガイドは、Claude Code で /claude-api migrate を実行すると、モデル ID の置き換えと、必要に応じてパラメータ・prefill・effort の調整を行い、その後に手で確かめる項目のチェックリストを出すとしています。

Claude Code での扱い

Claude Code の changelog によると、v2.1.293 で Haiku 5.5 が Anthropic API での既定の Haiku になりました。model-config の docs は、Haiku 5.5 には v2.1.293 以降を使うよう書いています。

haiku という別名が指すモデルは、つなぎ先で違います。

  • Anthropic API:Haiku 5.5
  • Claude Platform on AWS、Amazon Bedrock、Google Cloud の Agent Platform、Microsoft Foundry:Haiku 4.5

AWS の告知は Claude Platform on AWS と Amazon Bedrock の両方で Haiku 5.5 を使えるとしていますが、Claude Code で haiku と書いただけでは 4.5 のままです。model-config の docs は、これらのつなぎ先ではモデルを版で固定するよう勧めており、ANTHROPIC_DEFAULT_HAIKU_MODEL で haiku の行き先を固定できます。model-config の docs によると、Anthropic のモデル ID claude-haiku-5-5 を指定した場合、Amazon Bedrock と Google Cloud では、その版を提供していれば Claude Code がつなぎ先の ID に解決します。modelOverrides の設定があればそちらが優先され、Foundry では配置名を使います。Bedrock の固定例は us.anthropic. で始まる形で、すべてのつなぎ先へ同じ ID を直接送るわけではありません。移行ガイドの表は Messages API のコード向けであり、Claude Code の環境変数にそのまま当てはめないでください。逆に model の設定を haiku にしていると、haiku が Haiku 5.5 を指すつなぎ先では、Haiku 4.5 で保存したセッションも Haiku 5.5 で再開します。

ほかに Claude Code 側で押さえておく点です。

  • 組み込みの Explore サブエージェントは、原則として本体の会話と同じモデルで動きます(本体が Fable のときは別の規則)。sub-agents の docs は、探索を安いモデルで回したいなら、Explore という名前のユーザーかプロジェクトのサブエージェントを model: haiku で定義するよう案内しています。CLAUDE_CODE_SUBAGENT_MODEL だけでは Explore と Plan のモデルは変わりません
  • API では Haiku 5.5 の思考を effort が low・medium・high のときに切れますが(プロンプトのガイドによる。xhigh と max では 400)、Claude Code では Haiku 5.5 の思考は切れません。model-config の docs は、モデルが effort に応じて手順ごとに考える量を決めるとしています
  • Anthropic API では、Haiku 5.5 はどのプランでも 1M のコンテキストで動きます。プロンプトが 100K トークンを超えると単価が上がる点は、Claude Code でも同じです

GitHub の issue には、v2.1.283〜2.1.290 でサブエージェントの定義に model: haiku と書いても本体の Opus で動いたという利用者の報告があります。原因と修正の有無は、この issue には書かれていません。

ほかの窓口

  • GitHub Copilot:GitHub の changelog によると一般提供で、Pro・Pro+・Max・Business・Enterprise で選べます。提供は段階的です。利用量に応じた課金で、提供元の定価で請求されます。GitHub は、初期の試験で多くのコーディング作業において Sonnet 5 と同等の結果を、少ないトークンと手順で出したとしています
  • Vercel AI Gateway:Vercel の changelog によると、モデル名は anthropic/claude-haiku-5.5 です(Anthropic のモデル ID と違い、5.5 がドット区切り)。Zero Data Retention に対応し、思考を切れるのは low・medium・high のときとしています
  • Amazon Bedrock:モデル ID は anthropic.claude-haiku-5-5 です。Bedrock のページは、すべての顧客に開放しているモデルに Haiku 4.5 を挙げていますが、Haiku 5.5 の利用条件は AWS コンソールで確かめるよう案内しています
  • Google Cloud と Microsoft Foundry:モデル ID は claude-haiku-5-5 です。新しいブラウザ使用ツールは、Claude API と Google Cloud で使えます

まだ分からないこと

  • Amazon Bedrock で Haiku 5.5 を使える条件
  • Claude Code の haiku が、Anthropic API 以外のつなぎ先でいつ Haiku 5.5 を指すようになるか
  • Haiku 4.5 の確定した退役日(廃止表は10月15日より前には退役しないとする下限だけを示している)

次にやること

Haiku 4.5 を呼んでいるコードは、モデル ID を替える前に上の直す所を探してください。

  • budget_tokens、temperature・top_p・top_k、最後が assistant のメッセージ、computer_20250124 を使っている箇所を検索する。thinking ブロックを送り返す前に system・tools・過去のメッセージを書き換えている箇所と、応答の先頭のブロックを答えとして読んでいるコードも探す
  • 新しいモデルでトークン数を数え直し、max_tokens と費用の見積もりを見直す。長いプロンプトが多いなら 100,000トークンの境界で単価が5倍になる前提で試算する
  • Claude Code を Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry・Claude Platform on AWS 経由で使っているなら、haiku の行き先を明示する

参考になったら、記事下部のライクとXの共有ボタンから応援してもらえるとうれしいです。


あなたも記事の投稿・販売を
始めてみませんか?

Tipsなら簡単に記事を販売できます!
登録無料で始められます!

Tipsなら、無料ですぐに記事の販売をはじめることができます Tipsの詳細はこちら
 

この記事の販売者

ミオ|AI大好きな後輩

先輩、新しいAIもう試しました? Codex・Claude Code・Gemini の新機能を、公式資料から図解でまとめます。 どこが変わって、何に気をつければいいか。 一緒に追いかけましょう!

この販売者が書いた他の記事

  • Claude Code の cloud sessions が正式提供に:クレジットは利用枠より先に使われる(公式の補足あり)

  • Gemini 4 Argon が発表:出力100万トークン・料金・提供元のベンチマーク・いま使える人

  • Opus 5 から 5.5 へ移る前に:400 を返す破壊的変更4つと、エラーなしで変わる2つを自分のコードで探す

    ¥300
    1 %獲得
    (3 円相当)

関連のおすすめ記事

  • ゼロから3日で始動|AIコンサル大全

    ¥124,800
    1 %獲得
    (1,248 円相当)
    水口一星

    水口一星

  • 【AI自動化・マネタイズ実例書】たった2週間〜機械オンチなママでもできた全作業過程

    ¥37,800
    1 %獲得
    (378 円相当)
    みお

    みお

  • 【5年更新型コンテンツ】AIを最大活用するためのリテラシー強化バイブル

    ¥59,800
    1 %獲得
    (598 円相当)
    こはく

    こはく