Anthropic、Claude Haiku 5.5を公開 - 10万トークン以下はHaiku 4.5の単価の10分の1、Sonnet 5.5のキャッシュ読み取りも半額に
Anthropicが2026年10月7日にClaude Haiku 5.5を公開した。入力$0.10・出力$0.50(プロンプト10万トークン以下)とHaiku 4.5の10分の1の単価で、平均約75%安いと同社は試算する。budget_tokensが400エラーになるなど、Haiku 4.5向けのコードは修正が要る場合がある。Sonnet 5.5のキャッシュ読み取りも$0.10に下がった。
Anthropicは2026年10月7日、小型モデル Claude Haiku 5.5(claude-haiku-5-5)を公開した1。同社は要約・分類・データベース照会のような大量で繰り返しの多い処理や、Opus 5.5・Sonnet 5.5 の下で動くコーディングのサブエージェントに向くモデルと説明し、これまでで最も安く、速く、能力の高い小型モデルだと位置づけている。
9月22日の Opus 5.5、9月28日の Sonnet 5.5 に続く 5.5 ファミリーの3つ目で、どちらの発表でも Haiku 5.5 は数週間後になるとされていた。今回の発表では、Sonnet 5.5 のキャッシュ読み取り単価の引き下げもあわせて告知されている。
単価はプロンプトの長さで2段階
価格表は次のとおりで、いずれも100万トークンあたりの米ドルだ1。Haiku 5.5 だけ、プロンプトが10万トークン以下か超えるかで単価が分かれる。
| 項目 | Haiku 5.5(10万以下 / 超) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 入力 | $0.10 / $0.50 | $1.00 | $2.00 |
| 出力 | $0.50 / $2.50 | $5.00 | $10.00 |
| キャッシュ読み取り | $0.01 / $0.05 | $0.10 | $0.10 |
| キャッシュ書き込み | $0.125 / $0.625 | $1.25 | $2.50 |
10万トークン以下なら入力・出力・キャッシュの各単価が Haiku 4.5 のちょうど10分の1、10万トークンを超えると半分になる。Haiku 5.5 自身の2つの区分を比べると、境目を越えた側の単価は5倍だ。長い文書を丸ごと渡す使い方では、この境目を意識しておく必要がある。
入力$0.10・出力$0.50という水準は、9月22日に公開された GPT-6 Luna の単価と同じだ。10万トークン以下の単価で見れば、両社の値札が揃った形になる。
「約75%安い」は同社の平均試算
Anthropic は、Haiku 5.5 の運用コストは平均で Haiku 4.5 より約75%安いとしている1。単価の下げ幅である9割より小さい数字で、脚注には試算の前提が書かれている。
脚注によれば、Haiku 4.5 へのリクエストの90%は10万トークン以下だった。残りは単価の下げ幅が50%にとどまる区分に入る。さらに Haiku 5.5 はトークナイザーが更新されており、同じ仕事をこなすのにタスクあたりわずかに多くのトークンを使う。75%はこの2つを織り込んだ同社の平均値で、第三者の検証を経た数字ではない。
トークン数の増え方は、移行ガイドの側がより具体的に書いている。Haiku 5.5 は Claude 4.7 以降のモデルと同じ新しいトークナイザーを使い、同じ入力テキストが Haiku 4.5 より約30%多いトークンとして数えられる。増加量は内容によって変わる3。この変化は8月末の Sonnet 5 の価格据え置きの記事でも扱った新トークナイザーと同じ系統のものだ。トークンの数え方が変わる以上、自社の請求がどこに落ち着くかは、代表的なプロンプトを claude-haiku-5-5 で数え直すまで分からない。移行ガイドも、Haiku 4.5 で測ったトークン数を使い回さず数え直すよう求めている。
モデル名の置き換えだけでは動かない
Haiku 4.5 から乗り換える場合に最も注意が要るのはここだ。リリースノートは、Haiku 4.5 向けに書いたコードは Haiku 5.5 で壊れうると明記している2。挙げられているのは、手動の extended thinking(budget_tokens)が400エラーを返すこと、adaptive thinking が既定でオンになっていて応答が thinking ブロックから始まりうること、同じテキストがより多くのトークンとして数えられることだ。
移行ガイドが400エラーになるとしている主な要素は次のとおりだ3。
thinking: {"type": "enabled", "budget_tokens": N}は400エラー。{"type": "adaptive"}に替え、思考の量はoutput_config.effortで調整するtemperature・top_p・top_kは省略する。top_kは値を問わず、temperatureは1以外、top_pは0.99以外の値で400エラーになるmessagesを assistant のターンで終えるプリフィルは、thinking をオフにしていても400エラーになる- Claude API と Google Cloud の computer use は、
computer_20250124を宣言すると400エラー。computer_toolset_20260801への移行が必要
エラーにならなくても挙動が変わる点もある。thinking のトークンは max_tokens に数えられるため、Haiku 4.5 向けに小さく設定した上限では、thinking ブロックのあと、本文が出る前に応答が止まりうる。最初のコンテンツブロックを答えとして読むコードは、位置ではなく type で選ぶよう書き換える必要がある。さらに Haiku 5.5 は安全性の分類器で要求を断ることがあり、サーバー側のフォールバックもないため、stop_reason: "refusal" への対処が要る。Haiku 4.5 で Priority Tier を契約している組織は、Haiku 5.5 が Priority Tier に対応していない点も確認しておきたい。
一方、Claude Managed Agents を使っている場合はモデル名の変更だけで済むとされる。Claude Code では /claude-api migrate を実行すると、同梱のスキルがモデルIDの置き換えや破壊的なパラメータ変更への対応を必要に応じて行い、ファイルを編集する前に対象範囲の確認を求める。
ベンチマークと、同社自身が付けた線引き
発表ページの表では、値が載っている評価のすべてで Haiku 5.5 が Haiku 4.5 と GPT-6 Luna を上回っている1。主な項目を抜き出すと次のとおりだ。
| 評価 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 |
| OSWorld 2.1(Offline subset) | 72.4% | 15.7% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% |
| FrontierCode 1.1 (Main) | 46.4% | — | 42.4% |
| Chartography(no tools) | 46.4% | 6.4% | 29.1% |
いずれも Anthropic の発表による数値で、GPT-6 Luna の値の出所は表に書かれていない。
大事なのは、同社自身が引いている線のほうだ。同じ表で参考として載る Sonnet 5.5 は Terminal-Bench 4.0 で70.6%と、Haiku 5.5 の39.2%を大きく上回る。Anthropic は、Terminal-Bench 4.0 が測るような複雑なエージェント型のコーディングには Sonnet 5.5 と Opus 5.5 のほうが引き続き適しており、Haiku 5.5 は圧縮・要約・サブエージェントのような範囲の絞られた作業、つまりこれまではコストが合わなかった作業に最も向く、と書いている。メインのエージェントを Haiku 5.5 に置き換える話ではなく、大きなモデルの下で回す下請け処理の単価が下がった、と読むのが自然だろう。
早期テストの声も載っている。AlphaSense は400件のクエリで Haiku 4.5 の0.76に対し0.84と統計的に有意な改善があったとし、Box は Haiku 4.5 より11ポイント高いスコアを約半分のレイテンシで得たと報告している。いずれも各社の自社評価だ。
安全面では、サイバーセキュリティのセーフガードは Haiku 4.5 より厳しく、他の最近のモデルよりはやや緩い設定とされる。防御的な作業は Sonnet 5.5 より幅広く通す一方、ペネトレーションテストのように攻撃側に使われやすい手法は遮断する。生物学のセーフガードは Sonnet 5・Sonnet 5.5・Opus 5 と同じだ。
Sonnet 5.5 のキャッシュ読み取りは$0.20から$0.10へ
同じ日に、Sonnet 5.5 のプロンプトキャッシュ読み取りが100万トークンあたり$0.20から$0.10に下がった2。入力単価に対する倍率でいえば0.1倍から0.05倍への変更で、キャッシュ書き込みを含むほかの価格は変わらない。
Anthropic は、キャッシュ読み取りがトークン消費の大きな割合を占めるため、多くのエージェント型タスクで Sonnet 5.5 のコストが約20%下がると説明している1。これも同社の試算で、実際の下げ幅はキャッシュがどれだけ効いているかで変わると考えられる。Sonnet 5.5 の公開時点(9月28日)のキャッシュ読み取りは$0.20で、入出力の単価は据え置きのまま今回キャッシュ側だけが動いた。
同じ発表では、Max と Team の契約者に Claude Platform で使える月額のAPIクレジット(Max 5x は月$100、Max 20x は$200、Team はユーザー合算で最大$500)を配ることも告知された。
提供範囲と、移行を急ぐかどうか
Haiku 5.5 は Claude API のほか、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundry で公開当日から使える2。コンテキストウィンドウは1Mトークン、最大出力は128kトークン。同社によれば、調整可能な effort の設定が付くのは Haiku 系で初めてだ。モデルIDは日付の付かない固定の claude-haiku-5-5 で、別名は用意されていない。
要約や分類のような短いプロンプトを大量に投げている処理なら、単価の差が大きく効く。ただし、budget_tokens、既定値以外のサンプリングパラメータ、プリフィルを使っているコードは、モデル名を書き換えた時点で400エラーになる。乗り換えは、移行ガイドのチェックリストでこれらを潰し、トークン数を数え直したあとで行うのが安全だ。
Sources
- Introducing Claude Haiku 5.5 - Anthropic公式発表(2026年10月7日)
- Claude Platform release notes - Anthropic公式リリースノート(2026年10月7日の項)
- Claude Haiku 5.5 migration guide - Anthropic公式ドキュメント(2026年10月8日確認)
この記事は役に立ちましたか?
ありがとうございます!
受け取りました。ありがとうございます!