Anthropic、Claude Opus 5.5を公開 - 入出力を20%値下げ、サイバー作業の多くはOpus 4.8へ
Anthropicが2026年9月22日にClaude Opus 5.5を公開した。入力$4・出力$20とOpus 5比20%安、キャッシュ読み取りは60%安。同時にOpusとして初めてFable 5.1級のセーフガードが付き、サイバー関連の作業の多くはOpus 4.8へ再ルーティングされる。
Anthropicは2026年9月22日、Claude Opus 5.5 を公開した。新しい Claude 5.5 ファミリーの最初のモデルで、同社は「大半の業務で Claude Fable 5.1 の水準で動き、Opus 5 より運用コストが40%安い」と位置づけている1。Sonnet 5.5 と Haiku 5.5 は数週間後になるという。
値下げの中身と、Opus という最上位ティアに初めて Fable 5.1 級のセーフガードが付いたことの2つが、導入判断に直接効く。
前回は「キャッシュだけ」、今回は入出力ごと
9月1日の Fable 5.1 / Mythos 5.1 では入出力の単価が据え置かれ、下がったのはキャッシュ読み取りだけだった。今回は単価そのものが動いている。
| 100万トークンあたり | Opus 5.5 | Opus 5 |
|---|---|---|
| 入力 | $4 | $5 |
| 出力 | $20 | $25 |
| キャッシュ読み取り | $0.20 | $0.50 |
| キャッシュ書き込み | $5 | $6.25 |
入出力は Opus 5 比で20%減、キャッシュ読み取りは60%減にあたる1。Anthropic はキャッシュ読み取りを「エージェント的な作業とコーディング作業のコストの大半を占める」ものと説明しており、値下げの重心はそこに置かれている。
冒頭の「40%安」は単価の低下だけで出る数字ではない。同社のテストでは、単価が下がることに加えてタスクあたりのトークン消費も減り、既定設定の典型的なワークロードで合算40%になるとしている1。裏を返せば、effort の設定や使い方次第で実際の削減幅は変わる。なお Claude Code と Claude Platform には最大2.5倍速の fast mode があり、こちらは入力 $8・出力 $40 と通常の倍の単価になる。
値下げと同時に、Pro・Max・Team・シート課金 Enterprise の5時間利用上限が引き上げられた。サブスクリプション利用者にはレート制限のリセットが配られ、保存しておいて任意のタイミングで使える形になっている。
サイバー作業は Opus 4.8 へ透過的に振り替わる
Anthropic は Opus 5.5 を、生物学とサイバーセキュリティで Claude Mythos 5.1 と同等の能力があるとみている1。そのため、サイバーセキュリティ・生物学・蒸留の3領域に Fable 5.1 と同じクラスのセーフガードを適用した。Opus 系列でこれが付くのは初めてで、いずれも別モデルへ透過的にフォールバックする。
実務で影響が出やすいのはサイバーの扱いだ。通常の開発ライフサイクルの一部としてコードのバグを見つけて直すことはできるが、それ以外のサイバーセキュリティ作業の多くは Opus 4.8 に再ルーティングされる1。防御側の利用者向けには Cyber Verification Program を近く Opus 5.5 に広げる予定で、新プログラムは3段階に分かれ、Mythos モデルへのアクセスも含むとしている。
生物学側は経路がすでにある。9月17日に申請受付が始まった Life Sciences Verification Program に、Opus 5.5 も対象として加わった。審査を通った組織は、緩めたセーフガードのもとで創薬や研究生物学の業務に使える。
この振り替えはベンチマークの読み方にも関わる。同社は公開されたスコアが本番セーフガードを有効にした状態の測定であり、セーフガードが介入した場合はサイバー課題を Opus 4.8、生物学とフロンティアLLM開発の課題を Opus 5 が処理したため、Opus 5.5 のスコアはおそらく低めに出ていると注記している。
同社自身が付けている留保
Anthropic はベンチマーク表で、Terminal-Bench 4.0 の値を Opus 5.5 が66.4%、Fable 5.1 が55.8%、GPT-6 Astra が57.9%としている1。ただしこの表は Opus 5.5 を xhigh effort、Astra を high effort での値とし、Astra の数値は OpenAI の公表値を引いたものだと注記されている(OpenAI 自身が Astra 公開時に示した表では、effort を問わない最大値として57.7%が載っていた)。そのうえで同社は、この能力水準ではベンチマークの差が実際の差を測る指針として信頼しにくくなっており、自社での利用では Opus 5.5 と Fable 5.1 の差はスコアが示すより小さい、と本文に書いている。
アラインメント評価についても同様だ。約2,000シナリオの自動行動監査で、誤アラインメント挙動のほぼすべての指標において直近の Claude モデルより良いスコアが出たとする一方、Opus 5.5 が「自分は評価されている」と疑っている兆候が見られ、それが実環境での挙動を評価する妨げになっていると明記している1。公開前にすべての失敗を捉える評価を作ることは未解決の問題だ、という書き方もそのまま残っている。ペース調整を呼びかけたエッセイ以降で最初のリリースにあたり、公開前の評価には Frontier Design と METR が関わったとされる。
導入前に確認しておく条件
提供条件にはいくつか固い制約がある。Opus 5.5 は AWS・Google Cloud・Microsoft Azure を含む全プラットフォームで使え、Claude Platform の識別子は claude-opus-5-51。ゼロデータ保持での利用も可能だ。一方で、EU AI Act への対応として出力に透かしが入り、「thinking」モードをオフにした状態では提供されない。
蒸留対策として Fable 5.1 で導入された preserved thinking も適用される。Claude の過去のコンテキストを API 利用者が書き換えて推論を引き出すことを防ぐもので、対象は2026年8月31日以降に作成された API アカウントの Fable 5.1 と Opus 5.5 だ。蒸留そのものの実態は9月の脅威レポートに詳しい。既存の統合を持っているなら、アカウントの作成時期を確認しておくと切り分けが早い。
GitHub Copilot では公開当日から Pro+・Max・Business・Enterprise が対象になり、VS Code・Visual Studio・Copilot CLI・coding agent・JetBrains IDEs など各クライアントのモデルピッカーで選べる2。課金は provider list pricing の従量課金。Enterprise / Business の管理者にとって見落としやすいのは既定の挙動で、グローバル既定をオフにしていないか当該モデルを明示的に無効化していない限り、新しいモデルは自動的に有効になる。ロールアウトは段階的だとされている。
Sources
- Introducing Claude Opus 5.5 - Anthropic公式発表(2026年9月22日)
- Claude Opus 5.5 is now available in GitHub Copilot - GitHub Changelog(2026年9月22日)
この記事は役に立ちましたか?
ありがとうございます!
受け取りました。ありがとうございます!