AnthropicはClaude Opus 5.5を発売した。9月22日の発表では、多くの作業でFable 5.1に近い性能を、Opus 5より低い料金で実現するとしている。

すでにOpus 5を使っているチームにとって、この更新はモデルIDが安くなっただけではない。Opus 5.5ではadaptive thinkingが常に有効で、デフォルトの努力度はmediumとなり、Opus 5で受け付けられた複数のリクエスト形式が拒否される。また、Anthropicが監督下の業務向けに推奨する日常利用モデルとしてFable 5.1より下に位置付けられ、最も難しく長時間に及ぶ自律型タスクにはFableが推奨される。

大きな変化

  • 何が変わったか:Opus 5.5では入力・出力料金が20%、キャッシュ読み出し料金が60%下がる。常時有効なadaptive thinkingにより、既存のAPIクライアントが作業を依頼し、予算を立てる方法も変わる。
  • なぜ重要か:長時間のエージェントタスクでは、以前の指示やツールの結果を何度も読み込む。最大の値下げは再利用されるコンテキストに適用されるため、タスク全体の請求額を理解するにはキャッシュ使用量が鍵となる。
  • 今後の注目点:Sonnet 5.5とHaiku 5.5は数週間以内の提供が発表されている。先に利用可能になったのはOpusだ。デフォルトモデルを選ぶには、完了したタスクの費用と、各階層に必要なレビューを比較する必要がある。

Opus 5.5は、Fableより下の階層で本番業務を担う

Anthropicはパートナー向けの説明で、Opus 5.5を本番のコーディング、金融・法律知識業務、エージェント向けの企業標準モデルとして推奨している。公開モデル選択ガイドによると、ほとんどの作業ではOpus 5.5から始め、複雑なエージェント型コーディングや企業業務に利用する。別の費用ガイドでは、監督下の機能開発、デバッグ、コードレビューに適した「日常使いのモデル」と説明している。どちらのガイドも、トークン価格より最高性能や長く難しい処理を重視する場合は、Fable 5.1を上位に置く。

Anthropicのプロンプトガイドは、原因分析、コード検査、並列サブエージェント、調査、表計算、レポート、プレゼンテーションについて同社が実施したテストを挙げ、幅広い能力を説明している。また、進捗メッセージや最終要約の明瞭化、画像認識とコンピューター操作の改善も紹介する。これらはAnthropicの評価であり、BIG CHANGEが行ったテストではない。

OpusとFableの位置付けの違いは料金にも表れる。Fable 5.1は入力100万トークン当たり10ドル、出力50ドルであるのに対し、Opus 5.5は4ドルと20ドルだ。キャッシュ読み出しはそれぞれ0.25ドルと0.20ドルで差が小さい。長いキャッシュ済みセッションでは、見出しに出る入力・出力料金ほど総額の差が大きくならない場合がある。

Claude Opus 5.5は4種類のAPI料金を改定

以下の標準API料金は100万トークン当たり。Anthropicのモデルリファレンスには、Opus 5.5のコンテキストウィンドウが100万トークン、最大出力が128,000トークンとある。料金ドキュメントによると、コンテキストウィンドウ全体に標準料金が適用される。

API料金区分

Opus 5.5

Opus 5

変更率

入力

4ドル

5ドル

20%安

出力

20ドル

25ドル

20%安

5分間のキャッシュ書き込み

5ドル

6.25ドル

20%安

キャッシュ読み出し

0.20ドル

0.50ドル

60%安

Anthropicは、デフォルト設定では一般的な作業の費用が40%下がると報告しており、その計算には料金とトークン効率の両方が含まれる。タスク費用の説明では、その組み合わせが重要な理由を示している。長いエージェントセッションではコンテキストが増えながら何度も読み込まれ、出力にはthinkingトークンが含まれ、タスク中に多くのターンが発生することもある。キャッシュ読み出し料金が60%下がれば、キャッシュを多用するセッションでは大きな効果がある。一方、短い未キャッシュのリクエストで長い回答を生成する場合は、出力料金の20%引き下げに近い。

プロンプトガイドによると、報告された30%超の改善は出力生成速度に関するものだ。ツール、テスト、外部サービス、レビュアーを待つ時間を測定したものではない。Anthropicは、入力が100万トークン当たり8ドル、出力が40ドルとなる高速APIモードも提供する。これはClaude APIのリサーチプレビューであり、パートナーのクラウドプラットフォームでは利用できない。

AnthropicはPro、Max、Team、座席課金型Enterpriseプランで5時間当たりの利用上限も引き上げ、次回以降に繰り越せるリセット枠を用意した。サブスクリプションの利用枠はAPI請求とは別だ。

企業ベンチマークが示す強みと限界

Anthropicによると、Terminal-Bench 4.0のスコアはOpus 5.5のxhigh設定が66.4%、Opus 5が52.3%、Fable 5.1が55.8%だ。見出しに掲載されたその他の結果の多くはmax設定を使っている。

表示されたAutomationBenchとTerminal-Bench-Scienceの項目ではGPT-6 Astraが首位だ。安全策を組み込んだサイバー課題ではOpus 4.8、生物学と最先端モデル開発の課題ではOpus 5を使った。AutomationBenchではフォールバックを使っていない。

Anthropicは行動監査で、取り返しのつかない操作や許可範囲外の行動が減ったとも報告している。プロンプトガイドでは、以前のOpusモデルより間接的なプロンプトインジェクションへの耐性も高まったとしている。いずれも同社が実施したテストの結果であり、一般的な安全認証ではない。

既存APIクライアントには明示的な移行が必要

API利用者はclaude-opus-5-5を指定する必要がある。既存のOpus 5の呼び出しでモデルが自動的に切り替わることはない。移行リファレンスには、対応しなければエラーが返ったり、アプリケーションの出力ストリームが変化したりする複数のリクエスト変更が記載されている。

移行項目

Opus 5.5での動作

モデル選択

明示的にclaude-opus-5-5を指定する。

thinking

adaptive thinkingは常に有効。無効化したthinkingや手動のトークン予算を指定するとHTTP 400が返る。

努力度

次のいずれかを指定する:low、medium、high、xhighまたはmax。デフォルトはmedium。

ツールの強制選択

tool_choiceの値anyとtoolを指定するとHTTP 400が返る。autoとnoneは引き続き利用できる。

コンピューター操作

以前のcomputer_20251124toolはClaude APIとGoogle Cloudでは拒否される。Amazon Bedrockでは引き続き利用できる。

進捗テキスト

ツール呼び出し間のテキストはthinkingブロックに入って届く。そのため、デフォルトの非表示設定を使うクライアントでは、呼び出しの合間に応答がないように見えることがある。

長時間動作するクライアントでは、thinkingの保持に関する別の制約もある。thinkingブロックはモデルと会話のプレフィックスに結び付いている。2026年8月31日以降に作成されたAPIおよびクラウドプラットフォームのアカウントでは、thinkingブロックを再送する前に、それより前の指示、ツール、メッセージを変更すると、デフォルトでHTTP 400エラーが返る。Anthropicのthinking保持ドキュメントでは、追記のみで続ける方法と、互換性のないブロックを破棄するための制御オプションを説明している。

安全性ルーティングによって回答モデルが変わることがある

Anthropicのプロンプトガイドでは、Fable 5.1相当の生物学分野の安全策と、サイバーセキュリティおよび推論情報の抽出を判定する分類器を説明している。ソースコードの脆弱性発見は引き続き許可されており、ライフサイエンス分野の検証は組織から申請できる。サイバー分野の検証拡大は数週間以内の提供として発表されている。

拒否応答でもHTTP 200とstop_reason: "refusal"が返ることがある。フォールバックのドキュメントでは、サーバー側のフォールバック、SDKミドルウェア、クライアント側で管理する再試行を説明する。対応する経路を設定した場合に限ってフォールバックが行われる。Opus 5.5のすべてのリクエストに自動で付く保証ではない。推奨フォールバックが用意されていないカテゴリでは、引き続き拒否されることがある。

そのため、実際に応答したモデルも結果の一部となる。Opus 5.5へ移行するアプリケーションでは、特に安全策の対象分野の作業について、拒否応答とフォールバックで処理した応答を分けて記録する必要がある。料金の引き下げと幅広い能力に関する主張はOpus 5.5に当てはまるが、別モデルへルーティングされたリクエストには、実際に回答したモデルの動作と制限が適用される。