Anthropic 於 9 月 22 日推出 Claude Opus 5.5。Anthropic 表示,它在多數工作上的表現接近 Fable 5.1,價格則低於 Opus 5。

對已使用 Opus 5 的團隊來說,這次更新不只是換成較便宜的模型 ID。Opus 5.5 一律使用自適應 thinking,預設力度為 medium,並拒絕 Opus 5 原本接受的多種請求格式。它也被列為 Fable 5.1 之下、適合有人監督日常工作的推薦模型;Fable 則保留給最困難、耗時最長的自主任務。

重大變化

  • 改變了什麼:Opus 5.5 將輸入與輸出費率降低 20%,快取讀取費率降低 60%。一律啟用的自適應 thinking,也改變了既有 API 用戶端必須如何提出請求及估算預算。
  • 為何重要:長時間代理任務會反覆讀取先前指示與工具結果。最大幅度的降價適用於這些重複使用的上下文,因此快取使用情況是了解整項任務帳單的關鍵。
  • 值得觀察:Anthropic 宣布 Sonnet 5.5 與 Haiku 5.5 將於未來幾週推出;Opus 是首款可用模型。選擇預設模型時,應比較任務完成後的成本,以及各級模型所需的審查程度。

Opus 5.5 定位為 Fable 級別之下的正式環境工作模型

Anthropic 在合作夥伴資料中建議,將 Opus 5.5 作為企業正式環境中程式開發、金融與法律知識工作,以及代理程式的預設選擇。其 公開模型選擇指南指出,多數工作負載可從 Opus 5.5 開始,並將它配對至複雜的代理式程式開發與企業工作。另一份 成本指南則稱它適合擔任有人監督的功能開發、除錯與程式碼審查日常主力。兩份指南都將 Fable 5.1 列為更高階選項,適用於能力要求最高,或比 token 價格更重視長時間、困難任務的情境。

Anthropic 的 提示工程指南以公司內部測試補充上述適用範圍,涵蓋根因分析、程式碼檢查、平行子代理程式、研究、試算表、報告與簡報。指南也描述更清楚的進度訊息和最終摘要,以及視覺理解與電腦操作方面的改進。這些是 Anthropic 的評估,不是 BIG CHANGE 執行的測試。

Opus 與 Fable 的差異很重要:Fable 5.1 每百萬輸入 token 收費 10 美元、每百萬輸出 token 收費 50 美元;Opus 5.5 則為 4 美元和 20 美元。兩者的快取讀取費率差距小得多,分別為 0.25 美元和 0.20 美元。因此,對長時間且大量使用快取的工作階段而言,實際價差可能低於輸入與輸出標價所呈現的差距。

Claude Opus 5.5 調整四項 API 費率

下表標準 API 價格均以每百萬 token 計。Anthropic 的 模型參考文件列出 Opus 5.5 提供 100 萬 token 上下文視窗及最多 128,000 token 輸出。其 價格文件指出,使用完整上下文視窗仍適用標準費率。

API 費用

Opus 5.5

Opus 5

變化

輸入

$4

$5

降低 20%

輸出

$20

$25

降低 20%

5 分鐘快取寫入

$5

$6.25

降低 20%

快取讀取

$0.20

$0.50

降低 60%

Anthropic 表示,預設設定下的典型工作負載成本降低 40%,這是費率與 token 效率合併計算的結果。其 任務成本說明解釋了不同工作型態的影響:長時間代理工作階段會反覆讀取不斷增加的上下文;輸出包含 thinking token;單一任務也可能進行許多回合。大量使用快取的工作階段,可能主要受惠於快取讀取費降低 60%;短小且未使用快取、但答案較長的請求,則更接近輸出費率降低 20% 的幅度。

依提示工程指南所述,輸出生成速度提升超過 30%。這並未衡量等待工具、測試、外部服務或審查者所花的時間。Anthropic 也推出更快速的 API 模式,輸入每百萬 token 收費 8 美元、輸出收費 40 美元;目前在 Claude API 上屬研究預覽,不適用於合作夥伴雲端平台。

Anthropic 也提高 Pro、Max、Team 與按席位計價 Enterprise 方案的五小時用量上限,並提供可累積的重設額度。訂閱方案的用量與 API 計費分開。

公司基準測試呈現優勢與界限

Anthropic 回報,在 xhigh 力度下,Opus 5.5 的 Terminal-Bench 4.0 分數為 66.4%;Opus 5 為 52.3%,Fable 5.1 為 55.8%。其他多數主要結果採用 max 力度。

所列 AutomationBench 與 Terminal-Bench-Science 項目均由 GPT-6 Astra 領先。受安全防護的網路任務使用 Opus 4.8;生物學與前沿模型開發任務則使用 Opus 5。AutomationBench 未使用回退機制。

Anthropic 表示,其行為稽核中不可逆或超出範圍的行動減少。其 提示工程指南也回報,相較於較早的 Opus 模型,對間接提示注入的抵抗力有所提升。兩者都是公司自行進行的測試結果,並非通用安全認證。

既有 API 用戶端需要明確遷移

API 客戶必須明確指定 claude-opus-5-5;既有 Opus 5 請求不會自動切換模型。 遷移參考文件列出多項請求變更;若未處理,可能回傳錯誤或改變應用程式的輸出串流。

遷移項目

Opus 5.5 行為

模型選擇

明確使用 claude-opus-5-5。

Thinking

自適應 thinking 一律啟用。停用 thinking 或手動設定 token 預算都會回傳 HTTP 400 錯誤。

力度

使用 low、medium、high、xhigh 或 max;預設為 medium。

強制工具

tool_choice值 any 與 tool 會回傳 HTTP 400 錯誤;auto 與 none 仍受支援。

電腦操作

舊版 computer_20251124 工具在 Claude API 與 Google Cloud 上會被拒絕;Amazon Bedrock 仍支援該工具。

進度文字

工具呼叫之間的文字會出現在 thinking 區塊中,因此若用戶端省略預設的顯示設定,兩次呼叫間可能看起來像沒有反應。

保留 thinking 為長時間運作的用戶端增添另一項限制。Thinking 區塊會綁定模型與對話前綴。對於在 2026 年 8 月 31 日或之後建立的 API 與雲端平台帳戶,若在重播區塊前變更較早的指示、工具或訊息,預設會回傳 400 錯誤。Anthropic 的保留 thinking 文件說明了只能附加新內容的操作方式,以及在受控情況下捨棄不相容區塊的選項。

安全路由可能改變實際回覆的模型

Anthropic 的 提示工程指南說明了 Fable 5.1 級別的生物學防護措施,以及用於網路安全與推理資訊擷取的分類器。搜尋原始碼漏洞仍屬允許範圍,組織也可申請生命科學驗證。Anthropic 宣布將於未來幾週擴大網路安全驗證。

拒絕回覆仍可能伴隨 HTTP 200 與 stop_reason: "refusal"。 回退文件說明伺服器端回退、SDK 中介軟體與用戶端管理重試等方式。只有在設定了其中一項支援機制時才會回退;Opus 5.5 的每個請求都不保證自動回退。沒有建議回退選項的類別仍可能遭到拒絕。

因此,實際提供服務的模型也是結果的一部分。遷移至 Opus 5.5 的應用程式,應將拒絕回覆與由回退模型提供的回覆分開記錄,尤其是涉及受安全防護領域的工作。較低費率與較廣能力的主張適用於 Opus 5.5;路由後的請求則遵循實際回覆模型的行為與限制。