Anthropic 於 9 月 22 日推出 Claude Opus 5.5。Anthropic 表示,它在多數工作上的表現接近 Fable 5.1,價格則低於 Opus 5。
對已使用 Opus 5 的團隊來說,這次更新不只是換成較便宜的模型 ID。Opus 5.5 一律使用自適應 thinking,預設力度為 medium,並拒絕 Opus 5 原本接受的多種請求格式。它也被列為 Fable 5.1 之下、適合有人監督日常工作的推薦模型;Fable 則保留給最困難、耗時最長的自主任務。
重大變化
- 改變了什麼:Opus 5.5 將輸入與輸出費率降低 20%,快取讀取費率降低 60%。一律啟用的自適應 thinking,也改變了既有 API 用戶端必須如何提出請求及估算預算。
- 為何重要:長時間代理任務會反覆讀取先前指示與工具結果。最大幅度的降價適用於這些重複使用的上下文,因此快取使用情況是了解整項任務帳單的關鍵。
- 值得觀察:Anthropic 宣布 Sonnet 5.5 與 Haiku 5.5 將於未來幾週推出;Opus 是首款可用模型。選擇預設模型時,應比較任務完成後的成本,以及各級模型所需的審查程度。
Opus 5.5 定位為 Fable 級別之下的正式環境工作模型
Anthropic 在合作夥伴資料中建議,將 Opus 5.5 作為企業正式環境中程式開發、金融與法律知識工作,以及代理程式的預設選擇。其 公開模型選擇指南指出,多數工作負載可從 Opus 5.5 開始,並將它配對至複雜的代理式程式開發與企業工作。另一份 成本指南則稱它適合擔任有人監督的功能開發、除錯與程式碼審查日常主力。兩份指南都將 Fable 5.1 列為更高階選項,適用於能力要求最高,或比 token 價格更重視長時間、困難任務的情境。
Anthropic 的 提示工程指南以公司內部測試補充上述適用範圍,涵蓋根因分析、程式碼檢查、平行子代理程式、研究、試算表、報告與簡報。指南也描述更清楚的進度訊息和最終摘要,以及視覺理解與電腦操作方面的改進。這些是 Anthropic 的評估,不是 BIG CHANGE 執行的測試。
Opus 與 Fable 的差異很重要:Fable 5.1 每百萬輸入 token 收費 10 美元、每百萬輸出 token 收費 50 美元;Opus 5.5 則為 4 美元和 20 美元。兩者的快取讀取費率差距小得多,分別為 0.25 美元和 0.20 美元。因此,對長時間且大量使用快取的工作階段而言,實際價差可能低於輸入與輸出標價所呈現的差距。
Claude Opus 5.5 調整四項 API 費率
下表標準 API 價格均以每百萬 token 計。Anthropic 的 模型參考文件列出 Opus 5.5 提供 100 萬 token 上下文視窗及最多 128,000 token 輸出。其 價格文件指出,使用完整上下文視窗仍適用標準費率。
API 費用 | Opus 5.5 | Opus 5 | 變化 |
|---|---|---|---|
輸入 | $4 | $5 | 降低 20% |
輸出 | $20 | $25 | 降低 20% |
5 分鐘快取寫入 | $5 | $6.25 | 降低 20% |
快取讀取 | $0.20 | $0.50 | 降低 60% |
Anthropic 表示,預設設定下的典型工作負載成本降低 40%,這是費率與 token 效率合併計算的結果。其 任務成本說明解釋了不同工作型態的影響:長時間代理工作階段會反覆讀取不斷增加的上下文;輸出包含 thinking token;單一任務也可能進行許多回合。大量使用快取的工作階段,可能主要受惠於快取讀取費降低 60%;短小且未使用快取、但答案較長的請求,則更接近輸出費率降低 20% 的幅度。
依提示工程指南所述,輸出生成速度提升超過 30%。這並未衡量等待工具、測試、外部服務或審查者所花的時間。Anthropic 也推出更快速的 API 模式,輸入每百萬 token 收費 8 美元、輸出收費 40 美元;目前在 Claude API 上屬研究預覽,不適用於合作夥伴雲端平台。
Anthropic 也提高 Pro、Max、Team 與按席位計價 Enterprise 方案的五小時用量上限,並提供可累積的重設額度。訂閱方案的用量與 API 計費分開。
公司基準測試呈現優勢與界限
Anthropic 回報,在 xhigh 力度下,Opus 5.5 的 Terminal-Bench 4.0 分數為 66.4%;Opus 5 為 52.3%,Fable 5.1 為 55.8%。其他多數主要結果採用 max 力度。
所列 AutomationBench 與 Terminal-Bench-Science 項目均由 GPT-6 Astra 領先。受安全防護的網路任務使用 Opus 4.8;生物學與前沿模型開發任務則使用 Opus 5。AutomationBench 未使用回退機制。
Anthropic 表示,其行為稽核中不可逆或超出範圍的行動減少。其 提示工程指南也回報,相較於較早的 Opus 模型,對間接提示注入的抵抗力有所提升。兩者都是公司自行進行的測試結果,並非通用安全認證。
既有 API 用戶端需要明確遷移
API 客戶必須明確指定 claude-opus-5-5;既有 Opus 5 請求不會自動切換模型。 遷移參考文件列出多項請求變更;若未處理,可能回傳錯誤或改變應用程式的輸出串流。
遷移項目 | Opus 5.5 行為 |
|---|---|
模型選擇 | 明確使用 |
Thinking | 自適應 thinking 一律啟用。停用 thinking 或手動設定 token 預算都會回傳 HTTP 400 錯誤。 |
力度 | 使用 |
強制工具 | |
電腦操作 | 舊版 |
進度文字 | 工具呼叫之間的文字會出現在 thinking 區塊中,因此若用戶端省略預設的顯示設定,兩次呼叫間可能看起來像沒有反應。 |
保留 thinking 為長時間運作的用戶端增添另一項限制。Thinking 區塊會綁定模型與對話前綴。對於在 2026 年 8 月 31 日或之後建立的 API 與雲端平台帳戶,若在重播區塊前變更較早的指示、工具或訊息,預設會回傳 400 錯誤。Anthropic 的保留 thinking 文件說明了只能附加新內容的操作方式,以及在受控情況下捨棄不相容區塊的選項。
安全路由可能改變實際回覆的模型
Anthropic 的 提示工程指南說明了 Fable 5.1 級別的生物學防護措施,以及用於網路安全與推理資訊擷取的分類器。搜尋原始碼漏洞仍屬允許範圍,組織也可申請生命科學驗證。Anthropic 宣布將於未來幾週擴大網路安全驗證。
拒絕回覆仍可能伴隨 HTTP 200 與 stop_reason: "refusal"。 回退文件說明伺服器端回退、SDK 中介軟體與用戶端管理重試等方式。只有在設定了其中一項支援機制時才會回退;Opus 5.5 的每個請求都不保證自動回退。沒有建議回退選項的類別仍可能遭到拒絕。
因此,實際提供服務的模型也是結果的一部分。遷移至 Opus 5.5 的應用程式,應將拒絕回覆與由回退模型提供的回覆分開記錄,尤其是涉及受安全防護領域的工作。較低費率與較廣能力的主張適用於 Opus 5.5;路由後的請求則遵循實際回覆模型的行為與限制。



