AI-translated from English; not yet reviewed by a fluent editor.

# Claude Opus 5.5 下调 API 价格并带来迁移变化

> Anthropic 的 Opus 5.5 降低了令牌价格，定位为低于 Fable 5.1、适用于有人监督的企业工作；与此同时，API 客户端还将面对不兼容的思考与工具变更，以及有条件的回退机制。

By BIG CHANGE Editorial

Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

![A large abstract work capsule travels on a broad supported track while a separate side track ends at an unlabelled gate.](https://bigchange.ai/api/media/file/claude-opus-5-5-access-boundary-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.

Anthropic 于 9 月 22 日[推出 Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5)。该模型称，在大多数工作中表现接近 Fable 5.1，价格则低于 Opus 5。

对于已经使用 Opus 5 的团队，这次更新不只是换成更便宜的模型 ID。Opus 5.5 始终启用自适应思考，默认使用 medium 努力度，并拒绝 Opus 5 曾接受的若干请求格式。Anthropic 还将它定位在 Fable 5.1 之下，作为有人监督工作推荐的日常模型，而将 Fable 留给最困难、持续时间最长的自主任务。

## 重大变化

- **变化内容：**Opus 5.5 将输入和输出费率下调 20%，缓存读取费率下调 60%。始终启用自适应思考也改变了现有 API 客户端请求和预算工作量的方式。
- **为何重要：**长时间运行的智能体任务会反复读取先前的指令和工具结果。最大幅度的降价针对重复使用的上下文，因此缓存用量成为理解整项任务账单的关键。
- **关注事项：**Sonnet 5.5 和 Haiku 5.5 已宣布将在未来几周推出；Opus 是首个可用型号。选择默认模型时，应比较已完成任务的成本以及各档模型所需的审核量。

## Opus 5.5 面向低于 Fable 档的生产工作

Anthropic 在合作伙伴材料中的定位建议，将 Opus 5.5 作为生产编码、金融和法律知识工作以及智能体的企业默认选择。其[公开模型选择指南](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model)称，大多数工作负载可从 Opus 5.5 开始，并将其用于复杂的智能体编码和企业工作。另一份[成本指南](https://claude.com/blog/what-a-task-costs-on-opus-5-5)将它称为适用于有人监督的功能开发、调试和代码审查的“日常主力”。两份指南都将 Fable 5.1 列为更高一档：当最高能力或长时间、难度大的运行比令牌价格更重要时，可选择 Fable。

Anthropic 的[提示指南](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5)通过公司内部测试展示了这种广泛用途，涵盖根因分析、代码检查、并行子智能体、研究、电子表格、报告和演示文稿。指南还介绍了更清晰的进度消息和最终摘要，以及视觉理解和计算机使用方面的改进。这些是 Anthropic 的评估，并非 BIG CHANGE 执行的测试。

Opus 与 Fable 的差别很重要：Fable 5.1 的价格为每百万输入令牌 10 美元、每百万输出令牌 50 美元，而 Opus 5.5 分别为 4 美元和 20 美元。缓存读取价格则更接近，分别为 0.25 美元和 0.20 美元。因此，对于长时间使用缓存的会话，实际价差可能小于输入和输出费率所显示的差距。

## Claude Opus 5.5 调整了四项 API 费率

下表为标准 API 价格，单位是每百万令牌。Anthropic 的[模型参考](https://platform.claude.com/docs/en/models/opus-5-5/overview)列出 Opus 5.5 的上下文窗口为 100 万令牌，最大输出为 128,000 令牌。其[定价文档](https://platform.claude.com/docs/en/about-claude/pricing)说明，整个上下文窗口均按标准费率计价。

| API 费用 | Opus 5.5 | Opus 5 | 变化 |
| --- | --- | --- | --- |
| 输入 | 4 美元 | 5 美元 | 降低 20% |
| 输出 | 20 美元 | 25 美元 | 降低 20% |
| 5 分钟缓存写入 | 5 美元 | 6.25 美元 | 降低 20% |
| 缓存读取 | 0.20 美元 | 0.50 美元 | 降低 60% |

Anthropic 称，在默认设置下，典型工作负载的成本降低了 40%，这一结果综合考虑了费率和令牌效率。其[任务成本说明](https://claude.com/blog/what-a-task-costs-on-opus-5-5)展示了成本构成为何重要：长时间的智能体会话会反复读取不断增长的上下文，输出包含思考令牌，一项任务也可能包含许多轮交互。对于大量读取缓存的会话，缓存读取成本降低 60% 可能占据主导；而对于没有缓存、回答较长的短请求，成本变化则更接近输出费率下调 20% 的幅度。

根据提示指南，所报告的 30% 以上提升指的是输出生成速度，并不衡量等待工具、测试、外部服务或审核者所花的时间。Anthropic 还提供更快的 API 模式，价格为每百万令牌输入 8 美元、输出 40 美元；该模式目前仅在 Claude API 上处于研究预览阶段，尚未覆盖合作伙伴云平台。

Anthropic 还提高了 Pro、Max、Team 和按席位计费的 Enterprise 计划的五小时限额，并提供可累积的重置额度。订阅容量与 API 计费彼此独立。

## 公司基准测试呈现出优势与边界

Anthropic 报告称，在 Terminal-Bench 4.0 中，Opus 5.5 使用 xhigh 努力度时得分为 66.4%，Opus 5 为 52.3%，Fable 5.1 为 55.8%。其他大多数重点结果使用 max 努力度。

展示的 AutomationBench 和 Terminal-Bench-Science 项目中，GPT-6 Astra 领先。受安全措施保护的网络安全任务使用 Opus 4.8；生物学和前沿模型开发任务使用 Opus 5。AutomationBench 未使用回退机制。

Anthropic 报告称，在其行为审计中，不可逆操作或越界操作有所减少。其[提示指南](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5)还报告称，与此前的 Opus 模型相比，该模型对间接提示注入的抵御能力更强。这两项都是公司自行开展的测试结果，并非通用安全认证。

## 现有 API 客户端需要明确迁移

API 客户必须请求 `claude-opus-5-5`；现有 Opus 5 请求不会自动切换模型。[迁移参考](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5)列出了若干请求变更；忽略这些变更可能导致错误，或改变应用的输出流。

| 迁移事项 | Opus 5.5 的行为 |
| --- | --- |
| 模型选择 | 使用 `claude-opus-5-5`。 |
| 思考 | 自适应思考始终启用。禁用思考和手动设置令牌预算都会返回 HTTP 400。 |
| 力度 | 使用 `low`、`medium`、`high`、`xhigh` 或 `max`；默认值为 `medium`。 |
| 强制工具 | `tool_choice`值 `any` 和 `tool`会返回 HTTP 400；`auto` 和 `none`仍受支持。 |
| 计算机使用 | 旧版 `computer_20251124`工具在 Claude API 和 Google Cloud 上会被拒绝；Amazon Bedrock 仍支持该工具。 |
| 进度文本 | 工具调用之间的文本会出现在思考块中，因此，使用默认省略显示内容的客户端可能会显得在两次调用之间没有响应。 |

对于长期运行的客户端，保留思考块又增加了一层限制。思考块与模型和对话前缀绑定。对于在 2026 年 8 月 31 日或之后创建的 API 和云平台账户，若在重放思考块前修改先前的指令、工具或消息，默认会返回 400 错误。[Anthropic 关于保留思考的文档](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking)介绍了只能追加的处理路径，以及在受控情况下丢弃不兼容思考块的选项。

## 安全路由可能改变实际回答的模型

这份[提示指南](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5)介绍了 Fable 5.1 级别的生物学安全措施，以及针对网络安全和推理提取的分类器。查找源代码漏洞仍属允许范围，组织也可以申请生命科学验证。Anthropic 宣布将在未来几周扩大网络安全验证范围。

拒绝请求时，仍可能返回 HTTP 200 和 `stop_reason: "refusal"`。[关于回退的文档](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback)介绍了服务器端回退、SDK 中间件和由客户端管理的重试。只有配置了这些受支持路径之一时才会发生回退；每个 Opus 5.5 请求都不会自动获得回退保证。对于没有推荐回退方式的类别，请求仍可能被拒绝。

因此，实际提供服务的模型本身也是结果的一部分。迁移到 Opus 5.5 的应用需要分别记录拒绝响应和由回退模型提供服务的响应，尤其是在工作涉及受安全措施保护的领域时。较低费率和更广泛的能力声明适用于 Opus 5.5；经过路由的请求则遵循实际作答模型的行为和限制。

## Sources

- [Anthropic：推出 Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — 关于模型的首发公告，介绍了 Anthropic 对典型工作负载成本和速度的主张、基准测试、订阅者限额调整及安全措施。已发布的测试和早期用户案例均为公司报告，并非覆盖所有任务的独立结果。
- [Claude 平台：Claude Opus 5.5 更新内容](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — 实时模型与迁移参考，说明 API ID、服务提供方支持情况、价格、力度默认值、不支持的思考或工具设置、快速模式范围及计算机使用工具迁移。部署前请检查所选服务提供方的支持情况。
- [Claude 平台：保留思考](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — 说明返回的思考块与模型绑定，以及对话前缀只能追加的规则。默认前缀检查适用于 2026 年 8 月 31 日或之后创建的账户；对于 Anthropic 管理的界面，此功能不要求客户端直接更改。
- [Claude 平台：拒绝与回退](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — 说明分类器拒绝会以 HTTP 200 响应返回，并包含 stop_reason refusal 和类别详情；文档还介绍了回退选项。HTTP 状态成功并不能证明所请求的模型已完成任务。
- [Claude Opus 5.5 模型参考](https://platform.claude.com/docs/en/models/opus-5-5/overview) — 关于 100 万令牌上下文窗口、最多 128,000 个输出令牌、标准和缓存价格、默认 medium 努力度、模型 ID 及受支持平台的官方规格说明。本文不根据这些规格推断性能。
- [Opus 5.5 上一项任务的成本](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Anthropic 产品指南解释了交互轮次、缓存读取、输出和力度如何影响任务成本，并将 Opus 5.5 定位为低于 Fable 5.1、适用于有人监督的日常工作的模型。指南中的示例是公司的说明性指导，并非 BIG CHANGE 测试。
- [向 Claude Opus 5.5 提示](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — 官方指南介绍了公司测试过的编码、知识工作、沟通、视觉理解、计算机使用和多智能体能力，以及输出生成速度主张和进度更新行为。这些属于 Anthropic 的评估，并非 BIG CHANGE 产品测试。
- [如何选择合适的 Claude 模型](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — 官方选择矩阵称，大多数工作负载从 Opus 5.5 开始，将其用于复杂的智能体编码和企业工作，并将 Fable 5.1 留给需要最高可用能力的场景。这为模型档位定位提供了依据，不仅依赖合作伙伴材料。
- [Claude 平台定价](https://platform.claude.com/docs/en/about-claude/pricing) — 官方定价参考确认，Claude 4.6 及之后的模型均以标准令牌费率覆盖完整的 100 万令牌上下文窗口。该来源还确认了比较中使用的提示缓存和快速模式费率。
