Anthropic 于 9 月 22 日推出 Claude Opus 5.5。该模型称,在大多数工作中表现接近 Fable 5.1,价格则低于 Opus 5。
对于已经使用 Opus 5 的团队,这次更新不只是换成更便宜的模型 ID。Opus 5.5 始终启用自适应思考,默认使用 medium 努力度,并拒绝 Opus 5 曾接受的若干请求格式。Anthropic 还将它定位在 Fable 5.1 之下,作为有人监督工作推荐的日常模型,而将 Fable 留给最困难、持续时间最长的自主任务。
重大变化
- 变化内容:Opus 5.5 将输入和输出费率下调 20%,缓存读取费率下调 60%。始终启用自适应思考也改变了现有 API 客户端请求和预算工作量的方式。
- 为何重要:长时间运行的智能体任务会反复读取先前的指令和工具结果。最大幅度的降价针对重复使用的上下文,因此缓存用量成为理解整项任务账单的关键。
- 关注事项:Sonnet 5.5 和 Haiku 5.5 已宣布将在未来几周推出;Opus 是首个可用型号。选择默认模型时,应比较已完成任务的成本以及各档模型所需的审核量。
Opus 5.5 面向低于 Fable 档的生产工作
Anthropic 在合作伙伴材料中的定位建议,将 Opus 5.5 作为生产编码、金融和法律知识工作以及智能体的企业默认选择。其公开模型选择指南称,大多数工作负载可从 Opus 5.5 开始,并将其用于复杂的智能体编码和企业工作。另一份成本指南将它称为适用于有人监督的功能开发、调试和代码审查的“日常主力”。两份指南都将 Fable 5.1 列为更高一档:当最高能力或长时间、难度大的运行比令牌价格更重要时,可选择 Fable。
Anthropic 的提示指南通过公司内部测试展示了这种广泛用途,涵盖根因分析、代码检查、并行子智能体、研究、电子表格、报告和演示文稿。指南还介绍了更清晰的进度消息和最终摘要,以及视觉理解和计算机使用方面的改进。这些是 Anthropic 的评估,并非 BIG CHANGE 执行的测试。
Opus 与 Fable 的差别很重要:Fable 5.1 的价格为每百万输入令牌 10 美元、每百万输出令牌 50 美元,而 Opus 5.5 分别为 4 美元和 20 美元。缓存读取价格则更接近,分别为 0.25 美元和 0.20 美元。因此,对于长时间使用缓存的会话,实际价差可能小于输入和输出费率所显示的差距。
Claude Opus 5.5 调整了四项 API 费率
下表为标准 API 价格,单位是每百万令牌。Anthropic 的模型参考列出 Opus 5.5 的上下文窗口为 100 万令牌,最大输出为 128,000 令牌。其定价文档说明,整个上下文窗口均按标准费率计价。
API 费用 | Opus 5.5 | Opus 5 | 变化 |
|---|---|---|---|
输入 | 4 美元 | 5 美元 | 降低 20% |
输出 | 20 美元 | 25 美元 | 降低 20% |
5 分钟缓存写入 | 5 美元 | 6.25 美元 | 降低 20% |
缓存读取 | 0.20 美元 | 0.50 美元 | 降低 60% |
Anthropic 称,在默认设置下,典型工作负载的成本降低了 40%,这一结果综合考虑了费率和令牌效率。其任务成本说明展示了成本构成为何重要:长时间的智能体会话会反复读取不断增长的上下文,输出包含思考令牌,一项任务也可能包含许多轮交互。对于大量读取缓存的会话,缓存读取成本降低 60% 可能占据主导;而对于没有缓存、回答较长的短请求,成本变化则更接近输出费率下调 20% 的幅度。
根据提示指南,所报告的 30% 以上提升指的是输出生成速度,并不衡量等待工具、测试、外部服务或审核者所花的时间。Anthropic 还提供更快的 API 模式,价格为每百万令牌输入 8 美元、输出 40 美元;该模式目前仅在 Claude API 上处于研究预览阶段,尚未覆盖合作伙伴云平台。
Anthropic 还提高了 Pro、Max、Team 和按席位计费的 Enterprise 计划的五小时限额,并提供可累积的重置额度。订阅容量与 API 计费彼此独立。
公司基准测试呈现出优势与边界
Anthropic 报告称,在 Terminal-Bench 4.0 中,Opus 5.5 使用 xhigh 努力度时得分为 66.4%,Opus 5 为 52.3%,Fable 5.1 为 55.8%。其他大多数重点结果使用 max 努力度。
展示的 AutomationBench 和 Terminal-Bench-Science 项目中,GPT-6 Astra 领先。受安全措施保护的网络安全任务使用 Opus 4.8;生物学和前沿模型开发任务使用 Opus 5。AutomationBench 未使用回退机制。
Anthropic 报告称,在其行为审计中,不可逆操作或越界操作有所减少。其提示指南还报告称,与此前的 Opus 模型相比,该模型对间接提示注入的抵御能力更强。这两项都是公司自行开展的测试结果,并非通用安全认证。
现有 API 客户端需要明确迁移
API 客户必须请求 claude-opus-5-5;现有 Opus 5 请求不会自动切换模型。迁移参考列出了若干请求变更;忽略这些变更可能导致错误,或改变应用的输出流。
迁移事项 | Opus 5.5 的行为 |
|---|---|
模型选择 | 使用 |
思考 | 自适应思考始终启用。禁用思考和手动设置令牌预算都会返回 HTTP 400。 |
力度 | 使用 |
强制工具 | |
计算机使用 | 旧版 |
进度文本 | 工具调用之间的文本会出现在思考块中,因此,使用默认省略显示内容的客户端可能会显得在两次调用之间没有响应。 |
对于长期运行的客户端,保留思考块又增加了一层限制。思考块与模型和对话前缀绑定。对于在 2026 年 8 月 31 日或之后创建的 API 和云平台账户,若在重放思考块前修改先前的指令、工具或消息,默认会返回 400 错误。Anthropic 关于保留思考的文档介绍了只能追加的处理路径,以及在受控情况下丢弃不兼容思考块的选项。
安全路由可能改变实际回答的模型
这份提示指南介绍了 Fable 5.1 级别的生物学安全措施,以及针对网络安全和推理提取的分类器。查找源代码漏洞仍属允许范围,组织也可以申请生命科学验证。Anthropic 宣布将在未来几周扩大网络安全验证范围。
拒绝请求时,仍可能返回 HTTP 200 和 stop_reason: "refusal"。关于回退的文档介绍了服务器端回退、SDK 中间件和由客户端管理的重试。只有配置了这些受支持路径之一时才会发生回退;每个 Opus 5.5 请求都不会自动获得回退保证。对于没有推荐回退方式的类别,请求仍可能被拒绝。
因此,实际提供服务的模型本身也是结果的一部分。迁移到 Opus 5.5 的应用需要分别记录拒绝响应和由回退模型提供服务的响应,尤其是在工作涉及受安全措施保护的领域时。较低费率和更广泛的能力声明适用于 Opus 5.5;经过路由的请求则遵循实际作答模型的行为和限制。



