AI-translated from English; not yet reviewed by a fluent editor.
# Claude Opus 5.5 reduz preços da API e exige mudanças na migração
> O Opus 5.5 da Anthropic reduz os preços por token e mira tarefas empresariais supervisionadas, abaixo do Fable 5.1; clientes da API enfrentam mudanças incompatíveis no raciocínio e nas ferramentas, além de fallback condicional.
By BIG CHANGE Editorial
Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.
A Anthropic [lançou o Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) em 22 de setembro. A empresa afirma que ele tem desempenho próximo ao Fable 5.1 na maioria das tarefas, com preços inferiores aos do Opus 5.
Para equipes que já usam o Opus 5, a atualização vai além de um ID de modelo mais barato. O Opus 5.5 sempre usa raciocínio adaptativo, tem esforço médio como padrão e rejeita alguns formatos de solicitação aceitos pelo Opus 5. Também fica abaixo do Fable 5.1 como modelo diário recomendado pela Anthropic para trabalho supervisionado; o Fable fica reservado para tarefas autônomas mais difíceis e longas.
## A grande mudança
- **O que mudou:** O Opus 5.5 reduz em 20% as tarifas de entrada e saída e em 60% a tarifa de leitura do cache. O raciocínio adaptativo sempre ativado também muda como os clientes atuais da API precisam solicitar e orçar o trabalho.
- **Por que isso importa:** Tarefas longas de agentes leem repetidamente instruções anteriores e resultados de ferramentas. O maior corte de preço incide sobre esse contexto reutilizado, então o uso do cache passa a ser central para entender a conta total da tarefa.
- **O que observar:** Sonnet 5.5 e Haiku 5.5 foram anunciados para as próximas semanas; o Opus é o primeiro disponível. Para escolher um modelo padrão, é preciso comparar o custo das tarefas concluídas e o nível de revisão exigido em cada categoria.
## O Opus 5.5 é voltado à produção supervisionada abaixo da categoria Fable
A recomendação de parceiros da Anthropic apresenta o Opus 5.5 como opção empresarial padrão para programação em produção, trabalho especializado em finanças e direito e agentes. Seu [guia público de seleção de modelos](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) diz que a maioria das cargas de trabalho deve começar com o Opus 5.5 e o associa à programação agêntica complexa e ao trabalho empresarial. Um [guia de custos](https://claude.com/blog/what-a-task-costs-on-opus-5-5) separado o chama de “modelo para o dia a dia” em desenvolvimento supervisionado de recursos, depuração e revisão de código. Ambos colocam o Fable 5.1 acima quando a capacidade máxima ou uma tarefa longa e difícil importa mais do que o preço por token.
O [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) da Anthropic sustenta essa abrangência com testes da empresa em análise de causa raiz, verificação de código, subagentes paralelos, pesquisa, planilhas, relatórios e apresentações. Também descreve mensagens de progresso e resumos finais mais claros, além de melhorias de visão e uso do computador. São avaliações da Anthropic, não testes feitos pela BIG CHANGE.
A distinção entre Opus e Fable importa porque o Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, contra US$ 4 e US$ 20 do Opus 5.5. Os valores de leitura do cache são mais próximos: US$ 0,25 e US$ 0,20. Assim, em sessões longas com cache, a diferença pode ser menor do que sugerem as tarifas principais de entrada e saída.
## Os preços do Claude Opus 5.5 alteram quatro tarifas da API
Os preços padrão da API abaixo são por milhão de tokens. A [referência do modelo](https://platform.claude.com/docs/en/models/opus-5-5/overview) da Anthropic informa uma janela de contexto de 1 milhão de tokens e uma saída máxima de 128.000 tokens para o Opus 5.5. A [documentação de preços](https://platform.claude.com/docs/en/about-claude/pricing) diz que a janela de contexto inteira usa as tarifas padrão.
| Cobrança da API | Opus 5.5 | Opus 5 | Variação |
| --- | --- | --- | --- |
| Entrada | US$ 4 | US$ 5 | 20% menor |
| Saída | US$ 20 | US$ 25 | 20% menor |
| Gravação no cache por 5 minutos | US$ 5 | US$ 6,25 | 20% menor |
| Leitura do cache | US$ 0,20 | US$ 0,50 | 60% menor |
A Anthropic relata custo 40% menor em cargas de trabalho típicas nas configurações padrão, combinando tarifas com eficiência no uso de tokens. Sua [explicação do custo por tarefa](https://claude.com/blog/what-a-task-costs-on-opus-5-5) mostra por que a combinação importa: sessões longas de agentes leem repetidamente o contexto crescente, a saída inclui tokens de raciocínio e uma tarefa pode ter muitos turnos. Uma redução de 60% na leitura do cache pode dominar uma sessão que o utiliza intensamente, enquanto uma solicitação curta sem cache e com resposta longa se aproxima mais do corte de 20% na tarifa de saída.
Segundo o guia de prompting, o aumento de mais de 30% relatado diz respeito à velocidade de geração de saída. Não mede o tempo gasto esperando por ferramentas, testes, serviços externos ou um revisor. A Anthropic também oferece um modo mais rápido na API, a US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída, em prévia de pesquisa apenas na API Claude, não nas plataformas de nuvem de parceiros.
A Anthropic também aumentou os limites de sessões de cinco horas nos planos Pro, Max, Team e Enterprise por licença e ofereceu uma reposição acumulável. A capacidade da assinatura é separada da cobrança da API.
## Benchmarks da empresa mostram pontos fortes e limites
A Anthropic informa pontuações no Terminal-Bench 4.0 de 66,4% para o Opus 5.5 no nível xhigh, 52,3% para o Opus 5 e 55,8% para o Fable 5.1. A maioria dos outros resultados em destaque usa o nível máximo de esforço.
O GPT-6 Astra lidera as linhas exibidas do AutomationBench e do Terminal-Bench-Science. As tarefas cibernéticas com salvaguardas usaram o Opus 4.8; as tarefas de biologia e desenvolvimento de modelos de fronteira usaram o Opus 5. O AutomationBench não usou fallback.
A Anthropic relata menos ações irreversíveis ou fora dos limites em sua auditoria comportamental. Seu [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) também relata maior resistência a injeções indiretas de prompt em comparação com modelos Opus anteriores. Ambos são resultados de testes conduzidos pela empresa, não uma certificação geral de segurança.
## Clientes existentes da API precisam fazer uma migração explícita
Clientes da API precisam solicitar `claude-opus-5-5`; chamadas existentes ao Opus 5 não mudam de modelo silenciosamente. A [referência de migração](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) lista várias alterações em solicitações que, caso contrário, podem gerar erros ou mudar o fluxo de saída do aplicativo.
| Ponto de migração | Comportamento do Opus 5.5 |
| --- | --- |
| Seleção do modelo | Use `claude-opus-5-5` explicitamente. |
| Raciocínio | O raciocínio adaptativo está sempre ativado. Desativar o raciocínio e definir limites manuais de tokens geram erro HTTP 400. |
| Esforço | Use `low`, `medium`, `high`, `xhigh` ou `max`; o padrão é `medium`. |
| Ferramentas forçadas | `tool_choice` Os valores `any` e `tool` geram erro HTTP 400; `auto` e `none` continuam compatíveis. |
| Uso do computador | A ferramenta antiga de `computer_20251124` é rejeitada na API Claude e no Google Cloud; o Amazon Bedrock continua aceitando-a. |
| Texto de progresso | O texto entre chamadas de ferramentas chega em blocos de raciocínio; assim, um cliente que oculta esses blocos por padrão pode parecer inativo entre chamadas. |
O raciocínio preservado acrescenta outro limite para clientes de longa duração. Os blocos de raciocínio estão vinculados a um modelo e a um prefixo de conversa. Nas contas de API e plataformas de nuvem criadas em ou após 31 de agosto de 2026, alterar instruções, ferramentas ou mensagens anteriores antes de reproduzir um bloco gera, por padrão, um erro 400. [A documentação da Anthropic sobre raciocínio preservado](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) explica o caminho que permite apenas acrescentar conteúdo e a opção controlada de descartar um bloco incompatível.
## O roteamento de segurança pode mudar o modelo que responde
O [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) descreve salvaguardas de biologia no nível do Fable 5.1 e classificadores para cibersegurança e extração de raciocínio. A busca de vulnerabilidades em código-fonte continua permitida, e organizações podem solicitar verificação para ciências da vida. Uma ampliação da verificação cibernética foi anunciada para as próximas semanas.
Uma recusa ainda pode vir acompanhada do HTTP 200 e de `stop_reason: "refusal"`. A [documentação de fallback](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) descreve fallback no servidor, middleware do SDK e novas tentativas gerenciadas pelo cliente. O fallback só ocorre quando um desses caminhos compatíveis está configurado; ele não é uma promessa automática para cada solicitação ao Opus 5.5. Categorias sem fallback recomendado ainda podem ser recusadas.
Isso torna o modelo que atende a solicitação parte do resultado. Um aplicativo migrando para o Opus 5.5 precisa registrar separadamente as recusas e as respostas fornecidas por fallback, sobretudo quando o trabalho envolve áreas protegidas. As tarifas menores e as alegações mais amplas de capacidade se aplicam ao Opus 5.5; uma solicitação roteada segue o comportamento e os limites do modelo que efetivamente respondeu.
## Sources
- [Anthropic: apresentação do Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — Anúncio primário do lançamento, das alegações da Anthropic sobre custo e velocidade em cargas de trabalho típicas, benchmarks, mudanças nos limites de assinantes e abordagem de segurança. Testes publicados e exemplos de usuários iniciais são relatos da empresa, não resultados independentes para todas as tarefas.
- [Claude Platform: novidades do Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — Referência atual do modelo e da migração: ID da API, disponibilidade em provedores, preços, padrões de esforço, configurações de raciocínio e ferramentas incompatíveis, escopo do modo rápido e migração da ferramenta de uso do computador. Verifique o suporte do provedor escolhido antes da implantação.
- [Claude Platform: raciocínio preservado](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — Explica o vínculo com o modelo e as regras de prefixo de conversa que permite apenas acréscimos para blocos de raciocínio retornados. A verificação padrão do prefixo se aplica a contas criadas em ou após 31 de agosto de 2026; interfaces gerenciadas pela Anthropic não exigem alterações diretas no cliente para este recurso.
- [Claude Platform: recusas e fallback](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — Documenta recusas do classificador como respostas HTTP 200 com stop_reason refusal e detalhes da categoria, além de opções de fallback. Um status HTTP de sucesso não prova que o modelo solicitado concluiu a tarefa.
- [Referência do modelo Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview) — Especificação oficial da janela de contexto de 1 milhão de tokens, saída máxima de 128 mil tokens, preços padrão e de cache, esforço médio padrão, IDs de modelo e plataformas compatíveis. O artigo não infere desempenho a partir destas especificações.
- [Quanto custa uma tarefa no Opus 5.5](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Orientação de produto da Anthropic que explica como turnos, leituras do cache, saída e esforço influenciam o custo da tarefa e posiciona o Opus 5.5 como modelo diário supervisionado abaixo do Fable 5.1. Os exemplos são orientações ilustrativas da empresa, não testes da BIG CHANGE.
- [Como usar prompts com o Claude Opus 5.5](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — Orientação oficial sobre capacidades testadas pela empresa em programação, trabalho especializado, comunicação, tarefas visuais, uso do computador e sistemas multiagentes, além da alegação sobre velocidade de geração de saída e do comportamento de atualização de progresso. São avaliações da Anthropic, não testes de produto da BIG CHANGE.
- [Como escolher o modelo Claude certo](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — A matriz oficial de seleção diz que a maioria das cargas de trabalho deve começar com o Opus 5.5, associa-o à programação agêntica complexa e ao trabalho empresarial e reserva o Fable 5.1 para a maior capacidade disponível. Isso sustenta o posicionamento por categoria sem depender apenas de material de parceiros.
- [Preços da Claude Platform](https://platform.claude.com/docs/en/about-claude/pricing) — A referência oficial de preços confirma que os modelos Claude 4.6 e posteriores incluem a janela de contexto completa de 1 milhão de tokens nas tarifas padrão por token. Também confirma as tarifas de cache de prompts e do modo rápido usadas na comparação.
Newsletter da BIG CHANGE
A visão ampla, no seu ritmo.
Matérias recentes sobre IA e robótica, mudanças que merecem atenção e ideias práticas para usar. Escolha um briefing diário, um resumo semanal ou uma perspectiva mensal.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
Sua privacidade, sua escolha.
O armazenamento necessário ajuda a proteger o site e a lembrar suas escolhas. O Google Analytics opcional permanece desativado até você autorizá-lo. Você pode ler todas as matérias usando apenas o armazenamento necessário. Detalhes de privacidade