AI-translated from English; not yet reviewed by a fluent editor.
# Claude Opus 5.5 reduz os preços da API e traz alterações que exigem migração
> O Opus 5.5 da Anthropic reduz os preços por token e destina-se a trabalho empresarial supervisionado, abaixo do Fable 5.1. Os clientes da API enfrentam alterações incompatíveis no raciocínio e nas ferramentas, além de mecanismos de contingência condicionais.
By BIG CHANGE Editorial
Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.
A Anthropic [lançou o Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) a 22 de setembro. Afirma que o desempenho é próximo do Fable 5.1 na maioria das tarefas, com preços inferiores aos do Opus 5.
Para as equipas que já utilizam o Opus 5, a atualização é mais do que um identificador de modelo mais barato. O Opus 5.5 utiliza sempre raciocínio adaptativo, tem o esforço médio como predefinição e rejeita vários formatos de pedido que o Opus 5 aceitava. É também posicionado abaixo do Fable 5.1 como o modelo diário recomendado pela Anthropic para trabalho supervisionado; o Fable fica reservado às tarefas autónomas mais difíceis e longas.
## A grande mudança
- **O que mudou:** O Opus 5.5 reduz em 20% as tarifas de entrada e saída e em 60% o preço das leituras em cache. O raciocínio adaptativo sempre ativo também altera a forma como os clientes existentes da API têm de pedir e orçamentar o trabalho.
- **Porque é importante:** As tarefas longas dos agentes leem repetidamente instruções e resultados de ferramentas anteriores. A maior redução de preço aplica-se a esse contexto reutilizado, pelo que a utilização da cache é fundamental para compreender a fatura total da tarefa.
- **O que acompanhar:** O Sonnet 5.5 e o Haiku 5.5 foram anunciados para as próximas semanas; o Opus é o primeiro disponível. A escolha de um modelo predefinido exige comparar o custo das tarefas concluídas e a revisão necessária em cada nível.
## O Opus 5.5 destina-se a trabalho de produção abaixo do nível Fable
Na apresentação aos parceiros, a Anthropic recomenda o Opus 5.5 como opção empresarial predefinida para programação em produção, trabalho especializado em finanças e direito e agentes. O seu [guia público de seleção de modelos](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) afirma que a maioria das cargas de trabalho começa com o Opus 5.5 e associa-o a programação complexa com agentes e trabalho empresarial. Um guia distinto sobre [custos](https://claude.com/blog/what-a-task-costs-on-opus-5-5) chama-lhe um «modelo para o dia a dia» em tarefas supervisionadas de desenvolvimento de funcionalidades, depuração e revisão de código. Ambos os guias recomendam o Fable 5.1 quando a capacidade máxima ou uma execução longa e difícil é mais importante do que o preço dos tokens.
O [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) da Anthropic sustenta essa abrangência com testes da empresa em análise de causas de raiz, verificação de código, subagentes paralelos, investigação, folhas de cálculo, relatórios e apresentações. Descreve também mensagens de progresso e resumos finais mais claros, além de melhorias em visão e utilização do computador. São avaliações da Anthropic, não testes realizados pela BIG CHANGE.
A distinção entre o Opus e o Fable é importante porque o Fable 5.1 custa 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída, contra 4 e 20 dólares, respetivamente, para o Opus 5.5. Os preços das leituras em cache são muito mais próximos: 0,25 e 0,20 dólares. Por isso, em sessões longas que reutilizam muita informação em cache, a diferença pode ser menor do que sugerem os preços de entrada e saída apresentados em destaque.
## Claude Opus 5.5 altera quatro tarifas da API
Os preços Standard da API abaixo são por milhão de tokens. A [referência do modelo](https://platform.claude.com/docs/en/models/opus-5-5/overview) da Anthropic indica uma janela de contexto de 1 milhão de tokens e uma saída máxima de 128 000 tokens para o Opus 5.5. A sua [documentação de preços](https://platform.claude.com/docs/en/about-claude/pricing) indica que toda a janela de contexto utiliza as tarifas Standard.
| Tarifa da API | Opus 5.5 | Opus 5 | Variação |
| --- | --- | --- | --- |
| Entrada | 4 $ | 5 $ | menos 20% |
| Saída | 20 $ | 25 $ | menos 20% |
| Escrita na cache com validade de 5 minutos | 5 $ | 6,25 $ | menos 20% |
| Leitura da cache | 0,20 $ | 0,50 $ | menos 60% |
A Anthropic comunica uma redução de 40% no custo em cargas de trabalho típicas com as definições predefinidas, combinando tarifas e eficiência na utilização de tokens. A sua [explicação dos custos por tarefa](https://claude.com/blog/what-a-task-costs-on-opus-5-5) demonstra por que razão a composição da tarefa é importante: as sessões longas de agentes voltam a ler contexto crescente, a saída inclui tokens de raciocínio e uma tarefa pode envolver muitas interações. Uma redução de 60% no preço das leituras em cache pode ter um efeito dominante numa sessão que dependa muito da cache; já um pedido curto sem cache e com uma resposta longa aproxima-se mais da redução de 20% no preço da saída.
Segundo o guia de prompting, a melhoria comunicada de mais de 30% diz respeito à velocidade de geração de texto. Não mede o tempo de espera por ferramentas, testes, serviços externos ou revisores. A Anthropic também oferece um modo de API mais rápido, a 8 dólares por milhão de tokens de entrada e 40 dólares por milhão de tokens de saída, em pré-visualização de investigação na API Claude, mas não nas plataformas de nuvem dos parceiros.
A Anthropic também aumentou os limites de utilização em períodos de cinco horas nos planos Pro, Max, Team e Enterprise por lugar, e disponibilizou a reposição de limites transferível. A capacidade das subscrições é distinta da faturação da API.
## Os benchmarks da empresa mostram capacidades e limites
A Anthropic comunica resultados no Terminal-Bench 4.0 de 66,4% para o Opus 5.5 no nível xhigh, 52,3% para o Opus 5 e 55,8% para o Fable 5.1. A maioria dos restantes resultados em destaque utiliza o nível de esforço máximo.
O GPT-6 Astra lidera nas linhas apresentadas para o AutomationBench e o Terminal-Bench-Science. As tarefas de cibersegurança com salvaguardas utilizaram o Opus 4.8; as tarefas de biologia e de desenvolvimento de modelos de ponta utilizaram o Opus 5. O AutomationBench não utilizou contingência para outro modelo.
A Anthropic comunica menos ações irreversíveis ou fora dos limites definidos na sua auditoria comportamental. O seu [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) também indica maior resistência a injeções indiretas de prompts do que nos modelos Opus anteriores. Ambos são resultados de testes da empresa, não uma certificação geral de segurança.
## Os clientes atuais da API têm de fazer uma migração explícita
Os clientes da API têm de indicar `claude-opus-5-5`; as chamadas existentes ao Opus 5 não mudam silenciosamente de modelo. A [referência de migração](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) enumera várias alterações aos pedidos que, caso contrário, podem gerar erros ou alterar o fluxo de saída da aplicação.
| Aspeto da migração | Comportamento do Opus 5.5 |
| --- | --- |
| Seleção do modelo | Indique explicitamente `claude-opus-5-5`. |
| Raciocínio | O raciocínio adaptativo está sempre ativo. Desativá-lo ou definir manualmente o orçamento de tokens devolve o erro HTTP 400. |
| Esforço | Utilize `low`, `medium`, `high`, `xhigh` ou `max`; o valor predefinido é `medium`. |
| Ferramentas forçadas | `tool_choice` Os valores `any` e `tool` devolvem o erro HTTP 400; as opções `auto` e `none` continuam a ser suportadas. |
| Utilização do computador | A ferramenta anterior `computer_20251124` é rejeitada na API Claude e no Google Cloud; a Amazon Bedrock continua a suportá-la. |
| Texto de progresso | O texto apresentado entre chamadas a ferramentas é enviado em blocos de raciocínio, pelo que uma aplicação que mantenha a predefinição de não os mostrar pode parecer inativa entre chamadas. |
O raciocínio preservado introduz outro limite para clientes com execuções longas. Os blocos de raciocínio estão associados a um modelo e a um prefixo da conversa. Nas contas da API e das plataformas de nuvem criadas a partir de 31 de agosto de 2026, alterar instruções, ferramentas ou mensagens anteriores antes de voltar a enviar um bloco devolve, por predefinição, um erro 400. [A documentação da Anthropic sobre raciocínio preservado](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) explica a abordagem em que só se acrescentam elementos e a opção controlada de descartar um bloco incompatível.
## O encaminhamento por segurança pode alterar o modelo que responde
O [guia de prompting](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) descreve salvaguardas de biologia ao nível do Fable 5.1 e classificadores para cibersegurança e extração de raciocínio. A deteção de vulnerabilidades no código-fonte continua a ser permitida e as organizações podem candidatar-se à verificação na área das ciências da vida. A expansão da verificação de cibersegurança foi anunciada para as próximas semanas.
Uma recusa pode, ainda assim, ser devolvida com o código HTTP 200 e `stop_reason: "refusal"`. A documentação sobre [mecanismos de contingência](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) descreve a contingência do lado do servidor, o middleware do SDK e as tentativas novamente geridas pelo cliente. Só existe contingência quando um destes mecanismos suportados está configurado; não é uma promessa automática associada a todos os pedidos ao Opus 5.5. Os pedidos de categorias sem contingência recomendada podem continuar a ser recusados.
Por isso, o modelo que efetivamente responde faz parte do resultado. Uma aplicação que migre para o Opus 5.5 deve registar separadamente as recusas e as respostas fornecidas através de um modelo de contingência, sobretudo quando o trabalho abrange domínios protegidos. As tarifas inferiores e as alegações mais amplas sobre capacidades dizem respeito ao Opus 5.5; um pedido encaminhado segue o comportamento e os limites do modelo que realmente respondeu.
## Sources
- [Anthropic: apresentação do Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — Anúncio original de lançamento que apresenta o modelo, as alegações da Anthropic sobre custos e velocidade em tarefas típicas, os benchmarks, as alterações aos limites de subscrição e a abordagem de segurança. Os testes publicados e os exemplos de utilizadores iniciais são relatos da empresa, não resultados independentes para todas as tarefas.
- [Plataforma Claude: novidades do Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — Referência atual do modelo e da migração para o identificador da API, disponibilidade por fornecedor, preços, esforço predefinido, definições de raciocínio e ferramentas não suportadas, âmbito do modo rápido e migração da ferramenta de utilização do computador. Antes da implementação, confirme o suporte no fornecedor escolhido.
- [Plataforma Claude: raciocínio preservado](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — Explica a associação dos blocos de raciocínio devolvidos ao modelo e as regras que exigem acrescentar elementos ao prefixo da conversa sem alterar os anteriores. A verificação predefinida do prefixo aplica-se a contas criadas a partir de 31 de agosto de 2026; as interfaces geridas pela Anthropic não exigem alterações diretas no cliente para esta funcionalidade.
- [Plataforma Claude: recusas e contingência](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — Documenta as recusas acionadas por classificadores como respostas HTTP 200 com stop_reason refusal e detalhes da categoria, além das opções de contingência. Um estado HTTP de sucesso não prova que o modelo solicitado tenha concluído a tarefa.
- [Referência do modelo Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview) — Especificação oficial da janela de contexto de 1 milhão de tokens, saída máxima de 128K, preços Standard e da cache, esforço médio predefinido, identificadores de modelo e plataformas suportadas. O artigo não infere desempenho a partir destas especificações.
- [Quanto custa uma tarefa no Opus 5.5](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Orientação de produto da Anthropic que explica como as interações, as leituras da cache, a saída e o esforço contribuem para o custo de uma tarefa e posiciona o Opus 5.5 para trabalho diário supervisionado abaixo do Fable 5.1. Os exemplos são ilustrativos e refletem a orientação da empresa, não testes da BIG CHANGE.
- [Instruções de prompting para o Claude Opus 5.5](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — Orientação oficial sobre capacidades de programação, trabalho especializado, comunicação, visão, utilização do computador e sistemas com vários agentes testadas pela empresa, além da alegação de velocidade de geração e do comportamento das atualizações de progresso. São avaliações da Anthropic, não testes de produtos da BIG CHANGE.
- [Escolher o modelo Claude adequado](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — A matriz oficial de seleção indica que a maioria das cargas de trabalho começa com o Opus 5.5, associa-o a programação complexa com agentes e trabalho empresarial e reserva o Fable 5.1 para a capacidade máxima disponível. Isto sustenta o posicionamento dos modelos por nível sem depender apenas do material para parceiros.
- [Preços da plataforma Claude](https://platform.claude.com/docs/en/about-claude/pricing) — A referência oficial de preços confirma que os modelos Claude 4.6 e posteriores incluem toda a janela de contexto de 1 milhão de tokens às tarifas normais por token. Confirma também as tarifas da cache de prompts e do modo rápido utilizadas na comparação.
Newsletter BIG CHANGE
A perspetiva geral, ao seu ritmo.
Histórias recentes sobre IA e robótica, mudanças que vale a pena acompanhar e ideias práticas para utilizar. Escolha um briefing diário, um resumo semanal ou uma perspetiva mensal.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
A sua privacidade, a sua escolha.
O armazenamento necessário ajuda a proteger o site e a memorizar as suas escolhas. O Google Analytics opcional permanece desativado até que o autorize. Pode ler todos os artigos utilizando apenas o armazenamento necessário. Detalhes de privacidade