A Anthropic lançou o Claude Opus 5.5 a 22 de setembro. Afirma que o desempenho é próximo do Fable 5.1 na maioria das tarefas, com preços inferiores aos do Opus 5.

Para as equipas que já utilizam o Opus 5, a atualização é mais do que um identificador de modelo mais barato. O Opus 5.5 utiliza sempre raciocínio adaptativo, tem o esforço médio como predefinição e rejeita vários formatos de pedido que o Opus 5 aceitava. É também posicionado abaixo do Fable 5.1 como o modelo diário recomendado pela Anthropic para trabalho supervisionado; o Fable fica reservado às tarefas autónomas mais difíceis e longas.

A grande mudança

  • O que mudou: O Opus 5.5 reduz em 20% as tarifas de entrada e saída e em 60% o preço das leituras em cache. O raciocínio adaptativo sempre ativo também altera a forma como os clientes existentes da API têm de pedir e orçamentar o trabalho.
  • Porque é importante: As tarefas longas dos agentes leem repetidamente instruções e resultados de ferramentas anteriores. A maior redução de preço aplica-se a esse contexto reutilizado, pelo que a utilização da cache é fundamental para compreender a fatura total da tarefa.
  • O que acompanhar: O Sonnet 5.5 e o Haiku 5.5 foram anunciados para as próximas semanas; o Opus é o primeiro disponível. A escolha de um modelo predefinido exige comparar o custo das tarefas concluídas e a revisão necessária em cada nível.

O Opus 5.5 destina-se a trabalho de produção abaixo do nível Fable

Na apresentação aos parceiros, a Anthropic recomenda o Opus 5.5 como opção empresarial predefinida para programação em produção, trabalho especializado em finanças e direito e agentes. O seu guia público de seleção de modelos afirma que a maioria das cargas de trabalho começa com o Opus 5.5 e associa-o a programação complexa com agentes e trabalho empresarial. Um guia distinto sobre custos chama-lhe um «modelo para o dia a dia» em tarefas supervisionadas de desenvolvimento de funcionalidades, depuração e revisão de código. Ambos os guias recomendam o Fable 5.1 quando a capacidade máxima ou uma execução longa e difícil é mais importante do que o preço dos tokens.

O guia de prompting da Anthropic sustenta essa abrangência com testes da empresa em análise de causas de raiz, verificação de código, subagentes paralelos, investigação, folhas de cálculo, relatórios e apresentações. Descreve também mensagens de progresso e resumos finais mais claros, além de melhorias em visão e utilização do computador. São avaliações da Anthropic, não testes realizados pela BIG CHANGE.

A distinção entre o Opus e o Fable é importante porque o Fable 5.1 custa 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída, contra 4 e 20 dólares, respetivamente, para o Opus 5.5. Os preços das leituras em cache são muito mais próximos: 0,25 e 0,20 dólares. Por isso, em sessões longas que reutilizam muita informação em cache, a diferença pode ser menor do que sugerem os preços de entrada e saída apresentados em destaque.

Claude Opus 5.5 altera quatro tarifas da API

Os preços Standard da API abaixo são por milhão de tokens. A referência do modelo da Anthropic indica uma janela de contexto de 1 milhão de tokens e uma saída máxima de 128 000 tokens para o Opus 5.5. A sua documentação de preços indica que toda a janela de contexto utiliza as tarifas Standard.

Tarifa da API

Opus 5.5

Opus 5

Variação

Entrada

4 $

5 $

menos 20%

Saída

20 $

25 $

menos 20%

Escrita na cache com validade de 5 minutos

5 $

6,25 $

menos 20%

Leitura da cache

0,20 $

0,50 $

menos 60%

A Anthropic comunica uma redução de 40% no custo em cargas de trabalho típicas com as definições predefinidas, combinando tarifas e eficiência na utilização de tokens. A sua explicação dos custos por tarefa demonstra por que razão a composição da tarefa é importante: as sessões longas de agentes voltam a ler contexto crescente, a saída inclui tokens de raciocínio e uma tarefa pode envolver muitas interações. Uma redução de 60% no preço das leituras em cache pode ter um efeito dominante numa sessão que dependa muito da cache; já um pedido curto sem cache e com uma resposta longa aproxima-se mais da redução de 20% no preço da saída.

Segundo o guia de prompting, a melhoria comunicada de mais de 30% diz respeito à velocidade de geração de texto. Não mede o tempo de espera por ferramentas, testes, serviços externos ou revisores. A Anthropic também oferece um modo de API mais rápido, a 8 dólares por milhão de tokens de entrada e 40 dólares por milhão de tokens de saída, em pré-visualização de investigação na API Claude, mas não nas plataformas de nuvem dos parceiros.

A Anthropic também aumentou os limites de utilização em períodos de cinco horas nos planos Pro, Max, Team e Enterprise por lugar, e disponibilizou a reposição de limites transferível. A capacidade das subscrições é distinta da faturação da API.

Os benchmarks da empresa mostram capacidades e limites

A Anthropic comunica resultados no Terminal-Bench 4.0 de 66,4% para o Opus 5.5 no nível xhigh, 52,3% para o Opus 5 e 55,8% para o Fable 5.1. A maioria dos restantes resultados em destaque utiliza o nível de esforço máximo.

O GPT-6 Astra lidera nas linhas apresentadas para o AutomationBench e o Terminal-Bench-Science. As tarefas de cibersegurança com salvaguardas utilizaram o Opus 4.8; as tarefas de biologia e de desenvolvimento de modelos de ponta utilizaram o Opus 5. O AutomationBench não utilizou contingência para outro modelo.

A Anthropic comunica menos ações irreversíveis ou fora dos limites definidos na sua auditoria comportamental. O seu guia de prompting também indica maior resistência a injeções indiretas de prompts do que nos modelos Opus anteriores. Ambos são resultados de testes da empresa, não uma certificação geral de segurança.

Os clientes atuais da API têm de fazer uma migração explícita

Os clientes da API têm de indicar claude-opus-5-5; as chamadas existentes ao Opus 5 não mudam silenciosamente de modelo. A referência de migração enumera várias alterações aos pedidos que, caso contrário, podem gerar erros ou alterar o fluxo de saída da aplicação.

Aspeto da migração

Comportamento do Opus 5.5

Seleção do modelo

Indique explicitamente claude-opus-5-5.

Raciocínio

O raciocínio adaptativo está sempre ativo. Desativá-lo ou definir manualmente o orçamento de tokens devolve o erro HTTP 400.

Esforço

Utilize low, medium, high, xhigh ou max; o valor predefinido é medium.

Ferramentas forçadas

tool_choice Os valores any e tool devolvem o erro HTTP 400; as opções auto e none continuam a ser suportadas.

Utilização do computador

A ferramenta anterior computer_20251124 é rejeitada na API Claude e no Google Cloud; a Amazon Bedrock continua a suportá-la.

Texto de progresso

O texto apresentado entre chamadas a ferramentas é enviado em blocos de raciocínio, pelo que uma aplicação que mantenha a predefinição de não os mostrar pode parecer inativa entre chamadas.

O raciocínio preservado introduz outro limite para clientes com execuções longas. Os blocos de raciocínio estão associados a um modelo e a um prefixo da conversa. Nas contas da API e das plataformas de nuvem criadas a partir de 31 de agosto de 2026, alterar instruções, ferramentas ou mensagens anteriores antes de voltar a enviar um bloco devolve, por predefinição, um erro 400. A documentação da Anthropic sobre raciocínio preservado explica a abordagem em que só se acrescentam elementos e a opção controlada de descartar um bloco incompatível.

O encaminhamento por segurança pode alterar o modelo que responde

O guia de prompting descreve salvaguardas de biologia ao nível do Fable 5.1 e classificadores para cibersegurança e extração de raciocínio. A deteção de vulnerabilidades no código-fonte continua a ser permitida e as organizações podem candidatar-se à verificação na área das ciências da vida. A expansão da verificação de cibersegurança foi anunciada para as próximas semanas.

Uma recusa pode, ainda assim, ser devolvida com o código HTTP 200 e stop_reason: "refusal". A documentação sobre mecanismos de contingência descreve a contingência do lado do servidor, o middleware do SDK e as tentativas novamente geridas pelo cliente. Só existe contingência quando um destes mecanismos suportados está configurado; não é uma promessa automática associada a todos os pedidos ao Opus 5.5. Os pedidos de categorias sem contingência recomendada podem continuar a ser recusados.

Por isso, o modelo que efetivamente responde faz parte do resultado. Uma aplicação que migre para o Opus 5.5 deve registar separadamente as recusas e as respostas fornecidas através de um modelo de contingência, sobretudo quando o trabalho abrange domínios protegidos. As tarifas inferiores e as alegações mais amplas sobre capacidades dizem respeito ao Opus 5.5; um pedido encaminhado segue o comportamento e os limites do modelo que realmente respondeu.