A Anthropic lançou o Claude Opus 5.5 em 22 de setembro. A empresa afirma que ele tem desempenho próximo ao Fable 5.1 na maioria das tarefas, com preços inferiores aos do Opus 5.
Para equipes que já usam o Opus 5, a atualização vai além de um ID de modelo mais barato. O Opus 5.5 sempre usa raciocínio adaptativo, tem esforço médio como padrão e rejeita alguns formatos de solicitação aceitos pelo Opus 5. Também fica abaixo do Fable 5.1 como modelo diário recomendado pela Anthropic para trabalho supervisionado; o Fable fica reservado para tarefas autônomas mais difíceis e longas.
A grande mudança
- O que mudou: O Opus 5.5 reduz em 20% as tarifas de entrada e saída e em 60% a tarifa de leitura do cache. O raciocínio adaptativo sempre ativado também muda como os clientes atuais da API precisam solicitar e orçar o trabalho.
- Por que isso importa: Tarefas longas de agentes leem repetidamente instruções anteriores e resultados de ferramentas. O maior corte de preço incide sobre esse contexto reutilizado, então o uso do cache passa a ser central para entender a conta total da tarefa.
- O que observar: Sonnet 5.5 e Haiku 5.5 foram anunciados para as próximas semanas; o Opus é o primeiro disponível. Para escolher um modelo padrão, é preciso comparar o custo das tarefas concluídas e o nível de revisão exigido em cada categoria.
O Opus 5.5 é voltado à produção supervisionada abaixo da categoria Fable
A recomendação de parceiros da Anthropic apresenta o Opus 5.5 como opção empresarial padrão para programação em produção, trabalho especializado em finanças e direito e agentes. Seu guia público de seleção de modelos diz que a maioria das cargas de trabalho deve começar com o Opus 5.5 e o associa à programação agêntica complexa e ao trabalho empresarial. Um guia de custos separado o chama de “modelo para o dia a dia” em desenvolvimento supervisionado de recursos, depuração e revisão de código. Ambos colocam o Fable 5.1 acima quando a capacidade máxima ou uma tarefa longa e difícil importa mais do que o preço por token.
O guia de prompting da Anthropic sustenta essa abrangência com testes da empresa em análise de causa raiz, verificação de código, subagentes paralelos, pesquisa, planilhas, relatórios e apresentações. Também descreve mensagens de progresso e resumos finais mais claros, além de melhorias de visão e uso do computador. São avaliações da Anthropic, não testes feitos pela BIG CHANGE.
A distinção entre Opus e Fable importa porque o Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, contra US$ 4 e US$ 20 do Opus 5.5. Os valores de leitura do cache são mais próximos: US$ 0,25 e US$ 0,20. Assim, em sessões longas com cache, a diferença pode ser menor do que sugerem as tarifas principais de entrada e saída.
Os preços do Claude Opus 5.5 alteram quatro tarifas da API
Os preços padrão da API abaixo são por milhão de tokens. A referência do modelo da Anthropic informa uma janela de contexto de 1 milhão de tokens e uma saída máxima de 128.000 tokens para o Opus 5.5. A documentação de preços diz que a janela de contexto inteira usa as tarifas padrão.
Cobrança da API | Opus 5.5 | Opus 5 | Variação |
|---|---|---|---|
Entrada | US$ 4 | US$ 5 | 20% menor |
Saída | US$ 20 | US$ 25 | 20% menor |
Gravação no cache por 5 minutos | US$ 5 | US$ 6,25 | 20% menor |
Leitura do cache | US$ 0,20 | US$ 0,50 | 60% menor |
A Anthropic relata custo 40% menor em cargas de trabalho típicas nas configurações padrão, combinando tarifas com eficiência no uso de tokens. Sua explicação do custo por tarefa mostra por que a combinação importa: sessões longas de agentes leem repetidamente o contexto crescente, a saída inclui tokens de raciocínio e uma tarefa pode ter muitos turnos. Uma redução de 60% na leitura do cache pode dominar uma sessão que o utiliza intensamente, enquanto uma solicitação curta sem cache e com resposta longa se aproxima mais do corte de 20% na tarifa de saída.
Segundo o guia de prompting, o aumento de mais de 30% relatado diz respeito à velocidade de geração de saída. Não mede o tempo gasto esperando por ferramentas, testes, serviços externos ou um revisor. A Anthropic também oferece um modo mais rápido na API, a US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída, em prévia de pesquisa apenas na API Claude, não nas plataformas de nuvem de parceiros.
A Anthropic também aumentou os limites de sessões de cinco horas nos planos Pro, Max, Team e Enterprise por licença e ofereceu uma reposição acumulável. A capacidade da assinatura é separada da cobrança da API.
Benchmarks da empresa mostram pontos fortes e limites
A Anthropic informa pontuações no Terminal-Bench 4.0 de 66,4% para o Opus 5.5 no nível xhigh, 52,3% para o Opus 5 e 55,8% para o Fable 5.1. A maioria dos outros resultados em destaque usa o nível máximo de esforço.
O GPT-6 Astra lidera as linhas exibidas do AutomationBench e do Terminal-Bench-Science. As tarefas cibernéticas com salvaguardas usaram o Opus 4.8; as tarefas de biologia e desenvolvimento de modelos de fronteira usaram o Opus 5. O AutomationBench não usou fallback.
A Anthropic relata menos ações irreversíveis ou fora dos limites em sua auditoria comportamental. Seu guia de prompting também relata maior resistência a injeções indiretas de prompt em comparação com modelos Opus anteriores. Ambos são resultados de testes conduzidos pela empresa, não uma certificação geral de segurança.
Clientes existentes da API precisam fazer uma migração explícita
Clientes da API precisam solicitar claude-opus-5-5; chamadas existentes ao Opus 5 não mudam de modelo silenciosamente. A referência de migração lista várias alterações em solicitações que, caso contrário, podem gerar erros ou mudar o fluxo de saída do aplicativo.
Ponto de migração | Comportamento do Opus 5.5 |
|---|---|
Seleção do modelo | Use |
Raciocínio | O raciocínio adaptativo está sempre ativado. Desativar o raciocínio e definir limites manuais de tokens geram erro HTTP 400. |
Esforço | Use |
Ferramentas forçadas | |
Uso do computador | A ferramenta antiga de |
Texto de progresso | O texto entre chamadas de ferramentas chega em blocos de raciocínio; assim, um cliente que oculta esses blocos por padrão pode parecer inativo entre chamadas. |
O raciocínio preservado acrescenta outro limite para clientes de longa duração. Os blocos de raciocínio estão vinculados a um modelo e a um prefixo de conversa. Nas contas de API e plataformas de nuvem criadas em ou após 31 de agosto de 2026, alterar instruções, ferramentas ou mensagens anteriores antes de reproduzir um bloco gera, por padrão, um erro 400. A documentação da Anthropic sobre raciocínio preservado explica o caminho que permite apenas acrescentar conteúdo e a opção controlada de descartar um bloco incompatível.
O roteamento de segurança pode mudar o modelo que responde
O guia de prompting descreve salvaguardas de biologia no nível do Fable 5.1 e classificadores para cibersegurança e extração de raciocínio. A busca de vulnerabilidades em código-fonte continua permitida, e organizações podem solicitar verificação para ciências da vida. Uma ampliação da verificação cibernética foi anunciada para as próximas semanas.
Uma recusa ainda pode vir acompanhada do HTTP 200 e de stop_reason: "refusal". A documentação de fallback descreve fallback no servidor, middleware do SDK e novas tentativas gerenciadas pelo cliente. O fallback só ocorre quando um desses caminhos compatíveis está configurado; ele não é uma promessa automática para cada solicitação ao Opus 5.5. Categorias sem fallback recomendado ainda podem ser recusadas.
Isso torna o modelo que atende a solicitação parte do resultado. Um aplicativo migrando para o Opus 5.5 precisa registrar separadamente as recusas e as respostas fornecidas por fallback, sobretudo quando o trabalho envolve áreas protegidas. As tarifas menores e as alegações mais amplas de capacidade se aplicam ao Opus 5.5; uma solicitação roteada segue o comportamento e os limites do modelo que efetivamente respondeu.



