A Anthropic lançou o Claude Haiku 5.5 em 7 de outubro para tarefas curtas e frequentes que podem dominar o volume de chamadas de um sistema de agentes. As tarifas públicas da Claude API começam em US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, um décimo das tarifas do Haiku 4.5. Ainda assim, a Anthropic afirma que o mesmo texto usa cerca de 30% mais tokens no novo modelo e que prompts acima de 100.000 tokens entram em uma faixa de preço mais alta. Equipes que usam o Haiku 4.5 precisam recontar suas próprias solicitações antes de estimar a fatura ou migrar tráfego de produção.
O lançamento também muda o caminho da Messages API. Orçamentos manuais de thinking não funcionam no Haiku 5.5, o adaptive thinking fica ativado por padrão e o primeiro bloco da resposta pode ser thinking em vez de texto. São verificações concretas de compatibilidade para serviços que chamam repetidamente um modelo pequeno para classificar, extrair, encaminhar ou resumir tarefas.
A grande mudança
- O que mudou: A Anthropic levou sua nova janela de contexto de um milhão de tokens e o adaptive thinking para a categoria mais barata do Claude. O Haiku 5.5 reduz a tarifa de prompts curtos, mas muda como o texto é contado e como uma resposta pode começar.
- Por que isso importa: Uma equipe pode considerar o Claude para mais etapas frequentes e bem delimitadas de agentes, pagando uma tarifa publicada menor. O ganho depende da combinação de tamanhos de prompt, tokens de saída e thinking, uso de cache e de o novo modelo atingir a meta de qualidade daquela etapa.
- O que acompanhar: Integrações do Haiku 4.5 precisam de uma migração medida. Depois da recontagem, solicitações próximas ao limite de 100.000 tokens podem passar para a faixa mais cara; códigos que presumem que o primeiro bloco de conteúdo é texto também podem tratar incorretamente uma resposta que, no restante, foi bem-sucedida.
O preço depende do tamanho do prompt
Na Claude API, o Haiku 5.5 custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída para prompts de até 100.000 tokens. Acima desse limite, as tarifas são US$ 0,50 e US$ 2,50, respectivamente. O Haiku 4.5 aparece com preços de US$ 1 e US$ 5 em toda a sua janela de contexto de 200.000 tokens. O Haiku 5.5 tem janela de um milhão de tokens e saída máxima de 128.000 tokens, ante 200.000 e 64.000 no Haiku 4.5. A Anthropic lista disponibilidade pela Claude API, Amazon Bedrock, Claude Platform na AWS, Google Cloud e Microsoft Foundry. O ID do modelo na Amazon Bedrock é anthropic.claude-haiku-5-5; a Claude API usa claude-haiku-5-5. As páginas de modelos da Anthropic listam os IDs, limites e tarifas atuais de cada plataforma.
A Anthropic diz que o custo médio de execução do Haiku 5.5 é cerca de 75% menor que o do Haiku 4.5 em média. A nota de rodapé combina a tarifa de tabela 90% menor para prompts de até 100.000 tokens, a redução de 50% acima desse limite, a observação de que 90% das solicitações do Haiku 4.5 eram da categoria mais curta e a contagem maior de tokens do novo tokenizer para o mesmo trabalho. Esse cálculo descreve a mistura de solicitações da Anthropic, não um desconto uniforme em cada solicitação. O aumento de cerca de 30% nos tokens também é uma estimativa do fornecedor para o mesmo texto de entrada; a diferença exata depende do conteúdo. O anúncio de lançamento da Anthropic apresenta tanto a afirmação quanto o método usado.
Para uma solicitação da Claude API sem cache, pegue as contagens de tokens de entrada e saída do Haiku 5.5, multiplique cada uma pela tarifa da faixa correspondente ao tamanho do prompt da solicitação e divida por um milhão. No cálculo, 80.000 tokens de entrada e 10.000 de saída custam US$ 0,013 nas tarifas de prompts curtos. Com 120.000 tokens de entrada e 10.000 de saída, as tarifas de prompts longos resultam em US$ 0,085. São cálculos de preço, não tarefas observadas nem previsões. Leituras e gravações de cache têm tarifas próprias, e o processamento em lote lista um desconto de 50% na entrada e na saída. Uma estimativa útil, portanto, agrupa chamadas reais pelo tamanho do prompt e pelo comportamento do cache antes de somá-las. A página do modelo Haiku 5.5 lista essas categorias.
Reconte prompts representativos salvos usando o endpoint de contagem de tokens de Message, especificando claude-haiku-5-5. Os totais de tokens do modelo antigo não mostram em qual faixa do 5.5 um prompt se encaixa. Para uma amostra real, registre a resposta usage, o tamanho da saída, os campos de cache, o effort e a cobrança efetiva junto aos resultados da tarefa. Inclua solicitações curtas, as conversas repetidas mais longas e casos próximos de 100.000 tokens. A BIG CHANGE revisou a documentação; não executou o Haiku 5.5 nem mediu uma carga de produção.
Configurações que precisam de uma revisão na migração
O guia de migração do Haiku 5.5 da Anthropic traz uma lista especialmente específica para clientes que estão saindo do Haiku 4.5:
- Troque o ID do modelo na plataforma e reconte os prompts.
claude-haiku-5-5é um ID fixo da Claude API, sem sufixo de data ou alias separado. Revisemax_tokens, porque thinking consome esse limite e o mesmo texto pode exigir mais tokens. - Substitua
thinking: {"type":"enabled","budget_tokens":N}por adaptive thinking ou deixethinkingsem configuração. Ajusteoutput_config.effortpara calibrar a profundidade; o padrão documentado émedium. Um valor baixo demax_tokenspode encerrar a resposta após um bloco de thinking e antes de qualquer texto. - Leia os blocos de conteúdo pelo
type, não pela posição. Devolva os blocos de thinking sem alterações junto com os resultados das ferramentas. Teste qualquer armazenamento de conversas que reproduza um bloco por outra conta ou altere mensagens anteriores, instruções do sistema ou ferramentas. - Remova as configurações personalizadas de
temperature,top_petop_k. Troque um prefill final do assistant por um turno do user e, para formatos restritos, use a abordagem de saída estruturada ou de ferramentas documentada pela Anthropic. No cliente, trate umstop_reasoncom valorrefusal. - Se a integração usa computer use na Claude API ou no Google Cloud, troque a ferramenta antiga
computer_20250124porcomputer_toolset_20260801e atualize o ciclo de ferramentas conforme o guia. Organizações que usam capacidade Priority Tier no Haiku 4.5 também precisam de outro plano: o guia diz que Priority Tier não está disponível no Haiku 5.5.
Essas mudanças não determinam uma única configuração de effort para todas as tarefas. Uma comparação deve manter estáveis a tarefa da aplicação e os critérios de aceitação e, então, registrar qualidade das respostas, recusas, truncamentos, latência e tokens cobrados nas configurações avaliadas. A Anthropic relata resultados melhores do Haiku 5.5 que do 4.5 em vários benchmarks, incluindo 39,2% contra 0,0% em sua tabela do Terminal-Bench 4.0. São resultados divulgados pela Anthropic sob suas condições de avaliação, não uma medição do agente de um leitor. A Anthropic também diz que Sonnet 5.5 e Opus 5.5 são mais adequados a programação agêntica complexa nesse benchmark. A decisão imediata para quem usa Haiku 4.5 é verificar se o modelo menor ainda atende aos requisitos de cada etapa específica depois de incluir as mudanças de API e a nova contagem de tokens.
Fontes e leituras adicionais
- Anúncio da Anthropic sobre o Haiku 5.5Informa a data de lançamento, os trabalhos previstos e a disponibilidade, além de explicar o cálculo do custo médio por tarefa da empresa. A tabela de benchmarks apresenta os resultados da avaliação da Anthropic.
- Página do Haiku 5.5 na Claude PlatformLista IDs, limites de contexto e saída, faixas por tamanho do prompt, preços de cache e suporte a plataformas. A página do Haiku 4.5traz as tarifas e os limites do modelo anterior.
- Guia de migração do Haiku 5.5Especifica mudanças da Messages API e erros a verificar antes de trocar uma integração existente. A referência da API de contagem de tokensdocumenta como contar uma solicitação com o modelo escolhido.
- Reportagem da Reuters sobre o lançamento em 7 de outubroconfirma a data de lançamento de forma independente. As configurações técnicas e tarifas acima vêm da documentação atual da Anthropic.



