AI-translated from English; not yet reviewed by a fluent editor.
# Claude Haiku 5.5 reduce el precio de los tokens, pero cambia los cálculos de migración
> El nuevo modelo Haiku de Anthropic tiene tarifas por token más bajas, un tokenizer distinto y cambios de migración en la Messages API. Antes de cambiar, quienes ya usan Haiku 4.5 deberían volver a contar sus solicitudes y probar cómo se procesan las respuestas.
By BIG CHANGE Editorial
Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.
Anthropic lanzó Claude Haiku 5.5 el 7 de octubre para tareas breves y frecuentes que pueden representar gran parte de las llamadas de un sistema de agentes. Las tarifas públicas de la Claude API empiezan en 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de tokens de salida, una décima parte de las de Haiku 4.5. Sin embargo, Anthropic afirma que el mismo texto consume alrededor de un 30 % más de tokens con el nuevo modelo y que los prompts de más de 100.000 tokens pasan a un nivel de precio superior. Los equipos que usan Haiku 4.5 deben volver a contar sus propias solicitudes antes de estimar la factura o trasladar tráfico de producción.
El lanzamiento también cambia la ruta de Messages API. Los presupuestos manuales de thinking no funcionan en Haiku 5.5, el thinking adaptativo está activado de forma predeterminada y el primer bloque de respuesta puede ser `thinking` en lugar de texto. Son comprobaciones concretas de compatibilidad para servicios que llaman repetidamente a un modelo pequeño para clasificar, extraer, enrutar o resumir trabajo.
## El gran cambio
- **Qué cambió:** Anthropic ha incorporado su nueva ventana de contexto de un millón de tokens y el thinking adaptativo al nivel de Claude más económico. Haiku 5.5 reduce la tarifa de los prompts cortos, pero cambia cómo se cuentan los textos y cómo puede empezar una respuesta.
- **Por qué importa:** Ahora un equipo puede plantearse usar Claude en más pasos de agente frecuentes y acotados con una tarifa publicada más baja. La ventaja depende de la combinación de longitudes de prompt, tokens de salida y thinking, uso de caché y de si el nuevo modelo alcanza el nivel de calidad requerido para cada paso.
- **Qué conviene vigilar:** Las integraciones con Haiku 4.5 requieren una migración medida. Al volver a contarlas, las solicitudes cercanas al límite de 100.000 tokens pueden pasar al nivel superior, y el código que supone que el primer bloque de contenido siempre es texto puede gestionar mal una respuesta que sí se completó correctamente.
## El precio depende de la longitud del prompt
En la Claude API, Haiku 5.5 cuesta 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de tokens de salida para prompts de hasta 100.000 tokens. Por encima de ese umbral, las tarifas respectivas son 0,50 y 2,50 dólares. Haiku 4.5 figura a 1 y 5 dólares para toda su ventana de contexto de 200.000 tokens. Haiku 5.5 tiene una ventana de contexto de un millón de tokens y un máximo de salida de 128.000, frente a 200.000 y 64.000 en Haiku 4.5. Anthropic indica que está disponible a través de Claude API, Amazon Bedrock, Claude Platform en AWS, Google Cloud y Microsoft Foundry. El ID del modelo de Amazon Bedrock es `anthropic.claude-haiku-5-5`; la Claude API usa `claude-haiku-5-5`. [Las páginas de modelos de Anthropic](https://platform.claude.com/docs/en/models/haiku-5-5/overview) indican los ID, límites y tarifas actuales de cada plataforma.
Anthropic afirma que Haiku 5.5 cuesta alrededor de un 75 % menos de ejecutar que Haiku 4.5 *en promedio*. La nota al pie combina la tarifa publicada un 90 % menor para prompts de hasta 100.000 tokens, la tarifa un 50 % menor por encima de ese umbral, su observación de que el 90 % de las solicitudes de Haiku 4.5 pertenecían a la categoría corta y el mayor recuento de tokens del nuevo tokenizer para el mismo trabajo. Ese cálculo refleja la mezcla de Anthropic, no un descuento uniforme para cada solicitud. El aumento aproximado del 30 % en tokens también es una estimación del proveedor para el mismo texto de entrada; el cambio preciso depende de su contenido. [El anuncio de lanzamiento de Anthropic](https://www.anthropic.com/claude-haiku-5-5) explica tanto la afirmación como el método.
Para una solicitud de Claude API sin caché, toma los recuentos de tokens de entrada y salida de Haiku 5.5, multiplica cada uno por la tarifa correspondiente al *nivel de longitud del prompt de la solicitud* y divide entre un millón. Como cálculo, 80.000 tokens de entrada y 10.000 de salida cuestan 0,013 dólares con las tarifas de prompts cortos. Con 120.000 de entrada y 10.000 de salida, las tarifas de prompts largos dan 0,085 dólares. Son cálculos de precios, no trabajos observados ni previsiones. Las lecturas y escrituras de caché tienen sus propias tarifas, y el procesamiento por lotes anuncia un descuento del 50 % en entrada y salida. Por eso, una estimación útil agrupa las llamadas reales por longitud del prompt y comportamiento de la caché antes de sumarlas. [La página del modelo Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) enumera estas categorías.
Vuelve a contar prompts representativos guardados con el [punto de conexión para contar tokens de Messages](https://platform.claude.com/docs/en/api/go/messages/count_tokens), especificando `claude-haiku-5-5`. Los totales de tokens del modelo anterior no permiten saber en qué nivel de Haiku 5.5 cae un prompt. Para una muestra real, registra junto con los resultados de la tarea el `usage`, la longitud de salida, los campos de caché, el nivel de esfuerzo y el cargo efectivo. Incluye solicitudes cortas, las conversaciones repetidas más largas y casos próximos a 100.000 tokens. BIG CHANGE ha revisado la documentación; no ha ejecutado Haiku 5.5 ni medido una carga de producción.
## Los ajustes que requieren una revisión de migración
La [guía de migración a Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) de Anthropic ofrece una lista de comprobación especialmente concreta para clientes que pasan de Haiku 4.5:
1. Cambia el ID del modelo para la plataforma y vuelve a contar los prompts. `claude-haiku-5-5`es un ID fijo de Claude API, sin sufijo de fecha ni alias independiente. Revisa `max_tokens`, porque thinking consume ese límite y el mismo texto puede requerir más tokens.
2. Sustituye `thinking: {"type":"enabled","budget_tokens":N}` por thinking adaptativo o deja `thinking` sin configurar. Ajusta `output_config.effort` para calibrar la profundidad; el valor predeterminado documentado es `medium`. Un valor bajo de `max_tokens` puede terminar la respuesta tras un bloque de thinking y antes de que aparezca texto.
3. Lee los bloques de contenido por su `type`, no por su posición. Devuelve los bloques de thinking sin cambios junto con los resultados de las herramientas. Prueba cualquier almacén de conversaciones que reproduzca un bloque con otra cuenta o que modifique mensajes anteriores, instrucciones del sistema o herramientas.
4. Elimina los ajustes personalizados de `temperature`, `top_p` y `top_k`. Sustituye un prefijo final del asistente por un turno del usuario y, para formatos restringidos, usa el enfoque de salida estructurada o herramientas que documenta Anthropic. Gestiona en el cliente un `stop_reason` cuyo valor sea `refusal`.
5. Si la integración utiliza computer use con Claude API o Google Cloud, sustituye la herramienta anterior `computer_20250124` por `computer_toolset_20260801` y actualiza el ciclo de herramientas según la guía. Las organizaciones que usan capacidad Priority Tier para Haiku 4.5 también necesitan otro plan: la guía indica que Priority Tier no está disponible en Haiku 5.5.
Estos cambios no prescriben un único nivel de esfuerzo para todas las tareas. Una comparación debe mantener constante la tarea de la aplicación y sus criterios de aceptación, y luego registrar la calidad de las respuestas, los rechazos, los truncamientos, la latencia y los tokens facturados para cada configuración evaluada. Anthropic informa de mejores resultados de Haiku 5.5 que de 4.5 en varias pruebas, incluido un 39,2 % frente a un 0,0 % en su tabla Terminal-Bench 4.0. Son resultados publicados por Anthropic bajo sus condiciones de evaluación, no mediciones del agente de un lector. Anthropic también describe Sonnet 5.5 y Opus 5.5 como más adecuados para programación agéntica compleja en esa prueba. La decisión inmediata para quien usa Haiku 4.5 es si el modelo pequeño sigue cumpliendo los requisitos de cada paso acotado al incluir los cambios de API y el nuevo recuento de tokens.
## Fuentes y lecturas adicionales
- [Anuncio de Anthropic sobre Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5)Indica la fecha de lanzamiento, los trabajos previstos y la disponibilidad, y explica el cálculo del coste medio por tarea de la empresa. Su tabla de pruebas presenta resultados de evaluación de Anthropic.
- [Página del modelo Haiku 5.5 de Claude Platform](https://platform.claude.com/docs/en/models/haiku-5-5/overview)Enumera los ID, los límites de contexto y salida, los niveles por longitud del prompt, los precios de caché y las plataformas compatibles. La [página de Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) aporta las tarifas y límites del modelo anterior.
- [Guía de migración de Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)Especifica los cambios de Messages API y los errores que deben comprobarse antes de cambiar una integración existente. La [referencia de la API de recuento de tokens](https://platform.claude.com/docs/en/api/go/messages/count_tokens) documenta cómo contar una solicitud con un modelo elegido.
- [Información de Reuters sobre el lanzamiento del 7 de octubre](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)corrobora de forma independiente la fecha de publicación. Los ajustes técnicos y las tarifas anteriores proceden de la documentación actual de Anthropic.
## Sources
- [Lanzamiento de Claude Haiku 5.5 por Anthropic](https://www.anthropic.com/claude-haiku-5-5) — Fecha de lanzamiento, tareas previstas, prueba comparativa del proveedor y afirmaciones sobre el coste medio, nota de cálculo y disponibilidad en la nube.
- [Descripción general del modelo Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — ID actual del modelo, precios de API por longitud del prompt, tarifas de caché y procesamiento por lotes, contexto, salida y disponibilidad.
- [Descripción general del modelo Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Estado heredado actual del modelo anterior, tarifas publicadas y límites.
- [Guía de migración de Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Lista principal de cambios en Messages API y pautas sobre el tokenizer.
- [Contar tokens en un Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Punto de conexión de recuento de tokens y recuento de solicitudes específico del modelo.
- [Reuters: Anthropic lanza su tercer modelo Claude 5.5](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — Solo corrobora de forma independiente el lanzamiento.
El boletín de BIG CHANGE
La visión global, a tu ritmo.
Historias recientes sobre IA y robótica, cambios que vale la pena observar e ideas prácticas para usar. Elige un informe diario, un resumen semanal o una perspectiva mensual.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
Tu privacidad, tu elección.
El almacenamiento necesario ayuda a proteger el sitio y a recordar tus preferencias. Google Analytics opcional permanece desactivado hasta que lo autorices. Puedes leer todas las historias usando solo el almacenamiento necesario. Detalles de privacidad