AI-translated from English; not yet reviewed by a fluent editor.
# Claude Haiku 5.5 baisse le prix des tokens, mais change le calcul de la migration
> Le nouveau modèle Haiku d’Anthropic propose des tarifs de tokens plus bas, un tokenizer différent et des changements liés à la migration de la Messages API. Avant de passer à la nouvelle version, les utilisateurs de Haiku 4.5 devraient recompter leurs requêtes et tester le traitement des réponses.
By BIG CHANGE Editorial
Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.
Anthropic a lancé Claude Haiku 5.5 le 7 octobre pour les tâches courtes et fréquentes qui peuvent représenter une grande partie des appels d’un système d’agents. Les tarifs publics de la Claude API commencent à 0,10 $ par million de tokens d’entrée et 0,50 $ par million de tokens de sortie, soit un dixième de ceux de Haiku 4.5. Anthropic indique toutefois que le même texte nécessite environ 30 % de tokens supplémentaires avec le nouveau modèle et que les prompts de plus de 100 000 tokens passent dans une tranche tarifaire supérieure. Les équipes qui utilisent Haiku 4.5 doivent recompter leurs propres requêtes avant d’estimer leur facture ou de transférer du trafic de production.
La version modifie aussi le fonctionnement de la Messages API. Les budgets manuels de thinking ne fonctionnent pas avec Haiku 5.5, l’adaptive thinking est activé par défaut et le premier bloc de réponse peut être `thinking` au lieu de texte. Ce sont des vérifications de compatibilité concrètes pour les services qui appellent régulièrement un petit modèle afin de classer, extraire, router ou résumer des données.
## Le changement majeur
- **Ce qui change :** Anthropic apporte sa nouvelle fenêtre de contexte d’un million de tokens et l’adaptive thinking à la gamme Claude la moins chère. Haiku 5.5 réduit le tarif des prompts courts, tout en modifiant le comptage du texte et la manière dont une réponse peut commencer.
- **Pourquoi c’est important :** Une équipe peut désormais envisager Claude pour davantage d’étapes d’agent fréquentes et bien délimitées, à un tarif affiché inférieur. Le gain dépend de la répartition des longueurs de prompt, des tokens de sortie et de thinking, de l’utilisation du cache et de la capacité du nouveau modèle à atteindre l’objectif de qualité de chaque étape.
- **Points à surveiller :** Les intégrations Haiku 4.5 doivent faire l’objet d’une migration mesurée. Après recomptage, les requêtes proches du seuil de 100 000 tokens peuvent passer dans la tranche supérieure. Un code qui suppose que le premier bloc de contenu est du texte peut aussi mal traiter une réponse pourtant réussie.
## Le prix dépend de la longueur du prompt
Dans la Claude API, Haiku 5.5 coûte 0,10 $ par million de tokens d’entrée et 0,50 $ par million de tokens de sortie pour les prompts allant jusqu’à 100 000 tokens. Au-delà, les tarifs respectifs sont de 0,50 $ et 2,50 $. Haiku 4.5 est affiché à 1 $ et 5 $ sur l’ensemble de sa fenêtre de contexte de 200 000 tokens. Haiku 5.5 dispose d’une fenêtre d’un million de tokens et d’une sortie maximale de 128 000 tokens, contre 200 000 et 64 000 pour Haiku 4.5. Anthropic indique une disponibilité via la Claude API, Amazon Bedrock, Claude Platform sur AWS, Google Cloud et Microsoft Foundry. L’ID du modèle Amazon Bedrock est `anthropic.claude-haiku-5-5` ; la Claude API utilise `claude-haiku-5-5`. [Les pages des modèles d’Anthropic](https://platform.claude.com/docs/en/models/haiku-5-5/overview) indiquent les ID, limites et tarifs actuels des plateformes.
Selon Anthropic, le coût d’exécution de Haiku 5.5 est inférieur d’environ 75 % à celui de Haiku 4.5 *en moyenne*. La note de bas de page combine le tarif affiché inférieur de 90 % pour les prompts allant jusqu’à 100 000 tokens, la baisse de 50 % au-delà de ce seuil, l’observation selon laquelle 90 % des requêtes Haiku 4.5 relevaient de la catégorie courte et le nombre supérieur de tokens comptabilisés par le nouveau tokenizer pour le même travail. Ce calcul décrit le mélange de requêtes d’Anthropic, pas une remise uniforme sur chaque requête. La hausse d’environ 30 % du nombre de tokens est également une estimation du fournisseur pour le même texte d’entrée ; l’écart exact dépend du contenu. [L’annonce de lancement d’Anthropic](https://www.anthropic.com/claude-haiku-5-5) présente à la fois cette affirmation et sa méthode de calcul.
Pour une requête Claude API sans cache, prenez les nombres de tokens d’entrée et de sortie de Haiku 5.5, multipliez chacun par le tarif de la *tranche correspondant à la longueur du prompt de la requête* et divisez par un million. Exemple de calcul : 80 000 tokens d’entrée et 10 000 de sortie coûtent 0,013 $ aux tarifs des prompts courts. Avec 120 000 tokens d’entrée et 10 000 de sortie, les tarifs des prompts longs donnent 0,085 $. Ce sont des calculs de prix, pas des tâches observées ni des prévisions. La lecture et l’écriture du cache ont leurs propres tarifs, et le traitement par lots affiche une remise de 50 % sur l’entrée et la sortie. Une estimation utile regroupe donc les appels réels selon la longueur du prompt et le comportement du cache avant de les additionner. [La page du modèle Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) répertorie ces catégories.
Recomptez des prompts représentatifs enregistrés avec le [point de terminaison de comptage de tokens Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens), en indiquant `claude-haiku-5-5`. Les totaux de tokens de l’ancien modèle ne permettent pas de déterminer dans quelle tranche Haiku 5.5 placera un prompt. Pour un échantillon réel, consignez la réponse `usage`, la longueur de sortie, les champs du cache, l’effort et le coût réellement facturé, ainsi que les résultats de la tâche. Incluez des requêtes courtes, les conversations répétées les plus longues et des cas proches de 100 000 tokens. BIG CHANGE a examiné la documentation, mais n’a pas exécuté Haiku 5.5 ni mesuré une charge de production.
## Les paramètres à revoir pendant la migration
Le [guide de migration Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) d’Anthropic propose une liste de contrôle particulièrement détaillée pour les clients qui quittent Haiku 4.5 :
1. Modifiez l’ID du modèle pour la plateforme et recomptez les prompts. `claude-haiku-5-5`est un ID fixe de la Claude API, sans suffixe de date ni alias distinct. Vérifiez `max_tokens`, car le thinking utilise cette limite et un texte équivalent peut nécessiter davantage de tokens.
2. Remplacez `thinking: {"type":"enabled","budget_tokens":N}` par l’adaptive thinking ou laissez `thinking` non défini. Réglez `output_config.effort` pour ajuster la profondeur ; la valeur par défaut documentée est `medium`. Une valeur faible de `max_tokens` peut terminer la réponse après un bloc de thinking et avant tout texte.
3. Lisez les blocs de contenu selon leur `type`, et non leur position. Renvoyez les blocs de thinking sans les modifier avec les résultats des outils. Testez tout stockage de conversations qui rejoue un bloc avec un autre compte ou modifie des messages antérieurs, des instructions système ou des outils.
4. Supprimez les réglages personnalisés `temperature`, `top_p` et `top_k`. Remplacez le préremplissage final de l’assistant par un tour utilisateur et, pour les formats contraints, utilisez l’approche de sortie structurée ou d’outils documentée par Anthropic. Gérez dans le client un `stop_reason` dont la valeur est `refusal`.
5. Si l’intégration utilise computer use avec la Claude API ou Google Cloud, remplacez l’ancien outil `computer_20250124` par `computer_toolset_20260801` et mettez à jour la boucle d’outils comme indiqué dans le guide. Les organisations qui utilisent la capacité Priority Tier pour Haiku 4.5 ont également besoin d’un plan distinct : le guide précise que Priority Tier n’est pas disponible pour Haiku 5.5.
Ces changements ne prescrivent pas un seul niveau d’effort pour toutes les tâches. Une comparaison doit conserver la même tâche applicative et les mêmes critères d’acceptation, puis mesurer la qualité des réponses, les refus, les troncatures, la latence et les tokens facturés pour les paramètres étudiés. Anthropic rapporte de meilleurs résultats pour Haiku 5.5 que pour 4.5 sur plusieurs benchmarks, notamment 39,2 % contre 0,0 % dans son tableau Terminal-Bench 4.0. Il s’agit de résultats publiés par Anthropic selon ses conditions d’évaluation, pas d’une mesure de l’agent d’un lecteur. Anthropic présente aussi Sonnet 5.5 et Opus 5.5 comme mieux adaptés au codage agentique complexe dans ce benchmark. À court terme, les utilisateurs de Haiku 4.5 doivent déterminer si le petit modèle satisfait toujours les exigences de chaque étape ciblée une fois intégrés les changements d’API et le nouveau nombre de tokens.
## Sources et lectures complémentaires
- [Annonce d’Anthropic sur Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5)Indique la date de lancement, les tâches visées et la disponibilité, et explique le calcul du coût moyen d’une tâche par l’entreprise. Son tableau de benchmarks présente les résultats de l’évaluation d’Anthropic.
- [Page du modèle Haiku 5.5 sur Claude Platform](https://platform.claude.com/docs/en/models/haiku-5-5/overview)Répertorie les ID, les limites de contexte et de sortie, les tranches selon la longueur du prompt, les tarifs du cache et les plateformes prises en charge. La [page Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview)fournit les tarifs et limites du modèle précédent.
- [Guide de migration Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)Détaille les changements de la Messages API et les erreurs à vérifier avant de migrer une intégration existante. La [référence de l’API de comptage des tokens](https://platform.claude.com/docs/en/api/go/messages/count_tokens)explique le comptage d’une requête avec un modèle choisi.
- [Article de Reuters sur le lancement du 7 octobre](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)confirme indépendamment la date de sortie. Les paramètres techniques et tarifs ci-dessus proviennent de la documentation actuelle d’Anthropic.
## Sources
- [Anthropic, lancement de Claude Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5) — Date de lancement, tâches visées, benchmark du fournisseur et déclarations sur le coût moyen, note de calcul et disponibilité dans le cloud.
- [Présentation du modèle Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — ID actuel du modèle, prix de l’API selon la longueur du prompt, tarifs du cache et du traitement par lots, contexte, sortie et disponibilité.
- [Présentation du modèle Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Statut actuel de l’ancien modèle, tarifs affichés et limites.
- [Guide de migration Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Liste principale des changements de la Messages API et conseils sur le tokenizer.
- [Compter les tokens dans un Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Point de terminaison de comptage des tokens et comptage d’une requête propre au modèle.
- [Reuters : Anthropic lance un troisième modèle Claude 5.5](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — Pour corroborer le lancement de manière indépendante uniquement.
La newsletter BIG CHANGE
Prendre du recul, à votre rythme.
Articles récents sur l’IA et la robotique, évolutions à surveiller et idées pratiques à utiliser. Choisissez un briefing quotidien, une synthèse hebdomadaire ou une analyse mensuelle.
Next scheduled send (UTC): . Your first edition arrives at the next scheduled send after you confirm.
Votre vie privée, votre choix.
Le stockage nécessaire contribue à la sécurité du site et mémorise vos choix. Google Analytics facultatif reste désactivé tant que vous ne l’autorisez pas. Vous pouvez lire tous les articles avec le seul stockage nécessaire. Détails sur la confidentialité