LE MONDE NE S’ARRÊTE PAS.RSS
BIG CHANGE.

Édition Markdown

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Opus 5.5 réduit les tarifs API et impose des changements de migration

> Anthropic réduit les prix par jeton d’Opus 5.5 et le positionne sous Fable 5.1 pour le travail supervisé en entreprise. Les clients API doivent aussi gérer les changements incompatibles du raisonnement et des outils, ainsi que les solutions de repli conditionnelles.

By BIG CHANGE Editorial

Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

![A large abstract work capsule travels on a broad supported track while a separate side track ends at an unlabelled gate.](https://bigchange.ai/api/media/file/claude-opus-5-5-access-boundary-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.

Anthropic [a lancé Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) le 22 septembre. L’entreprise affirme que ses performances sont proches de celles de Fable 5.1 pour la plupart des tâches, avec des prix inférieurs à ceux d’Opus 5.

Pour les équipes qui utilisent déjà Opus 5, cette mise à jour ne se résume pas à un identifiant de modèle moins cher. Opus 5.5 utilise toujours le raisonnement adaptatif, avec un niveau d’effort moyen par défaut, et rejette plusieurs formats de requête acceptés par Opus 5. Anthropic le place aussi sous Fable 5.1, comme modèle quotidien recommandé pour le travail supervisé, et réserve Fable aux tâches autonomes les plus difficiles et les plus longues.

## Le grand changement

- **Ce qui change :** Opus 5.5 réduit de 20 % les tarifs des entrées et sorties et de 60 % celui des lectures du cache. Le raisonnement adaptatif toujours activé modifie également la manière dont les clients API existants doivent demander et budgéter les tâches.
- **Pourquoi c’est important :** Les longues tâches d’agent relisent régulièrement les instructions et les résultats d’outils précédents. La baisse de prix la plus importante concerne ce contexte réutilisé ; l’usage du cache devient donc essentiel pour comprendre la facture totale de la tâche.
- **À surveiller :** Sonnet 5.5 et Haiku 5.5 sont annoncés pour les prochaines semaines ; Opus est le premier disponible. Pour choisir un modèle par défaut, il faut comparer le coût des tâches terminées et le niveau de vérification exigé par chaque gamme.

## Opus 5.5 vise le travail de production supervisé, sous le niveau Fable

Dans son positionnement auprès des partenaires, Anthropic recommande Opus 5.5 comme choix par défaut en entreprise pour le codage en production et les travaux financiers et juridiques. Le [guide de sélection des modèles d’Anthropic](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) indique que la plupart des tâches commencent avec Opus 5.5 et l’associe au codage agentique complexe et au travail en entreprise. Un autre [guide sur les coûts](https://claude.com/blog/what-a-task-costs-on-opus-5-5) le présente comme un « outil du quotidien » pour le développement de fonctionnalités avec supervision, le débogage et la revue de code. Les deux guides placent Fable 5.1 au-dessus lorsqu’une capacité maximale ou une tâche autonome longue prime sur le prix des jetons.

Le [guide de conception des prompts](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) d’Anthropic confirme cette polyvalence à l’aide de tests de l’entreprise en analyse des causes profondes, vérification de code, sous-agents parallèles, recherche, tableurs, rapports et présentations. Il décrit aussi des messages d’avancement et des résumés finaux plus clairs, ainsi que des améliorations de la vision et du contrôle informatique. Ce sont des évaluations d’Anthropic, et non des tests réalisés par BIG CHANGE.

Cette distinction entre Opus et Fable compte : Fable 5.1 est tarifé à 10 $ par million de jetons d’entrée et 50 $ par million de jetons de sortie, contre 4 $ et 20 $ pour Opus 5.5. Les lectures du cache sont beaucoup plus proches, à 0,25 $ et 0,20 $. Pour les longues sessions avec cache, l’écart de prix peut donc être plus faible que ne le suggèrent les tarifs affichés des entrées et sorties.

## Les tarifs d’Opus 5.5 changent quatre prix API

Les tarifs API standard ci-dessous s’appliquent par million de jetons. La [fiche de référence du modèle](https://platform.claude.com/docs/en/models/opus-5-5/overview) indique une fenêtre de contexte d’un million de jetons et un maximum de sortie de 128 000 jetons pour Opus 5.5. La [documentation tarifaire](https://platform.claude.com/docs/en/about-claude/pricing) précise que toute la fenêtre de contexte est facturée aux tarifs standard.

| Frais API | Opus 5.5 | Opus 5 | Évolution |
| --- | --- | --- | --- |
| Entrée | $4 | $5 | 20 % de moins |
| Sortie | $20 | $25 | 20 % de moins |
| Écriture du cache pendant 5 minutes | $5 | $6.25 | 20 % de moins |
| Lecture du cache | $0.20 | $0.50 | 60 % de moins |

Anthropic annonce une baisse de 40 % du coût pour une charge de travail type avec les paramètres par défaut, en combinant les tarifs et l’efficacité en jetons. Son [explication des coûts par tâche](https://claude.com/blog/what-a-task-costs-on-opus-5-5) montre pourquoi la répartition compte : les longues sessions d’agent relisent sans cesse un contexte qui s’allonge, les sorties comprennent des jetons de raisonnement et une tâche peut comporter de nombreux tours. Une baisse de 60 % du prix des lectures de cache peut dominer une session fortement mise en cache, tandis qu’une courte requête sans cache suivie d’une longue réponse se rapproche davantage de la réduction de 20 % du tarif de sortie.

Selon le guide de prompting, l’amélioration annoncée de plus de 30 % concerne la vitesse de génération des sorties. Elle ne mesure pas le temps passé à attendre les outils, les tests, les services externes ou un réviseur. Anthropic propose aussi un mode API plus rapide, à 8 $ par million de jetons d’entrée et 40 $ par million en sortie, en préversion de recherche sur l’API Claude, mais pas sur les plateformes cloud partenaires.

Anthropic a également augmenté les limites de cinq heures des forfaits Pro, Max, Team et Enterprise par siège, et fourni un crédit reportable après réinitialisation. La capacité de l’abonnement est distincte de la facturation API.

## Les benchmarks de l’entreprise montrent ses points forts et ses limites

Anthropic annonce des scores Terminal-Bench 4.0 de 66,4 % pour Opus 5.5 en configuration xhigh, de 52,3 % pour Opus 5 et de 55,8 % pour Fable 5.1. La plupart des autres résultats mis en avant utilisent l’effort Max.

GPT-6 Astra arrive en tête des résultats affichés pour AutomationBench et Terminal-Bench-Science. Les tâches de cybersécurité protégées ont utilisé Opus 4.8 ; celles de biologie et de développement de modèles avancés, Opus 5. AutomationBench n’a utilisé aucune solution de repli.

Anthropic rapporte moins d’actions irréversibles ou sortant du cadre dans son audit comportemental. Son [guide de conception des prompts](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) fait aussi état d’une meilleure résistance aux injections indirectes de prompt que dans les modèles Opus précédents. Il s’agit dans les deux cas de résultats de tests menés par l’entreprise, et non d’une certification générale de sécurité.

## Les clients API existants doivent effectuer une migration explicite

Les clients API doivent demander `claude-opus-5-5` ; les appels existants à Opus 5 ne basculent pas silencieusement vers le nouveau modèle. La [référence de migration](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) répertorie plusieurs changements de requête qui pourraient autrement renvoyer des erreurs ou modifier le flux de sortie d’une application.

| Point de migration | Comportement d’Opus 5.5 |
| --- | --- |
| Sélection du modèle | Utilisez `claude-opus-5-5` explicitement. |
| Raisonnement | Le raisonnement adaptatif est toujours activé. Désactiver le raisonnement ou utiliser des budgets manuels de jetons renvoie une erreur HTTP 400. |
| Effort | Utilisez `low`, `medium`, `high`, `xhigh` ou `max` ; le niveau par défaut est `medium`. |
| Forçage des outils | `tool_choice` accepte les valeurs `any` et `tool`, qui renvoient une erreur HTTP 400 ; `auto` et `none` restent prises en charge. |
| Contrôle informatique | L’ancien outil `computer_20251124` est rejeté sur l’API Claude et Google Cloud ; Amazon Bedrock continue de le prendre en charge. |
| Texte de progression | Le texte entre les appels d’outils arrive dans les blocs de raisonnement ; un client qui omet l’affichage par défaut peut donc sembler silencieux entre les appels. |

La conservation des blocs de raisonnement crée une autre limite pour les clients qui exécutent de longues tâches. Ces blocs sont liés à un modèle et à un préfixe de conversation. Pour les comptes API et des plateformes cloud créés à partir du 31 août 2026, modifier des instructions, outils ou messages antérieurs avant de rejouer un bloc renvoie par défaut une erreur 400. [La documentation d’Anthropic sur la conservation du raisonnement](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) explique le fonctionnement du parcours en ajout uniquement et l’option contrôlée permettant de supprimer un bloc incompatible.

## Le routage de sécurité peut changer le modèle qui répond

Le [guide de conception des prompts](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) décrit les protections biologiques du niveau de Fable 5.1 ainsi que les classificateurs de cybersécurité et d’extraction de raisonnement. La recherche de vulnérabilités dans le code source reste autorisée, et les organisations peuvent demander une vérification en sciences de la vie. Une extension de la vérification cyber est annoncée pour les prochaines semaines.

Un refus peut malgré tout arriver avec le statut HTTP 200 et `stop_reason: "refusal"`. La [documentation sur les solutions de repli](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) décrit le repli côté serveur, le middleware SDK et les nouvelles tentatives gérées par le client. Un repli ne survient que si l’une de ces voies prises en charge est configurée ; il n’est pas promis automatiquement pour chaque requête à Opus 5.5. Les catégories sans solution de repli recommandée peuvent toujours faire l’objet d’un refus.

Le modèle qui répond fait donc partie du résultat. Une application passant à Opus 5.5 doit distinguer les refus des réponses fournies par une solution de repli, surtout pour les tâches touchant à des domaines soumis à des garde-fous. Les tarifs plus bas et les affirmations de capacités étendues concernent Opus 5.5 ; une requête redirigée suit le comportement et les limites du modèle qui a réellement répondu.

## Sources

- [Anthropic : présentation de Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — Annonce de lancement principale pour le modèle, les économies et gains de vitesse sur une charge de travail type revendiqués par Anthropic, les benchmarks, les changements de limites d’abonnement et l’approche de sécurité. Les tests publiés et exemples d’utilisateurs précoces sont des résultats de l’entreprise, et non des résultats indépendants portant sur toutes les tâches.
- [Claude Platform : nouveautés de Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — Référence en ligne du modèle et de la migration : identifiant API, disponibilité chez les fournisseurs, prix, effort par défaut, paramètres de raisonnement et d’outils non pris en charge, périmètre du mode rapide et migration du contrôle informatique. Vérifiez la prise en charge par le fournisseur choisi avant le déploiement.
- [Claude Platform : conservation du raisonnement](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — Explique l’association des blocs de raisonnement renvoyés à un modèle et aux règles de préfixe de conversation en ajout uniquement. La vérification de préfixe par défaut s’applique aux comptes créés à partir du 31 août 2026 ; les interfaces gérées par Anthropic n’exigent pas de modification directe côté client pour cette fonctionnalité.
- [Claude Platform : refus et solutions de repli](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — Documente les refus des classificateurs sous la forme de réponses HTTP 200 avec stop_reason refusal et des détails de catégorie, ainsi que les options de repli. Un statut HTTP de réussite ne prouve pas que le modèle demandé a effectué la tâche.
- [Référence du modèle Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview) — Spécifications officielles de la fenêtre de contexte d’un million de jetons, de la sortie maximale de 128 000 jetons, des tarifs standard et du cache, de l’effort moyen par défaut, des identifiants de modèle et des plateformes prises en charge. L’article ne déduit pas de performances à partir de ces spécifications.
- [Combien coûte une tâche sur Opus 5.5 ?](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Guide produit d’Anthropic qui explique comment les tours, lectures du cache, sorties et niveaux d’effort contribuent au coût d’une tâche, et positionne Opus 5.5 comme modèle quotidien supervisé sous Fable 5.1. Ses exemples sont des indications illustratives de l’entreprise, pas des tests de BIG CHANGE.
- [Prompting de Claude Opus 5.5](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — Guide officiel portant sur les capacités testées par l’entreprise en codage, travail intellectuel, communication, vision, contrôle informatique et multi-agents, ainsi que sur le gain de vitesse de génération revendiqué et les messages d’avancement. Il s’agit d’évaluations d’Anthropic, pas de tests produit de BIG CHANGE.
- [Choisir le bon modèle Claude](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — La matrice officielle recommande Opus 5.5 pour la plupart des tâches, l’associe au codage agentique complexe et au travail en entreprise, et réserve Fable 5.1 à la capacité la plus élevée disponible. Elle étaye le positionnement des niveaux sans s’appuyer uniquement sur les éléments des partenaires.
- [Tarifs de la plateforme Claude](https://platform.claude.com/docs/en/about-claude/pricing) — La référence tarifaire officielle confirme que les modèles Claude 4.6 et ultérieurs incluent toute la fenêtre de contexte d’un million de jetons aux tarifs par jeton standard. Elle confirme également les tarifs du cache de prompts et du mode rapide utilisés dans la comparaison.
La newsletter BIG CHANGE

Prendre du recul, à votre rythme.

Articles récents sur l’IA et la robotique, évolutions à surveiller et idées pratiques à utiliser. Choisissez un briefing quotidien, une synthèse hebdomadaire ou une analyse mensuelle.