Anthropic a lancé Claude Opus 5.5 le 22 septembre. L’entreprise affirme que ses performances sont proches de celles de Fable 5.1 pour la plupart des tâches, avec des prix inférieurs à ceux d’Opus 5.

Pour les équipes qui utilisent déjà Opus 5, cette mise à jour ne se résume pas à un identifiant de modèle moins cher. Opus 5.5 utilise toujours le raisonnement adaptatif, avec un niveau d’effort moyen par défaut, et rejette plusieurs formats de requête acceptés par Opus 5. Anthropic le place aussi sous Fable 5.1, comme modèle quotidien recommandé pour le travail supervisé, et réserve Fable aux tâches autonomes les plus difficiles et les plus longues.

Le grand changement

  • Ce qui change : Opus 5.5 réduit de 20 % les tarifs des entrées et sorties et de 60 % celui des lectures du cache. Le raisonnement adaptatif toujours activé modifie également la manière dont les clients API existants doivent demander et budgéter les tâches.
  • Pourquoi c’est important : Les longues tâches d’agent relisent régulièrement les instructions et les résultats d’outils précédents. La baisse de prix la plus importante concerne ce contexte réutilisé ; l’usage du cache devient donc essentiel pour comprendre la facture totale de la tâche.
  • À surveiller : Sonnet 5.5 et Haiku 5.5 sont annoncés pour les prochaines semaines ; Opus est le premier disponible. Pour choisir un modèle par défaut, il faut comparer le coût des tâches terminées et le niveau de vérification exigé par chaque gamme.

Opus 5.5 vise le travail de production supervisé, sous le niveau Fable

Dans son positionnement auprès des partenaires, Anthropic recommande Opus 5.5 comme choix par défaut en entreprise pour le codage en production et les travaux financiers et juridiques. Le guide de sélection des modèles d’Anthropic indique que la plupart des tâches commencent avec Opus 5.5 et l’associe au codage agentique complexe et au travail en entreprise. Un autre guide sur les coûts le présente comme un « outil du quotidien » pour le développement de fonctionnalités avec supervision, le débogage et la revue de code. Les deux guides placent Fable 5.1 au-dessus lorsqu’une capacité maximale ou une tâche autonome longue prime sur le prix des jetons.

Le guide de conception des prompts d’Anthropic confirme cette polyvalence à l’aide de tests de l’entreprise en analyse des causes profondes, vérification de code, sous-agents parallèles, recherche, tableurs, rapports et présentations. Il décrit aussi des messages d’avancement et des résumés finaux plus clairs, ainsi que des améliorations de la vision et du contrôle informatique. Ce sont des évaluations d’Anthropic, et non des tests réalisés par BIG CHANGE.

Cette distinction entre Opus et Fable compte : Fable 5.1 est tarifé à 10 $ par million de jetons d’entrée et 50 $ par million de jetons de sortie, contre 4 $ et 20 $ pour Opus 5.5. Les lectures du cache sont beaucoup plus proches, à 0,25 $ et 0,20 $. Pour les longues sessions avec cache, l’écart de prix peut donc être plus faible que ne le suggèrent les tarifs affichés des entrées et sorties.

Les tarifs d’Opus 5.5 changent quatre prix API

Les tarifs API standard ci-dessous s’appliquent par million de jetons. La fiche de référence du modèle indique une fenêtre de contexte d’un million de jetons et un maximum de sortie de 128 000 jetons pour Opus 5.5. La documentation tarifaire précise que toute la fenêtre de contexte est facturée aux tarifs standard.

Frais API

Opus 5.5

Opus 5

Évolution

Entrée

$4

$5

20 % de moins

Sortie

$20

$25

20 % de moins

Écriture du cache pendant 5 minutes

$5

$6.25

20 % de moins

Lecture du cache

$0.20

$0.50

60 % de moins

Anthropic annonce une baisse de 40 % du coût pour une charge de travail type avec les paramètres par défaut, en combinant les tarifs et l’efficacité en jetons. Son explication des coûts par tâche montre pourquoi la répartition compte : les longues sessions d’agent relisent sans cesse un contexte qui s’allonge, les sorties comprennent des jetons de raisonnement et une tâche peut comporter de nombreux tours. Une baisse de 60 % du prix des lectures de cache peut dominer une session fortement mise en cache, tandis qu’une courte requête sans cache suivie d’une longue réponse se rapproche davantage de la réduction de 20 % du tarif de sortie.

Selon le guide de prompting, l’amélioration annoncée de plus de 30 % concerne la vitesse de génération des sorties. Elle ne mesure pas le temps passé à attendre les outils, les tests, les services externes ou un réviseur. Anthropic propose aussi un mode API plus rapide, à 8 $ par million de jetons d’entrée et 40 $ par million en sortie, en préversion de recherche sur l’API Claude, mais pas sur les plateformes cloud partenaires.

Anthropic a également augmenté les limites de cinq heures des forfaits Pro, Max, Team et Enterprise par siège, et fourni un crédit reportable après réinitialisation. La capacité de l’abonnement est distincte de la facturation API.

Les benchmarks de l’entreprise montrent ses points forts et ses limites

Anthropic annonce des scores Terminal-Bench 4.0 de 66,4 % pour Opus 5.5 en configuration xhigh, de 52,3 % pour Opus 5 et de 55,8 % pour Fable 5.1. La plupart des autres résultats mis en avant utilisent l’effort Max.

GPT-6 Astra arrive en tête des résultats affichés pour AutomationBench et Terminal-Bench-Science. Les tâches de cybersécurité protégées ont utilisé Opus 4.8 ; celles de biologie et de développement de modèles avancés, Opus 5. AutomationBench n’a utilisé aucune solution de repli.

Anthropic rapporte moins d’actions irréversibles ou sortant du cadre dans son audit comportemental. Son guide de conception des prompts fait aussi état d’une meilleure résistance aux injections indirectes de prompt que dans les modèles Opus précédents. Il s’agit dans les deux cas de résultats de tests menés par l’entreprise, et non d’une certification générale de sécurité.

Les clients API existants doivent effectuer une migration explicite

Les clients API doivent demander claude-opus-5-5 ; les appels existants à Opus 5 ne basculent pas silencieusement vers le nouveau modèle. La référence de migration répertorie plusieurs changements de requête qui pourraient autrement renvoyer des erreurs ou modifier le flux de sortie d’une application.

Point de migration

Comportement d’Opus 5.5

Sélection du modèle

Utilisez claude-opus-5-5 explicitement.

Raisonnement

Le raisonnement adaptatif est toujours activé. Désactiver le raisonnement ou utiliser des budgets manuels de jetons renvoie une erreur HTTP 400.

Effort

Utilisez low, medium, high, xhigh ou max ; le niveau par défaut est medium.

Forçage des outils

tool_choice accepte les valeurs any et tool, qui renvoient une erreur HTTP 400 ; auto et none restent prises en charge.

Contrôle informatique

L’ancien outil computer_20251124 est rejeté sur l’API Claude et Google Cloud ; Amazon Bedrock continue de le prendre en charge.

Texte de progression

Le texte entre les appels d’outils arrive dans les blocs de raisonnement ; un client qui omet l’affichage par défaut peut donc sembler silencieux entre les appels.

La conservation des blocs de raisonnement crée une autre limite pour les clients qui exécutent de longues tâches. Ces blocs sont liés à un modèle et à un préfixe de conversation. Pour les comptes API et des plateformes cloud créés à partir du 31 août 2026, modifier des instructions, outils ou messages antérieurs avant de rejouer un bloc renvoie par défaut une erreur 400. La documentation d’Anthropic sur la conservation du raisonnement explique le fonctionnement du parcours en ajout uniquement et l’option contrôlée permettant de supprimer un bloc incompatible.

Le routage de sécurité peut changer le modèle qui répond

Le guide de conception des prompts décrit les protections biologiques du niveau de Fable 5.1 ainsi que les classificateurs de cybersécurité et d’extraction de raisonnement. La recherche de vulnérabilités dans le code source reste autorisée, et les organisations peuvent demander une vérification en sciences de la vie. Une extension de la vérification cyber est annoncée pour les prochaines semaines.

Un refus peut malgré tout arriver avec le statut HTTP 200 et stop_reason: "refusal". La documentation sur les solutions de repli décrit le repli côté serveur, le middleware SDK et les nouvelles tentatives gérées par le client. Un repli ne survient que si l’une de ces voies prises en charge est configurée ; il n’est pas promis automatiquement pour chaque requête à Opus 5.5. Les catégories sans solution de repli recommandée peuvent toujours faire l’objet d’un refus.

Le modèle qui répond fait donc partie du résultat. Une application passant à Opus 5.5 doit distinguer les refus des réponses fournies par une solution de repli, surtout pour les tâches touchant à des domaines soumis à des garde-fous. Les tarifs plus bas et les affirmations de capacités étendues concernent Opus 5.5 ; une requête redirigée suit le comportement et les limites du modèle qui a réellement répondu.