OpenAI et Anthropic ont lancé de nouveaux modèles le 22 septembre, mais leurs gammes évoluent à des rythmes différents. GPT-6 Sol et Luna rejoignent Astra, tandis que Terra reste sur GPT-5.6. Claude Opus passe à la version 5.5, aux côtés de Fable 5.1, Sonnet 5 et Haiku 4.5, lancé il y a presque un an.

Les comparaisons les plus pertinentes opposent Astra à Fable, Sol à Opus, Terra à Sonnet et Luna à Haiku. L’examen des quatre paires révèle une compétition plus intéressante que chacun des lancements pris isolément : Opus met au défi le niveau phare, Luna fait pression sur l’offre économique d’Anthropic, et le milieu des deux gammes reste incomplet.

Le grand changement

  • Ce qui change : Les acheteurs ont désormais accès à des modèles plus récents, à des prix très différents au sein d’une même gamme. OpenAI a renouvelé son niveau économique, tandis qu’Anthropic a concentré cette sortie sur Opus, laissant Haiku presque un an en arrière dans le calendrier des versions.
  • Pourquoi c’est important : Les équipes produit disposent de davantage de possibilités pour réduire le coût des usages courants de l’IA, tout en payant plus cher lorsque les erreurs coûtent cher. Le choix doit cependant reposer sur les performances mesurées : la place d’un modèle dans une gamme ne permet pas de prévoir de façon fiable son classement aux benchmarks.
  • À surveiller : Anthropic annonce l’arrivée de Sonnet 5.5 et Haiku 5.5 dans les prochaines semaines. Leurs prix et résultats détermineront quelle part de l’ouverture actuelle pour OpenAI subsistera, surtout dans les produits qui effectuent un grand nombre d’appels à bas coût.

Les prix, niveau par niveau

Tous les montants ci-dessous correspondent aux tarifs standard de l’API directe en dollars américains par million de jetons, vérifiés le 22 septembre. Une entrée mise en cache correspond à une lecture du cache. Les tarifs publiés par OpenAI s’appliquent jusqu’à 272 000 jetons d’entrée ; au-delà, le tarif des entrées pour l’ensemble de la requête double et celui des sorties augmente de 50 %. Les écritures dans le cache, le traitement par lots et les outils obéissent à des conditions de facturation distinctes. Sources : OpenAI et Anthropic.

Modèle

Entrée

Entrée mise en cache

Sortie

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0.25

$50

GPT-6 Sol

$2

$0.20

$10

Claude Opus 5.5

$4

$0.20

$20

GPT-5.6 Terra

$2

$0.20

$12

Claude Sonnet 5

$2

$0.20

$10

GPT-6 Luna

$0.10

$0.01

$0.50

Claude Haiku 4.5

$1

$0.10

$5

Scores d’intelligence et dépenses mesurées sur les tests

Artificial Analysis Intelligence Index v4.3.2, vérifié le 22 septembre. Les coûts correspondent aux dépenses moyennes pondérées de l’opérateur par tâche de l’indice.

Modèle

Configuration testée

Indice d’intelligence

Coût par tâche de l’indice

GPT-6 Astra

Max

52.7

$3.26

Claude Fable 5.1

Max avec solution de repli

53.4

$7.63

GPT-6 Sol

Max

47.5

Non indiqué

Claude Opus 5.5

Max avec solution de repli

57.6

$5.98

GPT-5.6 Terra

Max

42.1

$1.40

Claude Sonnet 5

Max

38.2

$5.09

GPT-6 Luna

Max

37.3

Non indiqué

Claude Haiku 4.5

Raisonnement activé

16.9

$0.21

Source : Artificial Analysis ; les résultats de chaque modèle sont liés dans les comparaisons ci-dessous.

Astra face à Fable : le duo phare

Leurs tarifs standard d’entrée et de sortie sont identiques. Le tarif de lecture du cache de Fable est un quart de celui d’Astra, différence qui compte lorsque les applications réutilisent régulièrement du contenu admissible du prompt.

Selon l’Intelligence Index actuel d’Artificial Analysis, Astra en configuration Max obtient 52.7 et Fable 5.1 en configuration Max avec solution de repli obtient 53.4. Les résultats sont proches. Artificial Analysis indique des dépenses pondérées de $3.26 par tâche de l’indice pour Astra, contre $7.63 pour Fable. Astra atteint un score proche avec des dépenses mesurées environ 57 % plus faibles, malgré des tarifs d’entrée et de sortie identiques. Résultats d’Astra, résultats de Fable.

Sol face à Opus : prix plus bas, scores plus élevés

Les tarifs d’entrée ordinaire et de sortie de Sol sont deux fois moins élevés que ceux d’Opus ; leurs tarifs de lecture du cache sont identiques. OpenAI a également réduit de moitié les tarifs de lancement des entrées et sorties de Sol par rapport à GPT-5.6 Sol. Anthropic a réduit de 20 % les tarifs correspondants d’Opus par rapport à Opus 5. Lancement d’OpenAI, lancement d’Opus.

Artificial Analysis attribue à Sol en configuration Max le score de 47.5, contre 57.6 pour Opus 5.5 en configuration Max avec solution de repli. Opus devance Sol de 10,1 points tout en facturant deux fois plus cher les entrées ordinaires et les sorties. Son score dépasse également ceux d’Astra et de Fable, avec des tarifs d’entrée et de sortie inférieurs de 60 %. Les dépenses réelles sur les tests nuancent le tableau : Opus coûte en moyenne $5.98 par tâche de l’indice, soit environ 84 % de plus qu’Astra. Au moment de la vérification, le graphique publié par Artificial Analysis ne donnait pas encore le coût de Sol. Résultats de Sol, résultats d’Opus.

Terra face à Sonnet : le modèle GPT-6 manquant

Le lancement et le catalogue actuels d’OpenAI ne comportent pas de GPT-6 Terra. La comparaison disponible porte sur GPT-5.6 Terra, dont la documentation API actuelle confirme les tarifs ci-dessus. Le guide Work et Codex d’OpenAI indique également que les anciens modèles 5.6 restent disponibles pendant le déploiement.

En effort Max, Terra obtient 42.1 à l’indice d’Artificial Analysis, contre 38.2 pour Sonnet 5. Terra coûte également en moyenne $1.40 par tâche de l’indice, contre $5.09 pour Sonnet : son score est plus élevé et ses dépenses mesurées environ 73 % plus faibles. Son tarif par jeton de sortie est pourtant supérieur de 20 %, ce qui montre comment la consommation de jetons et la mise en cache peuvent l’emporter sur le prix affiché. Résultats de Terra, résultats de Sonnet.

Sonnet 5 est arrivé le 30 juin. Anthropic a maintenant annoncé Sonnet 5.5 pour les prochaines semaines. L’arrivée promise d’un successeur ne change pas la comparaison actuelle avec Sonnet 5 avant que la nouvelle version soit disponible pour être testée et tarifée.

Luna face à Haiku : le plus grand écart d’ancienneté

Luna coûte dix fois moins cher dans chacune des catégories de jetons répertoriées. Haiku 4.5 a été lancé le 15 octobre 2025, soit 342 jours avant Luna. Il reste la version Haiku actuelle d’Anthropic ; la version 5.5 est annoncée pour les prochaines semaines.

Les tests indépendants révèlent également un écart de performances. Artificial Analysis attribue à Luna en configuration Max le score de 37.3, contre 16.9 pour Haiku 4.5 avec raisonnement activé. Ces scores proviennent du même indice et de la même suite de tests actuelle ; le prix par jeton de Luna est inférieur de 90 %. Le raisonnement de Haiku coûte en moyenne $0.21 par tâche de l’indice ; le coût correspondant de Luna ne figurait pas encore dans le graphique publié par l’opérateur. Résultats de Luna, résultats de Haiku avec raisonnement.

Anthropic est donc exposée sur une partie de sa gamme : son modèle actuel le moins cher fait face à un concurrent tout juste lancé, dont les tarifs par jeton sont plus faibles et le résultat à cette évaluation nettement meilleur. La mise à jour annoncée de Haiku compte donc parmi les prochaines sorties importantes pour les développeurs qui achètent à grande échelle.

Les chiffres d’Artificial Analysis cités ci-dessus sont issus de l’Intelligence Index v4.3.2, un agrégat de dix évaluations vérifié le 22 septembre. Les configurations sont indiquées à côté des scores ; les résultats de Fable et d’Opus comprennent la configuration avec solution de repli de l’opérateur. Indice et méthodologie.

Que se passe-t-il lorsque des agents doivent terminer un travail ?

Le benchmark AutomationBench v1.0.6 de Zapier de Zapier évalue des tâches de bout en bout dans des applications professionnelles simulées. Pour réussir, tous les résultats évalués doivent être corrects. Le classement du 22 septembre indique :

Modèle

Configuration testée

Taux de réussite

Coût par tâche

GPT-6 Astra

Max

41.4%

$1.73

Claude Fable 5.1

Max, sans solution de repli

22.37%

$2.45

GPT-6 Sol

Xhigh

33.2%

$0.27

GPT-6 Sol

Max

32.0%

$0.34

Claude Opus 5.5

Max

40.0%

$1.28

GPT-5.6 Terra

Max

23.59%

$0.51

Claude Sonnet 5

Max

10.65%

$0.88

GPT-6 Luna

Max

20.7%

$0.04

Claude Haiku 4.5

Non précisé

0.46%

$0.07

La configuration distincte Fable et Opus 5 avec solution de repli obtient 31.4 %. Opus effectue environ 40 % de ses tâches ; le coût affiché de 2,45 $ n’inclut pas les jetons utilisés par cette solution de repli.

En configuration Xhigh, Sol dépense environ 79 % de moins par tentative qu’Opus en Max, pour un taux de réussite inférieur de 6,8 points de pourcentage. Luna devance Haiku avec un coût par tâche inférieur de 43 %. Astra arrive en tête de ce groupe ; aucun taux de réussite ne dépasse la moitié. Résultats et méthode de notation de Zapier.

Un calendrier de sorties chargé et irrégulier

Les historiques de sortie des API des deux entreprises fournissent deux séries sélectionnées. La liste d’OpenAI suit les versions numérotées de GPT jusqu’à GPT-6 Astra. Elle exclut les branches spécialisées Instant et Codex, ainsi que les extensions ultérieures des niveaux, comme GPT-5.4 mini et nano le 17 mars, et GPT-6 Sol et Luna le 22 septembre. La liste d’Anthropic suit les versions publiques d’Opus sur l’API. L’« intervalle » correspond au nombre de jours écoulés depuis l’entrée précédente dans la série sélectionnée de chaque entreprise.

  • Famille GPT-5 — 7 août 2025 : lancement de la famille ; intervalle non applicable pour la première entrée.
  • GPT-5.1 — 13 novembre 2025 : mise à jour de version ; intervalle de 98 jours.
  • GPT-5.2 — 11 décembre 2025 : mise à jour de version ; intervalle de 28 jours.
  • GPT-5.4 — 5 mars 2026 : mise à jour de version ; intervalle de 84 jours.
  • GPT-5.5 — 24 avril 2026 : mise à jour de version ; intervalle de 50 jours.
  • GPT-5.6 — 9 juillet 2026 : mise à jour de la famille avec plusieurs niveaux ; intervalle de 76 jours.
  • GPT-6 Astra — 3 septembre 2026 : lancement d’une nouvelle famille ; intervalle de 56 jours.

Source : journal des modifications de l’API OpenAI. Séparément, GPT-6 Sol et Luna sont arrivés le 22 septembre, 19 jours après Astra. Cet intervalle mesure l’extension des niveaux au sein d’une même famille et ne figure pas dans la série des versions numérotées ci-dessus.

  • Opus 4 — 22 mai 2025 : version majeure ; intervalle non applicable pour la première entrée.
  • Opus 4.1 — 5 août 2025 : mise à jour mineure ; intervalle de 75 jours.
  • Opus 4.5 — 24 novembre 2025 : mise à jour de version ; intervalle de 111 jours.
  • Opus 4.6 — 5 février 2026 : mise à jour de version ; intervalle de 73 jours.
  • Opus 4.7 — 16 avril 2026 : mise à jour de version ; intervalle de 70 jours.
  • Opus 4.8 — 28 mai 2026 : mise à jour de version ; intervalle de 42 jours.
  • Opus 5 — 24 juillet 2026 : version majeure ; intervalle de 57 jours.
  • Opus 5.5 — 22 septembre 2026 : mise à jour de version et baisse de prix ; intervalle de 60 jours.

Source : notes de version de l’API Anthropic. Fable et les versions Mythos à accès restreint sont des branches distinctes et ne sont donc pas insérées dans la séquence Opus.

Les intervalles entre versions numérotées d’OpenAI varient de 28 à 98 jours ; ceux d’Opus chez Anthropic vont de 42 à 111 jours. Si l’on définit une « sortie majeure » comme un changement de numéro de famille, 392 jours ont séparé GPT-5 de GPT-6 et 428 jours Opus 4 d’Opus 5. Les intervalles plus courts correspondent aux mises à jour mineures et aux extensions de niveaux. Les deux séries fluctuent : les intervalles courts sont suivis de périodes plus longues.

Il est plus judicieux de mettre à niveau les modèles de façon sélective

Le calendrier des lancements donne constamment de nouvelles raisons de réévaluer le choix d’un modèle. Les quatre paires actuelles montrent pourquoi un verdict global sur un fournisseur ferait manquer des différences utiles : Anthropic propose un Opus récent et performant, OpenAI un niveau économique désormais concurrentiel, et les deux entreprises conservent des modèles plus anciens dans certaines parties de leur gamme.

Changer de version demande aussi du travail d’ingénierie. Le guide de migration vers Opus 5.5 d’Anthropic indique que le raisonnement est toujours activé, que la sélection forcée d’un outil renvoie une erreur et que l’ancien type d’outil de contrôle informatique est rejeté dans l’API Claude et sur Google Cloud. Les intégrations existantes qui utilisent ces options doivent être modifiées.

La prochaine évolution annoncée est la mise à jour de Sonnet et Haiku par Anthropic. Les acheteurs ont donc une raison concrète de réexaminer prochainement les niveaux inférieurs. Pour l’instant, les tarifs et résultats indépendants montrent déjà où la concurrence s’est déplacée et où un modèle plus ancien mérite encore d’être envisagé.