Aller au contenu
InYourGeek
visiteur@inyourgeek — console
compléter historique ouvrirhelp
EN
IA· 3 min de lecture

Opus 5.5 baisse de 40 %, GPT-6 Sol et Luna de moitié : guerre des prix

Anthropic et OpenAI ont dévoilé leurs nouveaux modèles le 23 septembre à quelques minutes d'écart. Derrière les benchmarks, l'annonce réelle est tarifaire : 40 % de baisse chez l'un, 50 % chez l'autre.

Deux étals de marché nocturne se faisant face dans une allée sombre : sur des balances en laiton, quelques grosses sphères lumineuses ambrées d'un côté, des centaines de minuscules de l'autre, les plateaux à peu près au même niveau sous une lampe suspendue.

Le même matin, à quelques minutes d’écart

Le 23 septembre au matin, Anthropic a présenté Claude Opus 5.5 comme son nouveau modèle phare. Quasiment dans la foulée, OpenAI a sorti GPT-6 Sol et GPT-6 Luna. Deux annonces le même matin, c’est le genre de coïncidence qui a un service marketing.

Les deux communiqués passent l’essentiel de leur temps sur les scores. C’est la grille tarifaire qui raconte ce qui se joue vraiment. Précision de méthode : tous les chiffres qui suivent viennent du compte rendu de Next publié ce matin-là, seule source de cet article.

Anthropic baisse le prix de son haut de gamme

Opus 5.5 est annoncé à 4 dollars le million de tokens en entrée et 20 dollars en sortie, les lectures de cache à 0,20 dollar le million. Anthropic revendique environ 40 % de moins qu’Opus 5 sur des charges de travail typiques, et des réponses générées 30 % plus vite.

C’est la partie solide de l’annonce, parce que le reste se désamorce tout seul. L’entreprise place son modèle devant Fable 5.1 et devant GPT-6 Astra sur ses propres tests — sauf sur la recherche agentique (Terminal-Bench-Science 0.1) et sur AutomationBench, qui mesure les agents en conditions de travail réelles — puis reconnaît que l’écart avec Fable 5.1 est « plus faible » que les scores ne le laissent croire. Elle écrit même que « les écarts entre les scores des benchmarks reflètent de moins en moins fidèlement les différences observées dans des situations réelles ». Rare, et honnête : le classement compte moins que la facture.

Un détail à connaître avant de câbler quoi que ce soit : Opus 5.5 hérite des protections de Fable 5.1 en cybersécurité, biologie et distillation, et la plupart des tâches liées à la cybersécurité sont redirigées vers Opus 4.8. Corriger un bug dans son code reste possible, mais sur ce périmètre le modèle que vous appelez n’est pas forcément celui qui répond. Pour aller plus loin, il faut passer par le Cyber Verification Program.

OpenAI ne vient pas jouer le même match

Sol et Luna ne sont pas là pour affronter Opus 5.5 — ce rôle reste dévolu à GPT-6 Astra. Sol vise les tâches du quotidien, Luna la vitesse et les budgets serrés sur les tâches fréquentes. Les deux sont annoncés à moitié prix de GPT-5.6 : 2 dollars en entrée et 10 en sortie pour Sol, 0,10 et 0,50 dollar pour Luna. La mise en cache des longs contextes progresse aussi, avec 90 % de réduction sur les jetons d’entrée déjà en cache.

Le chiffre qui pique est ailleurs. Sur AutomationBench, Sol obtient 33,2 % pour 0,27 dollar par tâche, là où Claude Opus 5 — le prédécesseur, pas le nouveau — plafonne à 26,9 % pour un coût annoncé environ onze fois supérieur. Le modèle explicitement présenté comme le moins puissant fait mieux, pour bien moins cher.

Une gamme qui s’étire par le bas

Mis bout à bout, ces tarifs dessinent un marché qui ne se segmente plus par la performance mais par le prix au token. De Luna à 0,10 dollar en entrée à Opus 5.5 à 4 dollars, le facteur est de quarante sur la même journée d’annonces. Rappel utile pour situer l’échelle : le 7 septembre, Next relevait qu’un seul prompt sur GPT-6 Astra pouvait coûter jusqu’à 33 dollars.

La vraie question d’architecture n’est donc plus « quel est le meilleur modèle », mais « à partir de quel volume je bascule du haut de gamme vers celui qui suffit ». Les deux éditeurs viennent de vous fournir les chiffres pour la trancher, ce qui est une façon élégante d’avouer que la course aux benchmarks ne convainc plus personne au moment de signer la facture.

Sources (1)

PartagerXLinkedInFacebookBluesky

Article rédigé avec l'assistance d'une IA à partir des sources citées, puis relu et validé avant publication par Sébastien Soulier.