Aller au contenu
InYourGeek
visiteur@inyourgeek — console
↹ compléter↑↓ historique⏎ ouvrirhelp
EN
IA· 3 min de lecture

Claude Haiku 5.5 : le petit modèle d'Anthropic 75 % moins cher

Anthropic a lancé le 7 octobre 2026 Claude Haiku 5.5, sa nouvelle génération de petit modèle rapide. L'enjeu : récupérer le terrain du bas de gamme, où il s'était fait distancer sur le prix.

Un petit colibri rapide volant dans une salle serveurs sombre, butinant une étiquette de prix lumineuse couleur ambre, relié par un fil doré à la silhouette lointaine d'un hibou posé.

Anthropic a dévoilé le 7 octobre 2026 Claude Haiku 5.5, présenté comme son petit modèle le plus rapide, le plus capable et le moins cher à ce jour. La cible est assumée : les charges à fort volume et sensibles au coût — résumés, compactions, requêtes en base, classification — et le rôle de sous-agent aux côtés d’Opus 5.5 et de Sonnet 5.5 sur des travaux de code. Comme c’est aussi le modèle le plus rapide de la maison, Anthropic le pousse vers le support client en direct et le pilotage de navigateur.

Un rattrapage sur le prix

Le bas de gamme, c’est une affaire de prix. Le précédent Haiku 4.5, sorti il y a presque un an, était facturé 1 $ le million de tokens en entrée et 5 $ en sortie — soit dix fois le tarif du GPT-6 Luna d’OpenAI, lancé le mois dernier, comme le relève Simon Willison. Haiku 5.5 aligne exactement le prix de Luna : 0,10 $ en entrée, 0,50 $ en sortie. Anthropic annonce de son côté un coût d’exécution en moyenne 75 % inférieur à celui de Haiku 4.5.

Deux astérisques, et ils comptent. Ce tarif ne tient que jusqu’à 100 000 tokens : au-delà, il est multiplié par cinq, à 0,50 $ / 2,50 $. Luna, lui, ne change de palier qu’à 272 000 tokens, et plus doucement (0,20 $ / 0,75 $). Sous les 100 000 tokens, Haiku revendique de meilleurs scores pour le même prix ; au-dessus, Luna redevient nettement plus avantageux.

Le tokenizer qui compte double

Simon Willison pointe un autre détail absent de la grille tarifaire : Haiku 5.5 utilise un nouveau tokenizer, moins généreux. Son compteur de tokens maison montre qu’un même long prompt consomme environ 1,25 fois plus de tokens qu’avec Haiku 4.5. Autrement dit, une partie de la baisse affichée se dissout dans le fait que la même requête pèse désormais plus lourd. Le prix au token baisse, le nombre de tokens monte.

Un curseur d’effort, enfin

Côté intelligence, nouveauté : c’est le premier modèle de la gamme Haiku à proposer un réglage d’effort ajustable, comme les grands modèles. Cinq niveaux — low, medium, high, xhigh, max — laissent arbitrer entre coût et qualité. Particularité : impossible de désactiver complètement le raisonnement, et le niveau par défaut est medium. Anthropic publie des courbes sur trois bancs d’essai mesurés à chaque niveau — OSWorld (usage de l’ordinateur), GDPval-AA (travail de connaissance) et Humanity’s Last Exam (raisonnement).

Parmi les premiers clients, Asana rapporte sur sa propre suite de tests d’agents une réduction de plus de 30 % de la latence sur l’achèvement des tâches, et une inférence jusqu’à 2,5 fois plus rapide par tour d’agent par rapport au modèle qu’elle utilisait jusque-là.

Un cadeau pour les abonnés

Autour du lancement, Anthropic divise par deux le prix des lectures de cache de Sonnet 5.5 — environ 20 % moins cher sur la plupart des travaux agentiques. Et surtout, un crédit API mensuel arrive pour les abonnés Max et Team : 100 $ pour les Max 5x, 200 $ pour les Max 20x, jusqu’à 500 $ mutualisés pour Team, soit pile le prix de l’abonnement. Un bémol signalé par Willison : ces crédits ne se reportent pas d’un mois sur l’autre.

Anthropic rattrape donc le prix d’OpenAI sur le bas de gamme, à condition de rester sous la barre des 100 000 tokens et de ne pas trop regarder le compteur de tokens tourner.

Sources (2)

PartagerXLinkedInFacebookBluesky

Article rédigé avec l'assistance d'une IA à partir des sources citées, puis relu et validé avant publication par Sébastien Soulier.