Anthropic a publié mardi Claude Haiku 5.5, le décrivant comme « le petit modèle le moins cher, le plus rapide et le plus performant que nous ayons jamais sorti ». Le lancement s'accompagne d'une forte baisse de prix à deux niveaux qui ramène les coûts d'entrée à 0,10 $ par million de jetons pour la plupart des demandes, une décision qui exerce une pression directe sur le GPT-6 Luna d'OpenAI dans le segment des petits modèles et prolonge une guerre des prix de plusieurs mois dans l'industrie de l'IA.
L'annonce, publiée sur le site d'Anthropic le 7 octobre 2026, positionne Haiku 5.5 comme le troisième modèle de la famille Claude 5.5, aux côtés du Sonnet 5.5 et de l'Opus 5.5. Reuters a qualifié cette version d'Anthropic élargissant sa gamme de modèles alors qu'elle se prépare à une introduction en bourse prévue, et le modèle est déjà disponible dans GitHub Copilot, Amazon Web Services, Google Cloud et Microsoft Foundry. Ce lancement est la dernière entrée en un mois de dernières actualités sur l'IA qui a vu des lancements de modèles, des réductions de prix et des changements politiques arriver presque chaque jour.
Un petit modèle conçu pour les travaux à gros volume
Selon Anthropic, Claude Haiku 5.5 est conçu pour des tâches à volume élevé et sensibles aux coûts plutôt que pour un raisonnement au niveau des frontières. La société affirme qu'elle « gère de manière fiable les charges de travail rapides et répétitives » telles que les résumés, le compactage, les requêtes de bases de données et les demandes de classification.
Anthropic positionne également le nouveau modèle comme un compagnon de ses systèmes plus grands : Haiku 5.5 « s'associe bien avec Opus 5.5 et Sonnet 5.5 en tant que sous-agent du travail de codage », permettant aux développeurs d'acheminer des sous-tâches rapides et bon marché vers Haiku tout en réservant des modèles plus grands pour un raisonnement complexe. Parce qu'il s'agit du modèle le plus rapide d'Anthropic à ce jour à vitesse standard, la société le recommande pour les applications sensibles à la latence comme le support client en direct et l'utilisation du navigateur. Une note de bas de page ajoute une mise en garde : les modèles Opus d'Anthropic fonctionnent toujours plus rapidement en mode rapide.
Prix : jusqu'à 90 % moins cher que Haiku 4.5
Le changement principal est le prix. Anthropic affirme que Haiku 5.5 coûte en moyenne environ 75 % de moins à exécuter que Haiku 4.5, avec une structure à plusieurs niveaux qui dépend de la taille de l'invite.
Pour les demandes avec des invites allant jusqu'à 100 000 jetons – qui, selon Anthropic, représentaient environ 90 % des demandes adressées au modèle Haiku précédent – les prix sont 90 % inférieurs à ceux de Haiku 4.5. Les invites de plus de 100 000 jetons coûtent 50 % de moins.
Le tableau des prix par million de jetons de l'annonce d'Anthropic montre l'ampleur de la réduction :
- Jetons d'entrée : 0,10 $ (invites jusqu'à 100 000) ou 0,50 $ (plus de 100 000), en baisse par rapport à 1,00 $ fixe pour Haiku 4.5
- Jetons de sortie : 0,50 $ ou 2,50 $, contre 5,00 $
- Lecture du cache : 0,01 $ ou 0,05 $, contre 0,10 $ auparavant
- Écrits du cache : 0,125 $ ou 0,625 $, contre 1,25 $
Au niveau inférieur à 100 000, cela fait que le prix de sortie de Haiku 5.5 représente un cinquième des 10,00 $ par million de jetons de sortie de Sonnet 5.5.
Anthropic note un détail technique derrière les chiffres : Haiku 5.5 utilise un tokenizer mis à jour, similaire à Sonnet 5.5 et Opus 5.5, ce qui signifie qu'il utilise légèrement plus de jetons par tâche que Haiku 4.5. L'entreprise affirme que son calcul du coût moyen tient compte de cette différence.
Benchmarks : devant GPT-6 Luna dans la plupart des lignes
Anthropic a publié un tableau de référence comparant Haiku 5.5 à Haiku 4.5, GPT-6 Luna et Sonnet 5.5. Dans la plupart des évaluations répertoriées, le nouveau modèle termine devant Luna et nettement devant son prédécesseur :
- GDPval-AA v2.1 (travail de connaissances) : 1620 pour Haiku 5.5, contre 735 pour Haiku 4.5, 1437 pour GPT-6 Luna et 1840 pour Sonnet 5.5
- AA-Briefcase v1.1 : 1578, contre 614 pour Haiku 4.5 et 1336 pour Luna
- OSWorld 2.1, sous-ensemble hors ligne (utilisation de l'ordinateur) : 72,4 %, contre 15,7 % pour Haiku 4.5, 48,9 % pour Luna et 83,9 % pour Sonnet 5.5.
- Dernier examen de l'humanité : 45,9 % sans outils et 57,4 % avec outils, contre 10,2 % et 18,7 % pour Haiku 4.5
- Terminal-Bench 4.0 (codage agent) : 39,2 %, contre 16,4 % pour Luna et 70,6 % pour Sonnet 5.5
- FrontierCode 1.1, Main : 46,4 %, devant les 42,4 % de Luna
Le modèle est cohérent : Haiku 5.5 réduit une grande partie de l'écart avec GPT-6 Luna et, en utilisation informatique, le bat carrément, tandis que Sonnet 5.5 d'Anthropic est toujours en tête dans toutes les catégories. Les conseils d'Anthropic reflètent cette hiérarchie : la société affirme que Sonnet 5.5 et Opus 5.5 "restent de meilleurs choix pour les tâches de codage agent complexes comme celles mesurées par Terminal-Bench 4.0", tandis que Haiku 5.5 cible des travaux à portée étroite qui "auraient autrement pu être prohibitifs avec les versions précédentes de Claude".
Premier haïku avec un cadran d'effort
Haiku 5.5 est également le premier modèle de classe Haiku à être livré avec un réglage d'effort réglable, le contrôle coût/intelligence qu'Anthropic proposait auparavant sur ses modèles plus grands. Les utilisateurs peuvent choisir la quantité de calcul consommée par chaque requête, et les graphiques d'Anthropic affichent les scores de référence pour chaque niveau d'effort, de faible à maximum.
Posture de sécurité : plus serrée que Haiku 4.5, plus souple que Sonnet
Concernant la sécurité, Anthropic affirme que Haiku 5.5 montre « des améliorations majeures dans presque toutes nos évaluations d'alignement par rapport à Haiku 4.5 », avec beaucoup moins de cas de comportement mal aligné et une moindre volonté de coopérer en cas d'utilisation abusive.
Les mesures de cybersécurité du modèle sont plus restrictives que celles du Haiku 4.5, bien qu'un peu moins restrictives que celles des récents modèles plus grands d'Anthropic. Ils permettent un plus large éventail de tâches de sécurité défensives que les protections de Sonnet 5.5, mais bloquent toujours les tests d'intrusion et les techniques plus susceptibles d'être utilisées par les attaquants. Les garanties biologiques correspondent à celles de Sonnet 5, Sonnet 5.5 et Opus 5. Les organisations ayant besoin d'un accès plus large peuvent postuler aux programmes de sciences de la vie ou de cybervérification d'Anthropic. Tous les détails se trouvent dans la carte système Haiku 5.5.
Le reste de l'annonce : Sonnet moins cher, crédits API gratuits
Le lancement était accompagné de plusieurs autres changements. Les lectures de cache sur Claude Sonnet 5.5 coûtent désormais 0,10 $ par million de jetons au lieu de 0,20 $ – une réduction de 50 % qui, selon Anthropic, rend Sonnet 5.5 environ 20 % moins cher sur la plupart des travaux agents, puisque les lectures de cache dominent la consommation de jetons dans les flux de travail des agents.
Anthropic déploie également cette semaine des crédits API mensuels pour les clients abonnés : 100 $ par mois pour les utilisateurs Max 5x, 200 $ pour les utilisateurs Max 20x et jusqu'à 500 $ regroupés entre les utilisateurs pour les forfaits Team, utilisables sur n'importe quel modèle. Les crédits sont destinés aux abonnés créant des outils et des agents sur la plateforme Claude.
Les développeurs reçoivent également des mises à jour du SDK : les SDK Python et TypeScript d'Anthropic prennent désormais en charge l'utilisation de l'ordinateur et du navigateur en version bêta, des fonctionnalités qui, selon la société, conviennent au profil vitesse-prix de Haiku 5.5.
Une guerre des prix sans fin en vue
La couverture médiatique du Decoder a présenté le lancement comme la preuve que « la course aux armements en matière de tarification de l’IA est loin d’être terminée », et les chiffres confirment cette lecture. En septembre, Anthropic et OpenAI ont lancé des modèles phares rivaux à quelques heures d'intervalle, accompagnés de baisses de prix concurrentes. Haiku 5.5 étend cette bataille au bas de gamme du marché, où les petits modèles alimentent les charges de travail les plus volumineuses et les plus sensibles au prix.
Pour les développeurs, l'effet immédiat est simple : l'inférence sur petit modèle sur la plate-forme Claude commence désormais à 0,10 $ par million de jetons d'entrée et à 0,50 $ par million de jetons de sortie, GPT-6 Luna étant battu sur la plupart des benchmarks publiés par Anthropic à ce niveau de prix. Que OpenAI réponde par une baisse de prix de Luna – ou attende sa prochaine version de petit modèle – indiquera à quel point ce prix plancher est réellement durable.
Haiku 5.5 est désormais disponible sur les applications et API propriétaires d'Anthropic, Amazon Web Services, Google Cloud et Microsoft Foundry, et est déjà intégré à GitHub Copilot.
Gardez une longueur d'avance sur l'IA Lisez plus d'actualités sur l'IA sur AI Buzz Wire