Anthropic décline ses modèles Claude en plusieurs tailles. Haiku est la plus petite, celle qu’on garde pour les tâches simples répétées des milliers de fois. Après Opus 5.5 le 22 septembre puis Sonnet 5.5 le 28 septembre, la famille 5.5 s’agrandit ce mercredi 7 octobre avec Claude Haiku 5.5.
Pour les développeurs qui paient l’IA à la consommation, c’est surtout la grille tarifaire qui change. Haiku 5.5 coûte 0,10 dollar (environ 0,09 euro HT) par million de tokens envoyés au modèle et 0,50 dollar (environ 0,45 euro HT) par million de tokens générés. Haiku 4.5, sorti en octobre 2025, était facturé 1 et 5 dollars.
Cette baisse inverse la tendance de la génération précédente. À sa sortie, Haiku 4.5 avait au contraire coûté 25 % plus cher que Haiku 3.5, facturé 0,80 dollar en entrée et 4 dollars en sortie (environ 0,72 et 3,58 euros HT). Haiku 5.5 repasse donc nettement sous le prix de ses deux prédécesseurs.
Un token est un fragment de mot. C’est l’unité que les fournisseurs d’IA comptent pour facturer. Une application qui confie des résumés de documents à Haiku 5.5 paie chaque token dix fois moins cher qu’avec Haiku 4.5, du moins sur les requêtes de moins de 100 000 tokens.
Anthropic présente Haiku 5.5 comme son modèle le plus rapide à ce jour. Une note de bas de page apporte quand même une nuance : Opus reste plus rapide quand on active son mode Fast, une version jusqu’à 2,5 fois plus rapide du grand modèle, facturée le double du tarif standard d’Opus 5.5.
Haiku 5.5 est aussi le premier Haiku qui propose un réglage d’effort. Le développeur peut donc choisir entre une réponse plus réfléchie et une réponse moins chère.
Anthropic cible les tâches courtes et nombreuses : résumés, tri de demandes, requêtes dans une base de données. Il y a aussi la compaction, qui consiste à condenser l’historique d’une longue conversation pour qu’un agent puisse continuer à travailler sans saturer sa mémoire. Haiku 5.5 est également pensé comme sous-agent, c’est-à-dire un assistant à qui Opus 5.5 ou Sonnet 5.5 confient les petites tâches d’un projet de code.
La baisse de 90 % ne vaut que pour les requêtes de moins de 100 000 tokens. Au-delà, Haiku 5.5 passe à 0,50 dollar en entrée et 2,50 dollars en sortie (environ 0,45 et 2,24 euros HT). Ça fait cinq fois son tarif de base, et la remise par rapport à Haiku 4.5 tombe alors à 50 %. Anthropic précise tout de même que 90 % des requêtes envoyées à Haiku 4.5 restaient sous ce seuil.
Autre nuance, Haiku 5.5 utilise un nouveau tokenizer, l’outil qui découpe le texte en tokens, et ce découpage consomme un peu plus de tokens pour le même travail. Une fois tout compté, Anthropic annonce donc une facture environ 75 % plus basse qu’avec Haiku 4.5. La baisse reste très nette, mais le « dix fois moins cher » ne vaut que par token et sous le seuil des 100 000 tokens ; à la tâche, la facture est plutôt divisée par quatre.
OpenAI facture GPT-6 Luna exactement le même prix, 0,10 dollar en entrée et 0,50 dollar en sortie. Luna est le plus petit modèle d’OpenAI, lancé avec GPT-6 Sol quelques minutes après Opus 5.5, le 22 septembre. OpenAI avait alors divisé par deux le prix de son petit modèle, puisque GPT-5.6 Luna était facturé 0,20 dollar en entrée et 1,20 dollar en sortie (environ 0,18 et 1,07 euro HT). Anthropic s’aligne donc au centime près sur son concurrent direct, qui misait déjà sur le prix face à Opus 5.5 sur le haut de gamme.
Pour la qualité, Anthropic publie un tableau où Haiku 5.5 devance Luna sur chacun des tests où le modèle d’OpenAI figure. Sur OSWorld 2.1, où l’IA doit utiliser un vrai ordinateur pour finir des tâches en plusieurs étapes, il obtient 72,4 % contre 48,9 % pour Luna et 15,7 % pour Haiku 4.5. Il s’agit d’un score partiel, qui donne aussi des points pour les tâches à moitié terminées. Sur Terminal-Bench 4.0, qui mesure des tâches de code en ligne de commande, il obtient 39,2 % contre 16,4 %. Pour comparer, Haiku 4.5 restait à 0 % sur ce test et Sonnet 5.5 atteint 70,6 %.
Ces chiffres viennent d’Anthropic, qui a choisi ses propres réglages, et aucune mesure indépendante n’est encore disponible. Or les benchmarks d’un constructeur demandent de la prudence. Anthropic reconnaît d’ailleurs que pour du code complexe en mode agent, Sonnet 5.5 et Opus 5.5 restent de meilleurs choix. Sur le papier, Haiku 5.5 tient la route, mais il faudra des tests indépendants pour le confirmer.
Anthropic vise d’abord les chatbots qui doivent répondre vite, comme un support client en direct. Asana, qui édite un logiciel de gestion de projets, a mesuré dans ses tests internes un temps de réalisation des tâches réduit de plus de 30 % pour ses agents, par rapport au modèle qu’il utilise aujourd’hui. Attention, ces retours de clients sont choisis et publiés par Anthropic.
Le traitement en masse est l’autre cible. AlphaSense, une plateforme de recherche financière, envoie environ 8 millions de requêtes par semaine à son outil de questions-réponses sur documents. Sur 400 requêtes de test, son score est passé de 0,76 avec Haiku 4.5 à 0,84 avec Haiku 5.5. Box, spécialiste du stockage en ligne pour les entreprises, annonce 11 points de mieux que Haiku 4.5, sans préciser l’échelle utilisée, et un temps de réponse environ deux fois plus court. La baisse de prix pèse le plus sur ce genre de volume.
Pour une application mobile, gardez en tête que Haiku 5.5 tourne sur les serveurs d’Anthropic. Il ne s’installe pas sur le téléphone. L’application l’interroge par Internet via l’API, l’interface qui permet à un programme de dialoguer avec le modèle. La vitesse du modèle se ressent donc directement dans le temps d’attente à l’écran.
Anthropic met aussi à jour, en version bêta, ses kits de développement Python et TypeScript. Ils permettent désormais de faire piloter un navigateur ou un ordinateur par le modèle. D’après Anthropic, Haiku 5.5 est particulièrement adapté à ces deux usages grâce à sa vitesse et son prix.
Haiku 5.5 est disponible dès ce mercredi via l’API sous l’identifiant claude-haiku-5-5, ainsi que chez Amazon Web Services, Google Cloud et Microsoft Azure.
Haiku 4.5, lui, passe dans la liste des anciens modèles sur la grille tarifaire d’Anthropic. Sa fiche technique ne garantit son maintien que jusqu’au 15 octobre 2026, la semaine prochaine, et aucune date de retrait n’est encore fixée. Les développeurs qui l’utilisent ont donc intérêt à préparer la migration, pour laquelle Anthropic publie un guide.
Anthropic divise aussi par deux le prix des lectures en cache de Sonnet 5.5, qui passe de 0,20 à 0,10 dollar (environ 0,09 euro HT) le million de tokens. Comme ces lectures pèsent lourd dans la consommation, Sonnet 5.5 devient environ 20 % moins cher sur la plupart des tâches d’agent.
Enfin, les abonnés Max et Team recevront à partir de cette semaine un crédit API mensuel, utilisable sur tous les modèles. Le montant va de 100 dollars (environ 89 euros) pour Max 5x à 200 dollars (environ 179 euros) pour Max 20x, soit le prix mensuel de chacun de ces deux abonnements. Les comptes Team auront jusqu’à 500 dollars (environ 447 euros), à partager entre leurs membres.
Pour rappel, les abonnements Claude sont jugés environ cinq fois plus généreux que ceux d’OpenAI par le cabinet SemiAnalysis, sur les modèles de milieu de gamme.
Le meilleur moyen de nous donner un coup de pouce, c’est d’ajouter Frandroid à vos sources préférées sur Google.
Journaliste tech depuis 2013 et Chef de rubrique Survoltés chez Frandroid depuis 2022.
Mon quotidien ? Décortiquer la mobilité de demain et la transition énergétique. Je suis spécialiste des voitures électriques, des écosystèmes d'énergie (panneaux photovoltaïques, batteries) et du hardware (PC et Mac).
Fasciné par le sifflement des moteurs électriques et leur couple instantané, je suis aussi un cycliste du dimanche (gravel) et un explorateur des capacités offertes par l'intelligence artificielle dans la vie quotidienne.
C'est enregistré ! Surveillez votre boîte aux lettres, vous allez entendre parler de nous !






