News · Logiciel
Claude Haiku 5.5 : 0,10 $ le million de tokens, 75 % moins cher que Haiku 4.5
Le 7 octobre 2026, Anthropic lance Claude Haiku 5.5 : 0,10 $ / 0,50 $ par million de tokens sous 100 000 tokens, contexte de 1 million, réglage d'effort. Les « 75 % » se comparent à Haiku 4.5. Prix, benchmarks, disponibilité et pièges de migration.

Le 7 octobre 2026, Anthropic a lancé Claude Haiku 5.5 (ouvre anthropic.com dans un nouvel onglet), son petit modèle pour les tâches rapides et répétitives. Le chiffre mis en avant, « environ 75 % moins cher », se compare à Haiku 4.5, pas à Sonnet 5.5. Il est disponible dès maintenant via l'API.
Info
Contrôle du 8 octobre 2026. Sources primaires lues : annonce d'Anthropic (ouvre anthropic.com dans un nouvel onglet), fiche Haiku 5.5 de la documentation (ouvre platform.claude.com dans un nouvel onglet), page des tarifs (ouvre platform.claude.com dans un nouvel onglet), nouveautés et ruptures (ouvre platform.claude.com dans un nouvel onglet), configuration des modèles de Claude Code (ouvre code.claude.com dans un nouvel onglet). Non confirmé à cette date : les formules claude.ai qui donnent accès à Haiku 5.5, et un tarif en euros.
75 % moins cher que Haiku 4.5, en moyenne
Le prix dépend désormais de la taille de la requête. Jusqu'à 100 000 tokens de prompt, Haiku 5.5 coûte 0,10 $ par million de tokens en entrée et 0,50 $ en sortie, contre 1 $ et 5 $ pour Haiku 4.5, soit une baisse de 90 %. Au-delà de 100 000 tokens, la requête passe à 0,50 $ et 2,50 $, soit 50 % de moins seulement.
Le cache de prompt, qui évite de refacturer un contexte déjà envoyé, suit la même logique : lecture à 0,01 $ (0,05 $ au-delà), écriture à 0,125 $ pour cinq minutes. L'API Batch divise par deux l'entrée et la sortie, selon la page tarifs (ouvre platform.claude.com dans un nouvel onglet).
D'où vient le « 75 % » ? Selon Anthropic, 90 % des requêtes envoyées à Haiku 4.5 restaient sous les 100 000 tokens. Le calcul intègre aussi le nouveau tokenizer, qui découpe le texte en tokens : d'après la documentation (ouvre platform.claude.com dans un nouvel onglet), un même texte compte environ 30 % de tokens en plus. Le prix par token baisse donc plus que la facture.

Crédit : Anthropic (ouvre anthropic.com dans un nouvel onglet), capture du tableau des prix de l'annonce, 7 octobre 2026.
Sous 100 000 tokens, l'entrée de Haiku 5.5 coûte 20 fois moins que celle de Sonnet 5.5 (2 $ / 10 $) et 40 fois moins que celle d'Opus 5.5 (4 $ / 20 $, selon la documentation). Anthropic divise aussi par deux la lecture de cache de Sonnet 5.5, à 0,10 $, ce qui le rendrait environ 20 % moins cher en usage agentique.
Contexte de 1 million de tokens et benchmarks
La fenêtre de contexte passe de 200 000 à 1 million de tokens, et la sortie maximale de 64 000 à 128 000 tokens. C'est aussi le premier Haiku doté d'un réglage d'effort, qui arbitre entre coût et qualité (medium par défaut).
Les scores suivants sont publiés par Anthropic, pas mesurés par Yatofix :
- GDPval-AA v2.1 (travail de bureau) : 1 620 Elo, contre 735 pour Haiku 4.5 et 1 840 pour Sonnet 5.5 ;
- OSWorld 2.1 (pilotage d'un ordinateur, sous-ensemble hors ligne) : 72,4 %, contre 15,7 % et 83,9 % ;
- Terminal-Bench 4.0 (code en ligne de commande) : 39,2 %, contre 0 % et 70,6 % ;
- Humanity's Last Exam sans outils : 45,9 %, contre 10,2 % et 56,9 %.
Dans le même tableau, GPT-6 Luna d'OpenAI fait moins bien que Haiku 5.5 sur chaque test où il figure. Anthropic reconnaît que Sonnet 5.5 et Opus 5.5 restent préférables pour le code agentique complexe.
Disponibilité et ce qui change pour un développeur
Haiku 5.5 est disponible sur l'API Claude (claude-haiku-5-5), Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. Claude Code (ouvre code.claude.com dans un nouvel onglet) l'utilise à partir de la version 2.1.293 : l'alias haiku pointe vers Haiku 5.5 sur l'API Anthropic, mais encore vers Haiku 4.5 chez les clouds tiers. Un prompt système Haiku 5.5 est publié pour claude.ai et les applis mobiles, sans précision sur les formules. Les prix sont en dollars, sans grille européenne.
Attention à la migration : du code écrit pour Haiku 4.5 peut casser. Le réglage manuel de réflexion (budget_tokens), le préremplissage de la réponse et des valeurs non standard de temperature, top_p ou top_k renvoient désormais une erreur 400, d'après le guide (ouvre platform.claude.com dans un nouvel onglet). Une réponse peut aussi commencer par un bloc de réflexion.
Enfin, les abonnés Max et Team reçoivent cette semaine des crédits API mensuels : 100 $ (Max 5x), 200 $ (Max 20x), jusqu'à 500 $ partagés (Team).
Notre lecture
Analyse. Le vrai changement est le prix sous 100 000 tokens : résumés, classement ou sous-agents deviennent presque gratuits à l'unité. Mais le « 75 % » reste une moyenne d'Anthropic. Avant de basculer, recompte tes prompts avec le nouveau tokenizer et surveille les requêtes longues, facturées cinq fois plus cher.
Laisser un avis
Avis des lecteurs
Aucun avis publié pour le moment.




