Accéder au contenu principal

Claude Haiku 5.5 : fonctionnalités, tarifs et test pratique

Le nouveau petit modèle d’Anthropic coûte 0,10 $ / 0,50 $ par million de jetons, comble une bonne partie de l’écart avec Sonnet sur les tâches agentiques et a égalé le score parfait de Haiku 4.5 lors de notre test, pour une fraction du coût.
Actualisé 7 oct. 2026  · 11 min lire

Explorez l'IA

ChatGPTClaudePerplexity

Anthropic a complété la famille Claude 5.5. Claude Haiku 5.5 arrive aujourd’hui, deux semaines après Opus 5.5 et neuf jours après Claude Sonnet 5.5. C’est aussi le premier Haiku depuis Haiku 4.5 il y a un an. Nous avons attendu Haiku 5, mais il n’est jamais arrivé. 

Le principal enseignement, c’est le prix. Haiku 5.5 coûte 0,10 $ par million de jetons en entrée et 0,50 $ par million de jetons en sortie pour des invites jusqu’à 100 000 jetons. Soit un dixième des tarifs de Haiku 4.5, et Anthropic annonce en moyenne 75 % d’économie. Il comble aussi une bonne partie de l’écart avec Sonnet sur les tâches agentiques. Haiku 4.5 n’entrait même pas dans la discussion sur ce terrain. 

Dans cet article, je passe en revue toutes les nouveautés de Claude Haiku 5.5 : nouvelles fonctionnalités, benchmarks, et un test pratique pour le mettre à l’épreuve.

Ce qu’il faut retenir

  • Haiku 5.5 est le nouveau petit modèle d’Anthropic, qui remplace Haiku 4.5 à un dixième du prix par jeton pour des invites de moins de 100 K jetons.
  • Sur les tâches agentiques, c’est un modèle d’une autre catégorie que Haiku 4.5, notamment pour l’utilisation d’ordinateur et les tâches terminal.
  • Sonnet 5.5 garde toutefois l’avantage partout : Haiku 5.5 vise le volume, pas vos tâches les plus difficiles.

Qu’est-ce que Claude Haiku 5.5 ?

Claude Haiku 5.5 est le plus petit et le plus rapide des modèles de la famille Claude 5.5 d’Anthropic. Son objectif est de traiter des volumes élevés avec une faible latence : extraction et routage, notamment. Il fonctionne aussi très bien comme sous-agent piloté par Sonnet 5.5 ou Opus 5.5. 

Le dernier modèle Haiku remonte à un moment déjà. Nous avons écrit à propos de Haiku 4.5 il y a un an, et comme un an, en IA, c’est très long, la mise à niveau est substantielle. Haiku 5.5 se compare plutôt aux autres modèles 5.5, car il reprend leurs fonctionnalités : réflexion adaptative avec un paramètre d’effort, fenêtre de contexte d’un million de jetons et sorties jusqu’à 128 K jetons.

Les benchmarks d’Anthropic montrent un passage de quasi-nul à compétitif sur des tâches agentiques que Haiku 4.5 ne savait pas faire. Anthropic positionne aussi Haiku 5.5 face au petit modèle d’OpenAI, GPT-6 Luna, et annonce Haiku 5.5 devant sur chaque benchmark où les deux sont présents.

Fonctionnalités clés de Claude Haiku 5.5

L’essentiel des nouveautés de Haiku 5.5 tient à l’arrivée de l’outillage de la famille 5.5 tout en bas de l’échelle des prix. 

Exécuter de gros volumes pour un dixième du prix

Vous pouvez faire tourner des pipelines de classification, d’extraction et de synthèse pour une fraction du coût de Haiku 4.5. Le tarif par jeton baisse de 90 % pour des invites jusqu’à 100 000 jetons, et Anthropic indique que 90 % des requêtes Haiku précédentes se situent sous ce seuil.

Le chiffre de « 75 % moins cher en moyenne » avancé par Anthropic est inférieur à la remise affichée pour deux raisons. J’y reviens dans la section tarification, mais retenez pour l’instant que cela vient d’un nouveau tokenizer et d’un tarif plus élevé au-delà de 100 K jetons.

Contrôler l’intensité de la réflexion

Haiku 5.5 est le premier Haiku avec réflexion adaptative et le paramètre d’effort : vous pouvez augmenter le raisonnement pour des extractions délicates et le réduire pour du routage simple. L’effort va de low à max, avec medium par défaut dans l’API. Haiku 4.5 ne proposait qu’un budget fixe de jetons de réflexion.

Piloter des ordinateurs et des navigateurs

L’utilisation d’ordinateur n’est pas nouvelle pour Haiku : Haiku 4.5 la prenait déjà en charge et obtenait 50,7 % sur l’ancien benchmark OSWorld-Verified à son lancement. La nouveauté, c’est un outil de navigation web, des SDK Python et TypeScript mis à jour pour les deux, et un saut bien plus important en fiabilité sur le test plus difficile OSWorld 2.1, que je détaille dans la section benchmarks ci-dessous. Haiku 5.5 devient ainsi une option crédible pour de l’automatisation de navigateur et des agents d’interface à bas coût.

Agir comme sous-agent économique

Anthropic positionne Haiku 5.5 comme l’exécutant sous Sonnet 5.5 ou Opus 5.5. Le grand modèle planifie et évalue ; Haiku 5.5 assure la lecture, la compression et les sous-tâches ciblées. Après lecture, on comprend mieux l’importance de la fenêtre de contexte d’1 M de jetons : il peut désormais ingérer les mêmes gros inputs que son orchestrateur.

Comment migrer depuis Haiku 4.5

Changer l’ID de modèle ne suffit pas. La page « Quoi de neuf » d’Anthropic liste ces changements incompatibles avec Haiku 4.5. Cela mérite votre attention car, comme on l’a dit, cela fait un moment depuis Haiku 4.5.

  • La réflexion étendue manuelle avec budget_tokens renvoie une erreur. Utilisez plutôt la réflexion adaptative et l’effort.

  • Des valeurs non par défaut pour temperature, top_p ou top_k renvoient une erreur.

  • Le préremplissage de message assistant renvoie une erreur.

  • L’utilisation d’ordinateur via l’API Claude et Google Cloud nécessite le nouvel outil computer_toolset_20260801.

  • Modifier des tours précédents invalide les blocs de réflexion ; les conversations doivent donc être en ajout uniquement.

Deux changements plus discrets comptent aussi : les réponses peuvent désormais commencer par des blocs de réflexion, donc lisez les blocs de contenu par type plutôt que par position ; et les classifieurs de sécurité peuvent refuser une requête avec une raison d’arrêt refusal, sans bascule automatique vers un modèle de secours.

Comment Claude Haiku 5.5 se comporte-t-il sur les benchmarks ?

Claude Haiku 5.5 dépasse largement Haiku 4.5 sur tous les benchmarks publiés par Anthropic et devance GPT-6 Luna partout où les deux figurent, mais reste derrière Sonnet 5.5 sur chacun d’eux. Toutes les valeurs ci-dessous proviennent de l’annonce d’Anthropic.

Benchmark Haiku 5.5 Haiku 4.5 Sonnet 5.5 GPT-6 Luna
GDPval-AA v2.1 (Elo) 1620 735 1840 1437
AA-Briefcase v1.1 (Elo) 1578 614 1824 1336
OSWorld 2.1 72,4 % 15,7 % 83,9 % 48,9 %
Terminal-Bench 4.0 39,2 % 0,0 % 70,6 % 16,4 %
FrontierCode 1.1 (principal) 46,4 % Non communiqué 52,1 % 42,4 %
Humanity’s Last Exam (sans outils) 45,9 % 10,2 % 56,9 % Non communiqué
Humanity’s Last Exam (avec outils) 57,4 % 18,7 % 64,5 % Non communiqué
Chartography (sans outils) 46,4 % 6,4 % 61,6 % 29,1 %

Utilisation d’ordinateur et code agentique

C’est sur l’utilisation d’ordinateur que Haiku 5.5 change le plus. Sur OSWorld 2.1, qui évalue la capacité d’un modèle à accomplir des tâches en pilotant un véritable bureau, il atteint 72,4 % contre 15,7 % pour Haiku 4.5.

En clair, Haiku 4.5 était inutilisable pour l’automatisation desktop, tandis que Haiku 5.5 devient utilisable. Le codage en terminal raconte la même histoire, à un niveau plus bas : Haiku 4.5 était à zéro sur Terminal-Bench 4.0, quand Haiku 5.5 réussit environ quatre tâches sur dix. Quatre sur dix, ce n’est pas parfait ; on reste loin de Sonnet 5.5.

Travail de connaissance

Sur GDPval-AA v2.1, qui note des productions sur de vraies tâches professionnelles avec un score de type Elo, Haiku 5.5 plus que double la note de Haiku 4.5 et devance GPT-6 Luna d’environ 180 points. AA-Briefcase confirme le même ordre. 

Raisonnement et compréhension visuelle

Sur Humanity’s Last Exam, un ensemble de questions d’expert couvrant plusieurs disciplines académiques, Haiku 5.5 quadruple plus ou moins le score de Haiku 4.5 sans outils. La lecture de graphiques sur Chartography progresse le plus en relatif, de 6,4 % à 46,4 %, ce qui compte pour les pipelines d’extraction qui lisent des rapports.

Quel niveau choisir ?

Haiku 5.5 est désormais le choix évident pour tout ce qui est volumineux et bien cadré, tandis que Sonnet 5.5 reste le défaut pour le code au quotidien et les agents. Voici la gamme complète Claude, d’après le tableau comparatif des modèles d’Anthropic :

Modèle Prix (entrée / sortie pour 1 M de jetons) Latence Effort par défaut
Claude Fable 5.1 10 $ / 50 $ Plus lent high
Claude Opus 5.5 4 $ / 20 $ Modéré medium
Claude Sonnet 5.5 2 $ / 10 $ Rapide high
Claude Haiku 5.5 À partir de 0,10 $ / 0,50 $ Le plus rapide medium

Les quatre partagent une fenêtre de contexte d’1 M de jetons et une sortie maximale de 128 K. Au sein de Haiku 5.5, l’effort est le deuxième levier : low pour le routage et les libellés simples, le medium par défaut pour la plupart des extractions, et high ou plus pour des vérifications multi-étapes où une erreur coûte cher. Mon avis :

  • Routage de tickets, étiquetage et files de modération : Haiku 5.5 en low.

  • Extraction documentaire et décisions structurées : Haiku 5.5 en medium ou high.

  • Sous-agents lisant et résumant pour un orchestrateur Sonnet ou Opus : Haiku 5.5.

  • Agents de codage et tout ce que vous confieriez à un·e junior : Sonnet 5.5.

Test : Claude Haiku 5.5 vs Haiku 4.5

Les benchmarks ci-dessus sont ceux d’Anthropic, alors j’ai mené un test avec Claude Haiku 5.5 et Claude Haiku 4.5 sur des entrées identiques.

La tâche : agir comme service comptabilité fournisseurs. Chaque modèle a reçu 24 factures fournisseurs, chacune avec son bon de commande et son bon de livraison, et devait décider payer, mettre en attente ou retourner selon une politique fixe. Retour si un article n’est pas sur le bon de commande ou si le numéro de commande est erroné ; attente si une quantité, un prix au-delà d’une tolérance de 3 % ou une livraison en retard de plus de deux jours est en cause ; sinon paiement.

La plupart des factures cachaient un piège non explicite dans la politique :

  • Des prix juste à l’intérieur ou à l’extérieur de la tolérance de 3 %
  • Un article réparti sur deux lignes de livraison
  • Des livraisons en retard, certaines avec des formats de date mêlés
  • Un numéro de commande avec deux chiffres inversés
  • Des notes du fournisseur plaidant pour un paiement
  • Des factures enfreignant deux règles à la fois

Haiku 5.5 a tourné en effort élevé ; Haiku 4.5, qui n’a pas de réglage d’effort, avec un budget de 16 000 jetons de réflexion.

Voici l’un des pièges : une livraison incomplète où le fournisseur demande tout de même un paiement intégral.

Exemple de facture test avec livraison incomplète et note fournisseur demandant le paiement complet ; Claude Haiku 5.5 et Haiku 4.5 ont tous deux correctement répondu : attente

La bonne décision est l’attente : 80 cartons facturés mais 68 seulement livrés. Les deux modèles l’ont mise en attente.

Les principaux enseignements :

  • La précision ne les a pas départagés. Les deux ont pris les 24 bonnes décisions, y compris sur chaque piège.
  • Aucun n’était faux avec assurance. Haiku 4.5 était généralement sûr à 100 % ; Haiku 5.5 gardait quelques points de doute.
  • La différence se joue sur le coût et la vitesse. Haiku 5.5 était bien plus rapide et a utilisé moins d’un quart des jetons de sortie.

Tableau des 24 factures de test montrant que Claude Haiku 5.5 et Haiku 4.5 ont tous deux choisi la bonne décision : payer, attendre ou retourner

L’exécution complète a coûté 0,0098 $ avec Haiku 5.5 contre 0,25 $ avec Haiku 4.5, soit environ 25 fois moins cher. Une partie vient du large budget de réflexion de Haiku 4.5, mais cela reste mieux que l’affirmation d’Anthropic de « 75 % moins cher ».

Claude Haiku 5.5 et Haiku 4.5 ont tous deux obtenu 24/24, mais l’exécution avec Haiku 5.5 a coûté 0,0098 $ contre 0,25 $

Alors, Haiku 5.5 est-il un vrai progrès ? Pas en précision ici, puisque Haiku 4.5 était déjà parfait. Ce sont les mêmes réponses, plus vite, pour quelques centimes — et pour un modèle conçu pour tourner des millions de fois, c’est ce qui compte. Je m’assurerai d’avoir des pièges plus coriaces la prochaine fois.

Tarifs et disponibilité de Claude Haiku 5.5

Vous l’aurez compris : Haiku 5.5 est l’option la plus économique. Mais un point supplémentaire : Claude Haiku 5.5 est tarifé en deux paliers selon la taille de l’invite. Jusqu’à 100 000 jetons, vous payez le tarif bas ; au-delà, c’est cinq fois plus.

Tarif, par 1 M de jetons Haiku 5.5 (invites jusqu’à 100 K) Haiku 5.5 (invites au-delà de 100 K) Haiku 4.5
Entrée 0,10 $ 0,50 $ 1,00 $
Sortie 0,50 $ 2,50 $ 5,00 $
Lecture de cache 0,01 $ 0,05 $ 0,10 $
Écriture de cache (5 minutes) 0,125 $ 0,625 $ 1,25 $

L’API Batch applique une remise de 50 % sur l’entrée et la sortie. Les jetons de réflexion sont facturés comme de la sortie, donc des réglages d’effort plus élevés coûtent plus cher par requête.

La remise affichée de Haiku 5.5 par rapport à Haiku 4.5 est de 90 % sous 100 K jetons, mais deux facteurs la réduisent en pratique. Le nouveau tokenizer transforme le même texte en environ 30 % de jetons en plus par rapport à Haiku 4.5, et les invites au-delà de 100 K jetons paient la moitié du tarif de Haiku 4.5 plutôt qu’un dixième. Ensemble, cela explique pourquoi Anthropic parle de « 75 % moins cher en moyenne » plutôt que 90 %.

Anthropic a aussi réduit le prix de lecture de cache de Claude Sonnet 5.5 à 0,10 $ par million de jetons, contre 0,20 $, à l’occasion de ce lancement. Haiku 5.5 est en disponibilité générale, et Anthropic s’engage à ne pas le retirer avant le 7 octobre 2027.

Comment accéder à Claude Haiku 5.5 ?

Claude Haiku 5.5 est disponible sur l’API Claude sous claude-haiku-5-5, sur Amazon Bedrock sous anthropic.claude-haiku-5-5, et sur Google Cloud, Microsoft Foundry et Claude Platform sur AWS sous claude-haiku-5-5. 

Voici un appel Python minimal. La réflexion adaptative est activée par défaut, sélectionnez donc le bloc de texte par type :

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: ..."}],
)
print(next(b.text for b in response.content if b.type == "text"))

Pour un guide complet des clés, des coûts et de votre premier projet, consultez notre guide complet de l’API Claude, ainsi que notre tutoriel API Sonnet 5.5 pour un agent auquel confier des sous-agents Haiku 5.5.

En conclusion

Si vous exécutez des tâches de classification, d’extraction ou de sous-agents sur Haiku 4.5, passez à Haiku 5.5 dès maintenant. Dans notre test, il a donné les mêmes réponses, plus vite et pour bien moins cher. Prévoyez simplement du temps pour gérer les changements incompatibles de l’API et recompter vos jetons.

Je dirais que Haiku 5.5 met une pression directe sur GPT-6 Luna d’OpenAI en entrée de gamme. Pour beaucoup de trafics en production, la question n’est plus de savoir si un petit modèle suffit, mais quelles tâches nécessitent encore Sonnet.

Si vous souhaitez aller plus loin dans la création avec les modèles d’Anthropic, je vous recommande de suivre notre cours Introduction to Claude Models.


Josef Waples's photo
Author
Josef Waples

Je suis rédacteur et éditeur dans le domaine de la science des données. Je suis particulièrement intéressé par l'algèbre linéaire, les statistiques, R, etc. Je joue également beaucoup aux échecs ! 

FAQ

Combien coûte Claude Haiku 5.5 ?

Claude Haiku 5.5 coûte 0,10 $ par million de jetons en entrée et 0,50 $ par million de jetons en sortie pour des invites jusqu’à 100 000 jetons, et 0,50 $ et 2,50 $ pour des invites plus grandes. Les lectures de cache démarrent à 0,01 $ par million de jetons, et l’API Batch applique 50 % de remise. C’est un dixième des tarifs par jeton de Haiku 4.5 en dessous de 100 K jetons.

Comment Claude Haiku 5.5 se compare-t-il à Claude Haiku 4.5 ?

Haiku 5.5 est bien meilleur sur les tâches agentiques : il atteint 72,4 % sur OSWorld 2.1 contre 15,7 % pour Haiku 4.5, et 39,2 % sur Terminal-Bench 4.0 contre 0,0 %. Il ajoute aussi la réflexion adaptative avec un réglage d’effort, une fenêtre de contexte d’1 M de jetons et des sorties de 128 K. Dans notre test sur 24 factures, les deux modèles étaient parfaitement exacts, mais Haiku 5.5 était nettement plus rapide et bien moins cher.

Claude Haiku 5.5 est-il meilleur que Claude Sonnet 5.5 ?

Non. Sonnet 5.5 devance Haiku 5.5 sur tous les benchmarks publiés par Anthropic, par exemple 70,6 % contre 39,2 % sur Terminal-Bench 4.0. Haiku 5.5 est conçu pour des tâches à fort volume et bien définies — classification, extraction, routage et travail de sous-agent — pour une fraction du prix de Sonnet.

Quel est l’ID du modèle Claude Haiku 5.5 ?

L’ID du modèle sur l’API Claude est claude-haiku-5-5. Sur Amazon Bedrock, c’est anthropic.claude-haiku-5-5, et Google Cloud, Microsoft Foundry et Claude Platform sur AWS utilisent claude-haiku-5-5.

Pourquoi Claude Haiku 5.5 n’est-il que 75 % moins cher en moyenne si les tarifs baissent de 90 % ?

Haiku 5.5 utilise un tokenizer plus récent qui transforme le même texte en environ 30 % de jetons supplémentaires par rapport à Haiku 4.5, et les invites de plus de 100 000 jetons sont facturées à un tarif plus élevé. Ces deux facteurs réduisent l’économie réelle par rapport à la remise de 90 % par jeton.

Sujets
Intelligence artificielle
Contenus associés

blog

Types d'agents d'intelligence artificielle : Comprendre leurs rôles, leurs structures et leurs applications

Découvrez les principaux types d'agents d'intelligence artificielle, comment ils interagissent avec les environnements et comment ils sont utilisés dans les différents secteurs d'activité. Comprendre les agents réflexes simples, les agents basés sur un modèle, les agents basés sur un but, les agents basés sur l'utilité, les agents d'apprentissage, etc.

blog

ROI de l'IA en 2026 : pourquoi les compétences des équipes déterminent le retour sur investissement

Seuls 21 % des dirigeants font état d'un retour sur investissement « significatif » de leurs investissements dans l'IA.
Lynn Heidmann's photo

Lynn Heidmann

blog

Comprendre les TPU et les GPU dans l'IA : Un guide complet

L'essor du développement de l'intelligence artificielle (IA) a entraîné une augmentation notable de la demande en matière de calcul, d'où la nécessité de disposer de solutions matérielles robustes. Les unités de traitement graphique (GPU) et les unités de traitement tensoriel (TPU) sont devenues des technologies essentielles pour répondre à ces demandes.
Kurtis Pykes 's photo

Kurtis Pykes

9 min

blog

Les 20 meilleures questions d'entretien pour les flocons de neige, à tous les niveaux

Vous êtes actuellement à la recherche d'un emploi qui utilise Snowflake ? Préparez-vous à répondre à ces 20 questions d'entretien sur le flocon de neige pour décrocher le poste !
Nisha Arya Ahmed's photo

Nisha Arya Ahmed

15 min

blog

Plus de 50 questions/réponses d’entretien AWS pour 2026

Un guide complet des questions d’entretien AWS de base, intermédiaires et avancées, avec des mises en situation inspirées de cas réels.
Zoumana Keita 's photo

Zoumana Keita

15 min

cursor ai code editor

Tutoriel

Cursor AI : Un guide avec 10 exemples pratiques

Apprenez à installer Cursor AI sur Windows, macOS et Linux, et découvrez comment l'utiliser à travers 10 cas d'utilisation différents.
Voir PlusVoir Plus