ModèlesPopulaire

Claude Haiku 5.5 : Anthropic divise la facture du petit modèle par quatre

Anthropic lance Claude Haiku 5.5, son petit modèle le plus rapide à ce jour. Son exploitation coûte environ 75 % moins cher que Haiku 4.5, et Sonnet 5.5 voit aussi son cache baisser de moitié.

Julien MartinJulien Martin
Popularité : 1,500
Claude Haiku 5.5 : Anthropic divise la facture du petit modèle par quatre

Anthropic descend d'un cran sur l'entrée de gamme : son nouveau petit modèle coûte environ quatre fois moins cher à exploiter que le précédent, et la société en profite pour alléger aussi la facture de son modèle intermédiaire.

Claude Haiku 5.5 débarque dans toute la gamme Claude

Le 7 octobre, Anthropic a publié Claude Haiku 5.5, qu'elle présente comme son petit modèle le plus rapide et le plus capable à ce jour. La société le destine aux tâches répétitives et à gros volume : résumés, compactage de conversations, requêtes en base de données, classification. Autrement dit, tout ce qu'un utilisateur confie des dizaines de fois par jour sans y penser.

Le chiffre que retient Anthropic porte sur l'exploitation. Sur un ensemble de charges comparables, Haiku 5.5 revient à environ 75 % moins cher que Haiku 4.5. Pour les requêtes jusqu'à 100 000 tokens, l'entrée est facturée 0,10 dollar par million de tokens et la sortie 0,50 dollar. Au-delà de ce seuil, les tarifs grimpent à 0,50 dollar en entrée et 2,50 dollars en sortie. Anthropic précise que les requêtes sous 100 000 tokens représentent près de 90 % de ce que recevait la génération précédente.

Ce modèle complète une famille déjà bien remplie. Opus 5.5 était arrivé le 22 septembre, Sonnet 5.5 le 28. Haiku 5.5 était annoncé depuis cette première date comme la pièce manquante, celle qui vient fermer la gamme Claude 5.5 par le bas. Il est disponible immédiatement sur Claude Platform, mais aussi via Amazon Web Services, Google Cloud et Microsoft Azure.

Pourquoi ce modèle compte-t-il autant ?

Prix et usages de Claude Haiku 5.5

Le positionnement de Haiku 5.5 tient en une phrase : faire le travail de fond sans faire exploser la note. Anthropic insiste surtout sur les usages où la vitesse compte, comme le support client en direct ou l'automatisation d'un navigateur. Le modèle prend aussi en charge un réglage d'effort, une première pour la gamme Haiku. L'utilisateur choisit lui-même s'il privilégie le coût ou l'intelligence.

Catégorie

Budget ou détail

Requêtes courantes

messages jusqu'à 100 000 tokens

Tarif entrée

0,10 dollar le million de tokens

Tarif sortie

0,50 dollar le million de tokens

Réglage d'effort

disponible, comme sur les autres modèles

Plateformes

Claude Platform, AWS, Google Cloud, Azure

Le gain de coût s'accompagne d'une hausse de qualité. Anthropic indique que Haiku 5.5 obtient 43 sur l'indice d'intelligence d'Artificial Analysis, un score qui le place nettement au-dessus de son prédécesseur. Sur Terminal-Bench 4.0, un test qui mesure l'exécution de commandes dans un terminal, il passe de 0,0 % à 39,2 %. Sur FrontierCode, il atteint 46,4 %. Ces chiffres restent ceux annoncés par l'éditeur et attendent une confirmation indépendante.

L'autre annonce, moins visible mais tout aussi concrète, concerne Sonnet 5.5. Anthropic divise par deux le prix de lecture de son cache, qui tombe à 0,10 dollar par million de tokens. Résultat : sur la plupart des tâches dites agentiques, ce modèle revient à environ 20 % moins cher qu'auparavant. La société ajoute un crédit mensuel d'API pour ses abonnés Max et Team. Objectif affiché : soutenir ceux qui construisent des agents sur sa plateforme.

Pourquoi la bataille des petits modèles s'intensifie

Le mouvement d'Anthropic intervient dans un marché où les petits modèles sont devenus un terrain de concurrence à part entière. Les tarifs annoncés rapprochent Haiku 5.5 de ceux de GPT-6 Luna, le modèle léger d'OpenAI, ce qui suggère un alignement assez net entre les deux acteurs sur ce segment.

Pour les développeurs, la question n'est pas abstraite. Un modèle qui coûte quatre fois moins cher à faire tourner change l'économie d'un produit : on peut le brancher sur des tâches que l'on réservait auparavant à un modèle plus puissant, ou multiplier les appels là où on les comptait. Les équipes qui gèrent des assistants de support ou des chaînes de traitement automatisées sont les premières concernées.

Reste une limite que ces annonces ne lèvent pas : un petit modèle reste un petit modèle. Haiku 5.5 convient aux tâches cadrées et répétitives, pas aux raisonnements longs et ouverts. La vraie nouveauté tient dans le rapport entre le coût et la qualité, pas dans l'idée qu'un modèle léger remplacerait un grand. Anthropic le dit d'ailleurs à sa façon. Haiku 5.5 est taillé pour intervenir comme sous-agent dans un travail de code, à côté d'Opus 5.5 ou de Sonnet 5.5.

Ce qu'il faut retenir avant de migrer

Haiku 5.5 est disponible dès maintenant, sans période d'attente. Les développeurs peuvent l'appeler avec l'identifiant claude-haiku-5-5 depuis la Claude Platform ou passer par un des trois grands clouds. Un guide de migration est publié pour ceux qui doivent basculer leurs appels depuis Haiku 4.5.

Avant de faire le saut, un conseil simple : recalculez le coût réel d'une requête complète, entrée comprise, sur vos derniers jours d'usage. La baisse de 75 % porte sur l'exploitation moyenne. Pas sur chaque appel pris isolément. Si vous envoyez beaucoup de contexte ou des documents longs, le gain sera moins net que sur des échanges courts. Le modèle est là. L'arbitrage, lui, reste à faire de votre côté.

Partager cet article

Produits mentionnés

Sources

Actualités liées à l’IA

Gemini agent : Google Cloud transforme Gemini en collègue autonome
Produit

Gemini agent : Google Cloud transforme Gemini en collègue autonome

Google Cloud présente Gemini agent, un agent unique qui planifie le travail, se connecte aux outils de l'entreprise et rend une tâche finie. Il accepte aussi les modèles Claude d'Anthropic.

Popularité : 820
Anthropic interdit d'être cruel envers Claude dans sa nouvelle politique
Entreprises et secteurs d’activité

Anthropic interdit d'être cruel envers Claude dans sa nouvelle politique

Anthropic publie une politique d'utilisation inédite qui interdit les comportements répétés et cruels envers ses modèles. Les règles sur les élections, les armes et la surveillance sont aussi précisées.

Popularité : 780
OSS Scanner : Anthropic offre un scanner gratuit aux projets open source
Produit

OSS Scanner : Anthropic offre un scanner gratuit aux projets open source

Anthropic lance OSS Scanner, un service gratuit et sur inscription qui scanne les projets open source avec ses modèles les plus puissants. Les rapports arrivent sans revue humaine préalable.

Popularité : 700
Anthropic ouvre les capacités cyber de Claude en trois niveaux
Entreprises et secteurs d’activité

Anthropic ouvre les capacités cyber de Claude en trois niveaux

Anthropic étend son programme de vérification et propose désormais trois niveaux d'accès aux capacités de cybersécurité de Claude, réservés aux professionnels vérifiés.

Popularité : 1,200