2026-10-07

Anthropic lance Claude Haiku 5.5, son petit modèle le moins cher et le plus rapide, à 0,10 $ / 0,50 $ par million de jetons, environ 75 % moins cher à exploiter que Haiku 4.5

AIModels🌍 North America

Anthropic a lancé Claude Haiku 5.5, qu'elle décrit comme « le modèle compact le moins cher, le plus rapide et le plus performant que nous ayons jamais publié ». En moyenne, il coûte environ 75 % de moins à exploiter que Claude Haiku 4.5. C'est le premier Haiku doté d'un réglage d'effort ajustable ; il offre une fenêtre de contexte de 1M de jetons (Haiku 4.5 : 200K) et est disponible dans l'API sous le nom claude-haiku-5-5. Les détails proviennent de la page de lancement.

Où il se place

Haiku 5.5 est conçu pour les travaux à fort volume et sensibles au coût : tâches répétitives comme les résumés et la classification, et rôle de sous-agent aux côtés de Claude Opus 5.5 et de Sonnet 5.5 en programmation. Anthropic le juge aussi assez rapide pour le support client en direct et l'utilisation du navigateur. Le réglage d'effort va de low à max, avec medium par défaut, et la réflexion adaptative est activée par défaut : chaque tâche peut ainsi être réglée pour le coût ou pour l'intelligence. La sortie maximale est de 128K jetons.

Benchmarks

Tableau de benchmarks comparant Claude Haiku 5.5, Haiku 4.5, GPT-6 Luna et Sonnet 5.5 sur huit évaluations couvrant le travail de bureau, l'utilisation d'ordinateur, le raisonnement, la programmation et le raisonnement visuel. Extrait de la page de lancement d'Anthropic.

BenchmarkHaiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
GDPval-AA v2.1 (Elo)162073514371840
AA-Briefcase v1.1 (Elo)157861413361824
OSWorld 2.1, sous-ensemble hors ligne72,4 %15,7 %48,9 %83,9 %
Humanity's Last Exam, sans outils45,9 %10,2 %—56,9 %
Humanity's Last Exam, avec outils57,4 %18,7 %—64,5 %
Terminal-Bench 4.039,2 %0,0 %16,4 %70,6 %
FrontierCode 1.1 (Main)46,4 %—42,4 %52,1 % (Xhigh)
Chartography, sans outils46,4 %6,4 %29,1 %61,6 %

Face à Haiku 4.5, les bonds sont considérables : OSWorld multiplié par 4,6 (72,4 % contre 15,7 %), Humanity's Last Exam sans outils par 4,5, Chartography par 7,3, et Terminal-Bench de 0,0 % à 39,2 %. Sur GDPval, Haiku 5.5 a 885 Elo d'avance (1620 contre 735).

GPT-6 Luna, qui affiche le même prix de 0,10 $ / 0,50 $, apparaît sur six lignes et Haiku 5.5 l'emporte sur les six : GDPval 1620 contre 1437, AA-Briefcase 1578 contre 1336, OSWorld 72,4 % contre 48,9 %, Terminal-Bench 39,2 % contre 16,4 %, FrontierCode 46,4 % contre 42,4 % et Chartography 46,4 % contre 29,1 %.

Sonnet 5.5, présenté à titre de référence, reste devant partout. Haiku 5.5 atteint environ 86 % de son score OSWorld (72,4 sur 83,9), 88 % sur GDPval, 87 % sur AA-Briefcase, 89 % sur FrontierCode (face à Sonnet à Xhigh) et 89 % sur Humanity's Last Exam avec outils. Les lignes les plus faibles sont Chartography (75 %) et Terminal-Bench (56 %).

Coût et performance selon le niveau d'effort

Score OSWorld 2.1 en fonction du coût par tentative, sur une échelle logarithmique, par niveau d'effort. Haiku 5.5 va d'environ 42 % à l'effort low à 72 % à max ; Sonnet 5.5 démarre près de 58 % ; Haiku 4.5 se situe près de 16 %. Graphique d'effort OSWorld 2.1, extrait de la page de lancement d'Anthropic.

Sur OSWorld, avec des valeurs lues approximativement sur l'axe logarithmique, Haiku 5.5 passe d'environ 42 % à l'effort low (environ 0,07 $ par tentative) à environ 53 % à medium, 61 % à high, 67,5 % à xhigh et 72,4 % à max (environ 0,6 $). Le point le moins cher de Sonnet 5.5 se situe à environ 58 % pour environ 0,7 $ ; Haiku 5.5 à l'effort high (environ 0,18 $) le dépasse donc déjà pour environ le quart du coût. Haiku 4.5 se situe près de 16 % pour environ 1,5 $ : Haiku 5.5 à max obtient donc un score 4,6 fois plus élevé pour environ 2,5 fois moins cher. Luna plafonne près de 49 % pour environ 0,2 $, un niveau que Haiku 5.5 franchit à l'effort medium pour environ 0,12 $.

Elo GDPval-AA en fonction du coût par tâche, sur une échelle logarithmique, par niveau d'effort. Haiku 5.5 va d'environ 1125 à l'effort low à 1620 à max, pour moins d'un dollar par tâche ; Haiku 4.5 se situe bien en dessous. Graphique d'effort GDPval-AA, extrait de la page de lancement d'Anthropic.

Sur GDPval-AA, Haiku 5.5 passe d'environ 1125 Elo pour environ 0,012 $ par tâche (low) à 1280 pour 0,03 $ (medium), 1420 pour 0,09 $ (high), 1515 pour 0,28 $ (xhigh) et 1620 pour environ 0,85 $ (max). Le meilleur point de Luna est d'environ 1437 pour environ 0,09 $, pratiquement à égalité avec Haiku 5.5 à l'effort high. Sonnet 5.5 atteint environ 1550 pour environ 0,6 $ et environ 1730 pour environ 1,9 $ : Haiku 5.5 à max bat donc le premier à un coût plus élevé et reste derrière le second. Haiku 4.5 obtient 735 pour environ 0,23 $, si bien que même le réglage low de Haiku 5.5 est supérieur d'environ 390 Elo pour un dix-neuvième du coût.

Tarifs

Tableau des tarifs par million de jetons pour Claude Haiku 5.5, Haiku 4.5 et Sonnet 5.5, avec Haiku 5.5 indiqué pour les prompts jusqu'à 100k jetons et au-delà. Extrait de la page de lancement d'Anthropic.

Par million de jetonsHaiku 5.5 (jusqu'à 100k / au-delà de 100k)Haiku 4.5Sonnet 5.5
Entrée0,10 $ / 0,50 $1,00 $2,00 $
Sortie0,50 $ / 2,50 $5,00 $10,00 $
Lectures de cache0,01 $ / 0,05 $0,10 $0,10 $
Écritures de cache0,125 $ / 0,625 $1,25 $2,50 $

Par jeton, Haiku 5.5 est 10 fois moins cher que Haiku 4.5 sur l'entrée, la sortie, les lectures de cache et les écritures de cache, et 20 fois moins cher que Sonnet 5.5 sur l'entrée et la sortie (0,10 $ contre 2,00 $ et 0,50 $ contre 10,00 $). Les prompts de plus de 100K jetons coûtent 5 fois plus (0,50 $ / 2,50 $).

L'affirmation phare est plus modeste que la grille tarifaire : une baisse de 90 % par jeton, mais environ 75 % de coût en moins à l'usage en moyenne. Si les deux sont exacts, une tâche typique consomme environ 2,5 fois plus de jetons sur Haiku 5.5 que sur Haiku 4.5, ce qui correspondrait à davantage de réflexion par tâche à l'effort medium par défaut.

Contexte

Haiku 5.5 suit Sonnet 5.5 et Opus 5.5 dans la famille 5.5 et arrive comme le bas de l'échelle des prix (0,10 $ / 0,50 $, contre 2 $ / 10 $ et 4 $ / 20 $). Son concurrent le plus proche en prix est GPT-6 Luna, tandis que DeepSeek V4.1 Flash est un autre modèle bon marché couvert par ce blog.

À lire ensuite