Anthropic a lancé Claude Haiku 5.5, qu'elle décrit comme « le modèle compact le moins cher, le plus rapide et le plus performant que nous ayons jamais publié ». En moyenne, il coûte environ 75 % de moins à exploiter que Claude Haiku 4.5. C'est le premier Haiku doté d'un réglage d'effort ajustable ; il offre une fenêtre de contexte de 1M de jetons (Haiku 4.5 : 200K) et est disponible dans l'API sous le nom claude-haiku-5-5. Les détails proviennent de la page de lancement.
Où il se place
Haiku 5.5 est conçu pour les travaux à fort volume et sensibles au coût : tâches répétitives comme les résumés et la classification, et rôle de sous-agent aux côtés de Claude Opus 5.5 et de Sonnet 5.5 en programmation. Anthropic le juge aussi assez rapide pour le support client en direct et l'utilisation du navigateur. Le réglage d'effort va de low à max, avec medium par défaut, et la réflexion adaptative est activée par défaut : chaque tâche peut ainsi être réglée pour le coût ou pour l'intelligence. La sortie maximale est de 128K jetons.
Benchmarks
Extrait de la page de lancement d'Anthropic.
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, sous-ensemble hors ligne | 72,4 % | 15,7 % | 48,9 % | 83,9 % |
| Humanity's Last Exam, sans outils | 45,9 % | 10,2 % | — | 56,9 % |
| Humanity's Last Exam, avec outils | 57,4 % | 18,7 % | — | 64,5 % |
| Terminal-Bench 4.0 | 39,2 % | 0,0 % | 16,4 % | 70,6 % |
| FrontierCode 1.1 (Main) | 46,4 % | — | 42,4 % | 52,1 % (Xhigh) |
| Chartography, sans outils | 46,4 % | 6,4 % | 29,1 % | 61,6 % |
Face à Haiku 4.5, les bonds sont considérables : OSWorld multiplié par 4,6 (72,4 % contre 15,7 %), Humanity's Last Exam sans outils par 4,5, Chartography par 7,3, et Terminal-Bench de 0,0 % à 39,2 %. Sur GDPval, Haiku 5.5 a 885 Elo d'avance (1620 contre 735).
GPT-6 Luna, qui affiche le même prix de 0,10 $ / 0,50 $, apparaît sur six lignes et Haiku 5.5 l'emporte sur les six : GDPval 1620 contre 1437, AA-Briefcase 1578 contre 1336, OSWorld 72,4 % contre 48,9 %, Terminal-Bench 39,2 % contre 16,4 %, FrontierCode 46,4 % contre 42,4 % et Chartography 46,4 % contre 29,1 %.
Sonnet 5.5, présenté à titre de référence, reste devant partout. Haiku 5.5 atteint environ 86 % de son score OSWorld (72,4 sur 83,9), 88 % sur GDPval, 87 % sur AA-Briefcase, 89 % sur FrontierCode (face à Sonnet à Xhigh) et 89 % sur Humanity's Last Exam avec outils. Les lignes les plus faibles sont Chartography (75 %) et Terminal-Bench (56 %).
Coût et performance selon le niveau d'effort
Graphique d'effort OSWorld 2.1, extrait de la page de lancement d'Anthropic.
Sur OSWorld, avec des valeurs lues approximativement sur l'axe logarithmique, Haiku 5.5 passe d'environ 42 % à l'effort low (environ 0,07 $ par tentative) à environ 53 % à medium, 61 % à high, 67,5 % à xhigh et 72,4 % à max (environ 0,6 $). Le point le moins cher de Sonnet 5.5 se situe à environ 58 % pour environ 0,7 $ ; Haiku 5.5 à l'effort high (environ 0,18 $) le dépasse donc déjà pour environ le quart du coût. Haiku 4.5 se situe près de 16 % pour environ 1,5 $ : Haiku 5.5 à max obtient donc un score 4,6 fois plus élevé pour environ 2,5 fois moins cher. Luna plafonne près de 49 % pour environ 0,2 $, un niveau que Haiku 5.5 franchit à l'effort medium pour environ 0,12 $.
Graphique d'effort GDPval-AA, extrait de la page de lancement d'Anthropic.
Sur GDPval-AA, Haiku 5.5 passe d'environ 1125 Elo pour environ 0,012 $ par tâche (low) à 1280 pour 0,03 $ (medium), 1420 pour 0,09 $ (high), 1515 pour 0,28 $ (xhigh) et 1620 pour environ 0,85 $ (max). Le meilleur point de Luna est d'environ 1437 pour environ 0,09 $, pratiquement à égalité avec Haiku 5.5 à l'effort high. Sonnet 5.5 atteint environ 1550 pour environ 0,6 $ et environ 1730 pour environ 1,9 $ : Haiku 5.5 à max bat donc le premier à un coût plus élevé et reste derrière le second. Haiku 4.5 obtient 735 pour environ 0,23 $, si bien que même le réglage low de Haiku 5.5 est supérieur d'environ 390 Elo pour un dix-neuvième du coût.
Tarifs
Extrait de la page de lancement d'Anthropic.
| Par million de jetons | Haiku 5.5 (jusqu'à 100k / au-delà de 100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Entrée | 0,10 $ / 0,50 $ | 1,00 $ | 2,00 $ |
| Sortie | 0,50 $ / 2,50 $ | 5,00 $ | 10,00 $ |
| Lectures de cache | 0,01 $ / 0,05 $ | 0,10 $ | 0,10 $ |
| Écritures de cache | 0,125 $ / 0,625 $ | 1,25 $ | 2,50 $ |
Par jeton, Haiku 5.5 est 10 fois moins cher que Haiku 4.5 sur l'entrée, la sortie, les lectures de cache et les écritures de cache, et 20 fois moins cher que Sonnet 5.5 sur l'entrée et la sortie (0,10 $ contre 2,00 $ et 0,50 $ contre 10,00 $). Les prompts de plus de 100K jetons coûtent 5 fois plus (0,50 $ / 2,50 $).
L'affirmation phare est plus modeste que la grille tarifaire : une baisse de 90 % par jeton, mais environ 75 % de coût en moins à l'usage en moyenne. Si les deux sont exacts, une tâche typique consomme environ 2,5 fois plus de jetons sur Haiku 5.5 que sur Haiku 4.5, ce qui correspondrait à davantage de réflexion par tâche à l'effort medium par défaut.
Contexte
Haiku 5.5 suit Sonnet 5.5 et Opus 5.5 dans la famille 5.5 et arrive comme le bas de l'échelle des prix (0,10 $ / 0,50 $, contre 2 $ / 10 $ et 4 $ / 20 $). Son concurrent le plus proche en prix est GPT-6 Luna, tandis que DeepSeek V4.1 Flash est un autre modèle bon marché couvert par ce blog.