Présentation de Claude Haiku 5.5 : le modèle compact le moins cher, le plus rapide et le plus performant que nous ayons jamais publié.
Claude Haiku 5.5 est conçu pour les tâches à volume élevé et sensibles aux coûts. Il gère de manière fiable les charges de travail rapides et répétitives (comme les résumés, les compactages, les requêtes de base de données et les demandes de classification). Il se marie bien avec Opus 5.5 et Sonnet 5.5 en tant que sous-agent sur des travaux de codage. Et, comme il s'agit également de notre modèle le plus rapide à ce jour, il est particulièrement adapté aux tâches sensibles à la vitesse comme le support client en direct et l'utilisation du navigateur.¹
Haiku 5.5 est disponible à un prix bien inférieur à celui de Haiku 4.5. En moyenne, son exécution coûte désormais environ 75 % moins cher.²
À l'occasion de ce lancement, nous apportons des améliorations à la valeur de notre gamme de modèles. Nous réduisons de moitié le prix des lectures de cache de Claude Sonnet 5.5, ce qui signifie que Sonnet 5.5 s'exécute désormais environ 20 % moins cher sur la plupart des travaux agentiques. Et nous introduisons un nouveau crédit API mensuel pour nos abonnés Claude Max et Team, conçu pour accompagner nos utilisateurs dans la création de nouveaux agents et applications qui fonctionnent sur la Claude Platform.
Performances
Voici comment Claude Haiku 5.5 se comporte sur une série de benchmarks :
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5Pour référence | |
|---|---|---|---|---|
| Travail cognitifGDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| Travail cognitifAA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| Utilisation de l'ordinateurOSWorld 2.1 | 72.4 %Sous-ensemble hors ligne | 15.7 %Sous-ensemble hors ligne | 48.9 %Sous-ensemble hors ligne | 83.9 %Sous-ensemble hors ligne |
| Raisonnement multidisciplinaireHumanity's Last Exam | 45.9 %sans outils | 10.2 %sans outils | — | 56.9 %sans outils |
| 57.4 %avec outils | 18.7 %avec outils | — | 64.5 %avec outils | |
| Codage agentiqueTerminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| Codage agentiqueFrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1 %Xhigh |
| Raisonnement visuelChartography | 46.4 %sans outils | 6,4 %sans outils | 29,1 %sans outils | 61,6 %sans outils |
Pour plus de détails sur la manière dont nous menons nos évaluations, consultez la Fiche système de Haiku 5.5.
Haiku 5.5 est notre premier modèle de classe Haiku à être doté d’un paramètre d’effort ajustable. Cela signifie que, comme pour nos autres modèles, les utilisateurs peuvent décider d’optimiser le coût ou l’intelligence. Les graphiques ci-dessous montrent les performances de Haiku 5.5 sur trois benchmarks à chaque niveau d’effort :
OSWorld 2.1 mesure la capacité des agents à utiliser un véritable ordinateur pour accomplir des tâches longues en plusieurs étapes.
Le GDPval-AA v2.1 d’Artificial Analysis évalue les agents sur un travail professionnel réel dans 44 professions.
Humanity’s Last Exam (HLE) est un test de connaissances académiques et de raisonnement de niveau expert.
Lors des premiers tests, nos clients ont rapporté des résultats cohérents avec les améliorations de performances et de coûts présentées ci-dessus. Voici ce qu’ils nous ont dit à propos du nouveau modèle :
CitationEntrepriseAsanaAuteurAaron Vinh, Ingénieur logiciel titulaire« Nous sommes très impressionnés par Claude Haiku 5.5, en particulier par sa vitesse. Nous l’avons soumis à notre suite d’évaluations pour AI Teammates, notre produit d’agents IA, couvrant des cas d’usage tels que le triage des bugs, la mise en place de projets et la recherche dans de grands portefeuilles pour faire remonter les travaux à haut risque ou en retard. Par rapport au modèle que nous utilisons aujourd’hui, nous avons constaté une réduction de latence de plus de 30 % pour l’accomplissement des tâches et une inférence jusqu’à 2,5x plus rapide par tour d’agent. C’est une expérience nettement plus réactive. »
Tarification
Le tableau ci-dessous montre comment la tarification de Claude Haiku 5.5 se compare à celle de nos autres modèles. Haiku 5.5 offre un excellent rapport qualité-prix pour les tâches avec des invites allant jusqu’à 100,000 tokens, qui représentent environ 90 % des requêtes adressées à notre précédent modèle Haiku.
| Prix par 1 million de tokens | Haiku 5.5 invites jusqu’à / au-delà de 100k | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Lectures de cache | $0.01 / $0.05 | $0.10 | $0.10 |
| Écritures de cache | $0.125 / $0.625 | $1.25 | $2.50 |
| Tokens d’entrée | $0.10 / $0.50 | $1.00 | $2.00 |
| Tokens de sortie | $0.50 / $2.50 | $5.00 | $10.00 |
Sécurité
Alignement. Claude Haiku 5.5 présente des améliorations majeures dans presque toutes nos évaluations d’alignement par rapport à Haiku 4.5. En particulier, nous avons constaté bien moins d’instances de comportement désaligné, et une moindre propension à coopérer avec un usage malveillant. La fiche système du modèle décrit notre processus d’évaluation et nos résultats plus en détail.
Mesures de protection. En cohérence avec ses capacités, les mesures de protection en cybersécurité de Haiku 5.5 sont plus restrictives que celles de Haiku 4.5, mais quelque peu moins restrictives que celles que nous avons appliquées à d'autres modèles récents. En cybersécurité, elles autorisent un éventail plus large de tâches défensives que nos mesures de protection pour Sonnet 5.5, mais elles bloquent toujours les tests d'intrusion et d'autres techniques plus susceptibles d'être utilisées par des attaquants.
Les mesures de protection en biologie de Haiku 5.5 sont identiques à celles de Sonnet 5, Sonnet 5.5 et Opus 5. Elles permettent les questions de biologie de recherche mais restreignent l'accès aux demandes que nous jugeons susceptibles de causer des dommages. Les organisations travaillant sur des activités de biologie et de cybersécurité plus étendues peuvent postuler à notre Life Sciences Verification Program et Cyber Verification Program.
Disponibilité
Claude Haiku 5.5 est dès à présent disponible sur toutes les plateformes, notamment Amazon Web Services, Google Cloud et Microsoft Azure. Sur la Claude Platform, les développeurs peuvent commencer avec claude-haiku-5-5.
Consultez notre guide de migration pour plus de détails.
Autres mises à jour
Parallèlement à notre nouvelle tarification pour Claude Haiku 5.5, nous apportons d’autres améliorations à la valeur de nos modèles et produits.
Premièrement, à partir d’aujourd’hui, nous baissions le prix des lectures de cache sur Claude Sonnet 5.5. Les lectures de cache coûtent désormais 50 % moins cher : 0,10 $ par million de tokens au lieu de 0,20 $. Comme les lectures de cache représentent une grande part de la consommation de tokens des modèles, cela réduit le coût de Sonnet 5.5 sur la plupart des tâches agentiques d’environ 20 %.
Par exemple, voici ce que signifie cette baisse de prix pour le rapport performance/coût de Sonnet 5.5 sur Terminal-Bench 4.0 :
Terminal-Bench 4.0 mesure la capacité d’un modèle à accomplir des tâches professionnelles complexes, en plusieurs étapes, dans une interface en ligne de commande.
Ce graphique illustre une différence importante entre Haiku 5.5 et nos modèles plus grands. Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches de codage agentique complexes comme celles mesurées par Terminal-Bench 4.0. En revanche, Haiku 5.5 est mieux adapté aux tâches au périmètre plus restreint qui auraient pu être prohibitives en coût avec les versions précédentes de Claude—comme la compaction, la synthèse ou le travail de sous-agents.
Deuxièmement, cette semaine, nous allons déployer un nouveau crédit API mensuel à tous les abonnés Max et Team, utilisable sur la Claude Platform. Les utilisateurs Max 5x recevront 100 $ de crédits par mois, les utilisateurs Max 20x recevront 200 $, et les abonnés Team recevront jusqu’à 500 $, mutualisés entre leurs utilisateurs. Ces crédits sont conçus pour permettre à nos utilisateurs d’expérimenter la création d’outils, d’applications et d’agents qui font appel à notre API. Ils peuvent être utilisés sur n’importe lequel de nos modèles. Pour plus d’informations, consultez notre article du Centre d’aide.
Pour les développeurs, nous mettons également à jour nos SDK Python et TypeScript de Claude pour ajouter la prise en charge de computer use et de browser use en version bêta. Haiku 5.5 est particulièrement bien adapté à ces tâches, compte tenu de sa combinaison de vitesse, de capacité et de prix. Vous pouvez en savoir plus dans notre documentation de la Claude Platform.
Notes de bas de page
1 Claude Haiku 5.5 est notre modèle le plus rapide à ce jour à la vitesse standard de chaque modèle, bien qu’il s’exécute moins vite que nos modèles Opus en Fast Mode.
2 Claude Haiku 5.5 est tarifé 90 % moins cher que Claude Haiku 4.5 pour les requêtes allant jusqu’à 100,000 tokens, et 50 % moins cher pour les requêtes dépassant 100,000 tokens. Sur Haiku 4.5, 90 % des requêtes relevaient de la première catégorie. Ce calcul tient également compte des changements entre Haiku 4.5 et Haiku 5.5 quant au nombre de tokens utilisés pour accomplir un travail donné : Haiku 5.5 dispose d’un tokenizer mis à jour (similaire à ceux de Sonnet 5.5 et d’Opus 5.5), ce qui signifie qu’il utilise légèrement plus de tokens par tâche.
