AnthropicMis à jour le

Présentation de Claude Haiku 5.5

Notre modèle compact le plus rapide, le moins cher et le plus performant à ce jour. Il est conçu pour les charges de travail à volume élevé et sensibles aux coûts.

Source de l’image · Anthropic

Présentation de Claude Haiku 5.5 : le modèle compact le moins cher, le plus rapide et le plus performant que nous ayons jamais publié.

Claude Haiku 5.5 est conçu pour les tâches à volume élevé et sensibles aux coûts. Il gère de manière fiable les charges de travail rapides et répétitives (comme les résumés, les compactages, les requêtes de base de données et les demandes de classification). Il se marie bien avec Opus 5.5 et Sonnet 5.5 en tant que sous-agent sur des travaux de codage. Et, comme il s'agit également de notre modèle le plus rapide à ce jour, il est particulièrement adapté aux tâches sensibles à la vitesse comme le support client en direct et l'utilisation du navigateur.¹

Haiku 5.5 est disponible à un prix bien inférieur à celui de Haiku 4.5. En moyenne, son exécution coûte désormais environ 75 % moins cher.²

À l'occasion de ce lancement, nous apportons des améliorations à la valeur de notre gamme de modèles. Nous réduisons de moitié le prix des lectures de cache de Claude Sonnet 5.5, ce qui signifie que Sonnet 5.5 s'exécute désormais environ 20 % moins cher sur la plupart des travaux agentiques. Et nous introduisons un nouveau crédit API mensuel pour nos abonnés Claude Max et Team, conçu pour accompagner nos utilisateurs dans la création de nouveaux agents et applications qui fonctionnent sur la Claude Platform.

Performances

Voici comment Claude Haiku 5.5 se comporte sur une série de benchmarks :

Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5Pour référence
Travail cognitifGDPval-AA v2.1162073514371840
Travail cognitifAA-Briefcase v1.1157861413361824
Utilisation de l'ordinateurOSWorld 2.172.4 %Sous-ensemble hors ligne15.7 %Sous-ensemble hors ligne48.9 %Sous-ensemble hors ligne83.9 %Sous-ensemble hors ligne
Raisonnement multidisciplinaireHumanity's Last Exam45.9 %sans outils10.2 %sans outils—56.9 %sans outils
57.4 %avec outils18.7 %avec outils—64.5 %avec outils
Codage agentiqueTerminal-Bench 4.039.2%0.0%16.4%70.6%
Codage agentiqueFrontierCode 1.1 (Main)46.4%—42.4%52.1 %Xhigh
Raisonnement visuelChartography46.4 %sans outils6,4 %sans outils29,1 %sans outils61,6 %sans outils

Pour plus de détails sur la manière dont nous menons nos évaluations, consultez la Fiche système de Haiku 5.5.

Haiku 5.5 est notre premier modèle de classe Haiku à être doté d’un paramètre d’effort ajustable. Cela signifie que, comme pour nos autres modèles, les utilisateurs peuvent décider d’optimiser le coût ou l’intelligence. Les graphiques ci-dessous montrent les performances de Haiku 5.5 sur trois benchmarks à chaque niveau d’effort :

OSWorld 2.1 (sous-ensemble hors ligne)Précision vs. coût

OSWorld 2.1 mesure la capacité des agents à utiliser un véritable ordinateur pour accomplir des tâches longues en plusieurs étapes.

GDPval-AA v2.1Précision vs. coût

Le GDPval-AA v2.1 d’Artificial Analysis évalue les agents sur un travail professionnel réel dans 44 professions.

Humanity’s Last Exam (sans outils)Précision vs. coût

Humanity’s Last Exam (HLE) est un test de connaissances académiques et de raisonnement de niveau expert.

Lors des premiers tests, nos clients ont rapporté des résultats cohérents avec les améliorations de performances et de coûts présentées ci-dessus. Voici ce qu’ils nous ont dit à propos du nouveau modèle :

Citation

« Nous sommes très impressionnés par Claude Haiku 5.5, en particulier par sa vitesse. Nous l’avons soumis à notre suite d’évaluations pour AI Teammates, notre produit d’agents IA, couvrant des cas d’usage tels que le triage des bugs, la mise en place de projets et la recherche dans de grands portefeuilles pour faire remonter les travaux à haut risque ou en retard. Par rapport au modèle que nous utilisons aujourd’hui, nous avons constaté une réduction de latence de plus de 30 % pour l’accomplissement des tâches et une inférence jusqu’à 2,5x plus rapide par tour d’agent. C’est une expérience nettement plus réactive. »

EntrepriseAsanaAuteurAaron Vinh, Ingénieur logiciel titulaire

Tarification

Le tableau ci-dessous montre comment la tarification de Claude Haiku 5.5 se compare à celle de nos autres modèles. Haiku 5.5 offre un excellent rapport qualité-prix pour les tâches avec des invites allant jusqu’à 100,000 tokens, qui représentent environ 90 % des requêtes adressées à notre précédent modèle Haiku.

Prix par 1 million de tokensHaiku 5.5
invites jusqu’à / au-delà de 100k
Haiku 4.5Sonnet 5.5
Lectures de cache$0.01 / $0.05$0.10$0.10
Écritures de cache$0.125 / $0.625$1.25$2.50
Tokens d’entrée$0.10 / $0.50$1.00$2.00
Tokens de sortie$0.50 / $2.50$5.00$10.00

Sécurité

Alignement. Claude Haiku 5.5 présente des améliorations majeures dans presque toutes nos évaluations d’alignement par rapport à Haiku 4.5. En particulier, nous avons constaté bien moins d’instances de comportement désaligné, et une moindre propension à coopérer avec un usage malveillant. La fiche système du modèle décrit notre processus d’évaluation et nos résultats plus en détail.

Mesures de protection. En cohérence avec ses capacités, les mesures de protection en cybersécurité de Haiku 5.5 sont plus restrictives que celles de Haiku 4.5, mais quelque peu moins restrictives que celles que nous avons appliquées à d'autres modèles récents. En cybersécurité, elles autorisent un éventail plus large de tâches défensives que nos mesures de protection pour Sonnet 5.5, mais elles bloquent toujours les tests d'intrusion et d'autres techniques plus susceptibles d'être utilisées par des attaquants.

Les mesures de protection en biologie de Haiku 5.5 sont identiques à celles de Sonnet 5, Sonnet 5.5 et Opus 5. Elles permettent les questions de biologie de recherche mais restreignent l'accès aux demandes que nous jugeons susceptibles de causer des dommages. Les organisations travaillant sur des activités de biologie et de cybersécurité plus étendues peuvent postuler à notre Life Sciences Verification Program et Cyber Verification Program.

Disponibilité

Claude Haiku 5.5 est dès à présent disponible sur toutes les plateformes, notamment Amazon Web Services, Google Cloud et Microsoft Azure. Sur la Claude Platform, les développeurs peuvent commencer avec claude-haiku-5-5.

Consultez notre guide de migration pour plus de détails.

Autres mises à jour

Parallèlement à notre nouvelle tarification pour Claude Haiku 5.5, nous apportons d’autres améliorations à la valeur de nos modèles et produits.

Premièrement, à partir d’aujourd’hui, nous baissions le prix des lectures de cache sur Claude Sonnet 5.5. Les lectures de cache coûtent désormais 50 % moins cher : 0,10 $ par million de tokens au lieu de 0,20 $. Comme les lectures de cache représentent une grande part de la consommation de tokens des modèles, cela réduit le coût de Sonnet 5.5 sur la plupart des tâches agentiques d’environ 20 %.

Par exemple, voici ce que signifie cette baisse de prix pour le rapport performance/coût de Sonnet 5.5 sur Terminal-Bench 4.0 :

Terminal-Bench 4.0Précision vs. coût

Terminal-Bench 4.0 mesure la capacité d’un modèle à accomplir des tâches professionnelles complexes, en plusieurs étapes, dans une interface en ligne de commande.

Ce graphique illustre une différence importante entre Haiku 5.5 et nos modèles plus grands. Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches de codage agentique complexes comme celles mesurées par Terminal-Bench 4.0. En revanche, Haiku 5.5 est mieux adapté aux tâches au périmètre plus restreint qui auraient pu être prohibitives en coût avec les versions précédentes de Claude—comme la compaction, la synthèse ou le travail de sous-agents.

Deuxièmement, cette semaine, nous allons déployer un nouveau crédit API mensuel à tous les abonnés Max et Team, utilisable sur la Claude Platform. Les utilisateurs Max 5x recevront 100 $ de crédits par mois, les utilisateurs Max 20x recevront 200 $, et les abonnés Team recevront jusqu’à 500 $, mutualisés entre leurs utilisateurs. Ces crédits sont conçus pour permettre à nos utilisateurs d’expérimenter la création d’outils, d’applications et d’agents qui font appel à notre API. Ils peuvent être utilisés sur n’importe lequel de nos modèles. Pour plus d’informations, consultez notre article du Centre d’aide.

Pour les développeurs, nous mettons également à jour nos SDK Python et TypeScript de Claude pour ajouter la prise en charge de computer use et de browser use en version bêta. Haiku 5.5 est particulièrement bien adapté à ces tâches, compte tenu de sa combinaison de vitesse, de capacité et de prix. Vous pouvez en savoir plus dans notre documentation de la Claude Platform.

Notes de bas de page

1 Claude Haiku 5.5 est notre modèle le plus rapide à ce jour à la vitesse standard de chaque modèle, bien qu’il s’exécute moins vite que nos modèles Opus en Fast Mode.

2 Claude Haiku 5.5 est tarifé 90 % moins cher que Claude Haiku 4.5 pour les requêtes allant jusqu’à 100,000 tokens, et 50 % moins cher pour les requêtes dépassant 100,000 tokens. Sur Haiku 4.5, 90 % des requêtes relevaient de la première catégorie. Ce calcul tient également compte des changements entre Haiku 4.5 et Haiku 5.5 quant au nombre de tokens utilisés pour accomplir un travail donné : Haiku 5.5 dispose d’un tokenizer mis à jour (similaire à ceux de Sonnet 5.5 et d’Opus 5.5), ce qui signifie qu’il utilise légèrement plus de tokens par tâche.

Source originale

Anthropic

À propos du contenu

La publication originale et les droits appartiennent à la source.

Traduction automatique · Consultez l’original