AnthropicAktualisiert

Wir stellen Claude Haiku 5.5 vor

Unser bisher schnellstes, günstigstes und leistungsfähigstes kleines Modell. Es wurde für hochvolumige, kostensensible Arbeiten entwickelt.

Bildquelle · Anthropic

Wir stellen Claude Haiku 5.5 vor: das günstigste, schnellste und leistungsfähigste kleine Modell, das wir je veröffentlicht haben.

Claude Haiku 5.5 wurde für hochvolumige, kostensensible Aufgaben entwickelt. Es bewältigt schnelle und repetitive Workloads zuverlässig (wie Zusammenfassungen, Kompaktierungen, Datenbankabfragen und Klassifizierungsanfragen). Es passt gut als Subagent bei Codierungsarbeiten mit Opus 5.5 und Sonnet 5.5 zusammen. Und da es auch unser bisher schnellstes Modell ist, eignet es sich besonders gut für geschwindigkeitssensible Aufgaben wie Live-Kundensupport und Browsernutzung.¹

Haiku 5.5 ist zu einem deutlich niedrigeren Preis als Haiku 4.5 verfügbar. Im Durchschnitt kostet der Betrieb nun rund 75 % weniger.²

Mit diesem Launch verbessern wir zusätzlich den Wert unserer Modellpalette. Wir halbieren den Preis der Cache-Lesevorgänge von Claude Sonnet 5.5, was bedeutet, dass Sonnet 5.5 bei den meisten agentischen Arbeiten nun rund 20 % günstiger läuft. Außerdem führen wir ein neues monatliches API-Guthaben für unsere Claude-Max- und Team-Abonnenten ein, das unsere Nutzer beim Bau neuer Agenten und Anwendungen unterstützen soll, die auf der Claude Platform laufen.

Leistung

So schneidet Claude Haiku 5.5 über eine Reihe von Benchmarks ab:

Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5Zur Referenz
WissensarbeitGDPval-AA v2.1162073514371840
WissensarbeitAA-Briefcase v1.1157861413361824
ComputernutzungOSWorld 2.172.4 %Offline-Teilmenge15.7 %Offline-Teilmenge48.9 %Offline-Teilmenge83.9 %Offline-Teilmenge
Multidisziplinäres DenkenHumanity’s Last Exam45.9 %ohne Tools10.2 %ohne Tools—56.9 %ohne Tools
57.4 %mit Tools18.7 %mit Tools—64.5 %mit Tools
Agentische CodierungTerminal-Bench 4.039.2%0.0%16.4%70.6%
Agentische CodierungFrontierCode 1.1 (Main)46.4%—42.4%52.1 %Xhigh
Visuelles DenkenChartography46.4 %ohne Tools6,4 %keine Tools29,1 %keine Tools61,6 %keine Tools

Details dazu, wie wir unsere Bewertungen durchführen, finden Sie in der Haiku 5.5 System Card.

Haiku 5.5 ist unser erstes Haiku-Klassenmodell mit einer einstellbaren Aufwandsstufe. Das bedeutet, dass Nutzer wie bei unseren anderen Modellen entscheiden können, ob sie Kosten oder Intelligenz optimieren möchten. Die folgenden Diagramme zeigen, wie Haiku 5.5 bei jeder Aufwandsstufe auf drei Benchmarks abschneidet:

OSWorld 2.1 (Offline-Teilmenge)Genauigkeit vs. Kosten

OSWorld 2.1 misst, wie gut Agenten einen echten Computer bedienen können, um lange, mehrstufige Aufgaben abzuschließen.

GDPval-AA v2.1Genauigkeit vs. Kosten

Artificial Analysis’ GDPval-AA v2.1 bewertet Agenten bei realer professioneller Arbeit in 44 Berufen.

Humanity’s Last Exam (keine Tools)Genauigkeit vs. Kosten

Humanity’s Last Exam (HLE) ist ein Test für Fachwissen und Denkleistungen auf Expertenniveau.

In frühen Tests berichteten unsere Kunden von Ergebnissen, die mit den oben gezeigten Leistungs- und Kostenverbesserungen übereinstimmen. Das haben sie uns über das neue Modell erzählt:

Zitat

„Wir sind von Claude Haiku 5.5 sehr beeindruckt, insbesondere von seiner Geschwindigkeit. Wir haben es durch unsere Eval-Suite für AI Teammates, unser KI-Agentenprodukt, laufen lassen, die Anwendungsfälle wie das Triagieren von Bugs, das Einrichten von Projekten und das Durchsuchen großer Portfolios zur Aufdeckung risikoreicher oder überfälliger Arbeiten abdeckt. Im Vergleich zum Modell, das wir heute nutzen, sahen wir eine Verringerung der Latenz bei Aufgabenabschlüssen um über 30 % und eine bis zu 2.5x schnellere Inferenz pro Agentenzug. Das Erlebnis ist spürbar flinker.“

UnternehmenAsanaAutorAaron Vinh, Staff Software Engineer

Preise

Die folgende Tabelle zeigt, wie sich die Preisgestaltung von Claude Haiku 5.5 im Vergleich zu unseren anderen Modellen verhält. Haiku 5.5 bietet besonders gutes Preis-Leistungs-Verhältnis bei Aufgaben mit Prompts bis zu 100,000 Token, die rund 90 % der Anfragen an unser vorheriges Haiku-Modell ausmachen.

Preis pro 1 Million TokenHaiku 5.5
Prompts bis zu / über 100k
Haiku 4.5Sonnet 5.5
Cache-Lesevorgänge$0.01 / $0.05$0.10$0.10
Cache-Schreibvorgänge$0.125 / $0.625$1.25$2.50
Eingabetoken$0.10 / $0.50$1.00$2.00
Ausgabetoken$0.50 / $2.50$5.00$10.00

Sicherheit

Ausrichtung. Claude Haiku 5.5 zeigt gegenüber Haiku 4.5 erhebliche Verbesserungen in fast allen unseren Ausrichtungsbewertungen. Insbesondere fanden wir deutlich weniger Fälle fehl Ausrichtungsverhaltens und eine geringere Bereitschaft zur Kooperation bei Missbrauch. Die System Card des Modells beschreibt unseren Bewertungsprozess und die Ergebnisse genauer.

Schutzmaßnahmen. Entsprechend seinen Fähigkeiten sind die Cybersicherheits-Schutzmaßnahmen von Haiku 5.5 restriktiver als die von Haiku 4.5, aber etwas weniger restriktiv als die, die wir bei anderen aktuellen Modellen angewendet haben. Im Bereich Cybersicherheit erlauben sie ein breiteres Spektrum an defensiven Aufgaben als unsere Schutzmaßnahmen für Sonnet 5.5, blockieren jedoch weiterhin Penetrationstests und andere Techniken, die eher von Angreifern verwendet werden.

Die Biologie-Schutzmaßnahmen von Haiku 5.5 sind dieselben wie bei Sonnet 5, Sonnet 5.5 und Opus 5. Sie erlauben Forschungsfragen zur Biologie, schränken aber den Zugang zu Anfragen ein, die nach unserer Einschätzung wahrscheinlich Schaden verursachen würden. Organisationen, die an umfassenderen Biologie- und Cyber-Aktivitäten arbeiten, können sich bewerben für unser Life Sciences Verification Program und Cyber Verification Program.

Verfügbarkeit

Claude Haiku 5.5 ist jetzt auf allen Plattformen verfügbar, darunter Amazon Web Services, Google Cloud und Microsoft Azure. Auf der Claude Platform können Entwickler loslegen mit claude-haiku-5-5.

Siehe unseren Migrationsleitfaden für Einzelheiten.

Weitere Updates

Neben unserer neuen Preisgestaltung für Claude Haiku 5.5 nehmen wir weitere Verbesserungen am Mehrwert unserer Modelle und Produkte vor.

Zunächst senken wir ab heute den Preis für Cache-Lesevorgänge bei Claude Sonnet 5.5. Cache-Lesevorgänge kosten jetzt 50% weniger: $0.10 pro Million Tokens statt $0.20. Da Cache-Lesevorgänge einen großen Teil des Token-Verbrauchs der Modelle ausmachen, reduziert dies die Kosten von Sonnet 5.5 bei den meisten agentischen Aufgaben um etwa 20%.

Hier ist zum Beispiel, was die Preissenkung für die Leistung von Sonnet 5.5 im Verhältnis zu den Kosten bei Terminal-Bench 4.0 bedeutet:

Terminal-Bench 4.0Genauigkeit vs. Kosten

Terminal-Bench 4.0 misst, wie gut ein Modell komplexe, mehrstufige professionelle Aufgaben innerhalb einer Befehlszeilenschnittstelle abschließen kann.

Dieses Diagramm veranschaulicht einen wichtigen Unterschied zwischen Haiku 5.5 und unseren größeren Modellen. Sonnet 5.5 und Opus 5.5 bleiben die bessere Wahl für komplexe agentische Codierungsaufgaben wie die von Terminal-Bench 4.0 gemessenen. Im Gegensatz dazu eignet sich Haiku 5.5 am besten für enger gefasste Aufgaben, die mit früheren Versionen von Claude möglicherweise zu kostenintensiv gewesen wären – wie Komprimierung, Zusammenfassung oder Subagenten-Arbeit.

Zweitens werden wir diese Woche ein neues monatliches API-Guthaben für alle Max- und Team-Abonnenten zur Nutzung auf der Claude Platform einführen. Max-5x-Nutzer erhalten $100 an Guthaben pro Monat, Max-20x-Nutzer erhalten $200, und Team-Abonnenten erhalten bis zu $500, gepoolt über ihre Nutzer. Diese Guthaben sollen unseren Nutzern ermöglichen, mit dem Bau von Tools, Apps und Agenten, die unsere API aufrufen, zu experimentieren. Sie können für alle unsere Modelle verwendet werden. Weitere Informationen finden Sie in unserem Help-Center-Artikel.

Für Entwickler aktualisieren wir außerdem unsere Claude Python- und TypeScript-SDKs, um Unterstützung für Computer Use und Browser Use in der Beta hinzuzufügen. Haiku 5.5 ist besonders gut für diese Aufgaben geeignet, angesichts seiner Kombination aus Geschwindigkeit, Leistungsfähigkeit und Preis. Mehr dazu können Sie in unseren Claude-Platform-Dokumenten lesen.

Fußnoten

1 Claude Haiku 5.5 ist unser schnellstes Modell bis heute bei der Standardgeschwindigkeit jedes Modells, wobei es im Fast Mode weniger schnell läuft als unsere Opus-Modelle.

2 Claude Haiku 5.5 ist 90% günstiger als Claude Haiku 4.5 für Anfragen bis 100,000 Tokens und 50% günstiger für Anfragen über 100,000 Tokens. Bei Haiku 4.5 fielen 90% der Anfragen in die erstere Kategorie. Diese Berechnung berücksichtigt auch Änderungen zwischen Haiku 4.5 und Haiku 5.5 darin, wie viele Tokens zur Erledigung einer bestimmten Arbeit verwendet werden: Haiku 5.5 hat einen aktualisierten Tokenizer (ähnlich dem von Sonnet 5.5 und Opus 5.5), was bedeutet, dass er etwas mehr Tokens pro Aufgabe verwendet.

Originalquelle

Anthropic

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten