MarkTechPostAktualisiert

Anthropic veröffentlicht Claude Haiku 5.5: Ein kleines Modell mit 1M Kontext zum Preis von $0.10 pro Million Eingabe-Tokens

Anthropic's Claude Haiku 5.5 startet bei $0.10 pro Million Eingabe-Tokens, behält 1M Kontext und erreicht 72.4% bei OSWorld. Der Beitrag Anthropic veröffentlicht Claude Haiku 5.5: Ein kleines Modell mit 1M Kontext zum…

Anthropic hat Claude Haiku 5.5veröffentlicht, sein bisher günstigstes und schnellstes kleines Modell. Es zielt auf hochvolumige Arbeiten wie Zusammenfassungen, Kompaktierung, Klassifizierung und Subagent-Aufgaben ab. Es behält ein 1M Token Kontextfenster und bis zu 128K Output-Tokens. Die Preise beginnen bei $0.10 pro Million Eingabe-Tokens und $0.50 pro Million Ausgabe-Tokens. Das liegt 90% unter Claude Haiku 4.5 für Prompts bis 100K Tokens.

Ist es einsetzbar? Ja, als gehostete API. Haiku 5.5 ist allgemein verfügbar über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS.

Was Anthropic ausgeliefert hat

Haiku 5.5 ist das erste Modell der Haiku-Klasse mit einer einstellbaren Effort-Einstellung. Adaptive thinking ist standardmäßig aktiviert, und der effort parameter steht standardmäßig auf medium.

Es nimmt Text und Bilder entgegen, gibt Text aus und hat einen Wissensstand von Juni 2026. Batch-Jobs unterstützen bis zu 300K Ausgabe-Tokens in der Beta.

Es ist wichtig, zwei zentrale Punkte zu beachten. Nicht voreingestellte temperature, top_p oder top_k -Werte geben einen 400-Fehler zurück. Der neue Tokenizer zählt denselben Text auch mit etwa 30% mehr Tokens als Haiku 4.5. Der Migrationsleitfaden behandelt beides.

Preise: Eine 2-stufige Struktur

Die Preise teilen sich bei 100K Prompt-Tokens. Bis 100K kostet die Eingabe $0.10 und die Ausgabe $0.50 pro Million. Cache-Lesezugriffe kosten $0.01 und 5-minütige Cache-Schreibzugriffe $0.125. Über 100K steigen die Sätze auf $0.50 Eingabe und $2.50 Ausgabe.

Haiku 4.5 kostete $1 Eingabe und $5 Ausgabe. Laut Anthropic blieben etwa 90% der Haiku 4.5-Anfragen unter 100K Tokens. Nach Anpassung an den Tokenizer schätzt Anthropic, dass Haiku 5.5 im Durchschnitt etwa 75% günstiger läuft. Batch-Verarbeitung senkt die Kosten um weitere 50%.

GPT-6 Luna listet identische Sätze für kurze Kontexte. Seine höhere Stufe beginnt erst über 272K Eingabe-Tokens, bei $0.20 und $0.75. Für einen 150K-Token-Prompt ist Luna beim Listenpreis günstiger.

Benchmarks

Alle folgenden Zahlen sind von Anthropic berichtet (siehe die System Card):

  • OSWorld 2.1 (Offline-Subset): 72,4 %, gegenüber 48,9 % für GPT-6 Luna und 15,7 % für Haiku 4.5.
  • Terminal-Bench 4.0: 39,2 %, gegenüber 16,4 % für Luna und 0,0 % für Haiku 4.5.
  • FrontierCode 1.1 (Main): 46,4 %, gegenüber 42,4 % für Luna.
  • Humanity’s Last Exam: 45,9 % ohne Werkzeuge und 57,4 % mit Werkzeugen.
  • GDPval-AA v2.1: 1620, gegenüber 1437 für Luna und 735 für Haiku 4.5.

Sonnet 5.5 führt weiterhin in jeder Zeile, einschließlich 70,6 % auf Terminal-Bench 4.0. Anthropic selbst empfiehlt Sonnet 5.5 und Opus 5.5 für komplexes agentisches Coding.

Beste Anwendungsfälle

Drei Workloads passen am besten zu Haiku 5.5:

  • Der erste ist Subagent-Arbeit unter Opus 5.5 oder Sonnet 5.5. Bei Rogo zieht ein Haiku-5.5-Subagent eine 10-K-Umsatzzeile, während ein größeres Modell das Deck erstellt.
  • Der zweite ist Dokumenten-Q&A und Zusammenfassung im hohen Volumen. AlphaSense hat es an einem Feature getestet, das etwa 8M Aufrufe pro Woche verarbeitet.
  • Der dritte ist geschwindigkeitssensible Arbeit wie Live-Kundensupport und Browser-Nutzung.

Haiku 5.5 im Vergleich zu seinen nächsten Konkurrenten

MerkmalClaude Haiku 5.5GPT-6 LunaGemini 3.5 Flash-Lite
Eingabe / Ausgabe (pro 1M)$0.10 / $0.50$0.10 / $0.50$0.30 / $2.50
Preise für lange Prompts$0.50 / $2.50 über 100K$0.20 / $0.75 über 272KPauschaltarif
Cache-Lesen (pro 1M)$0.01$0.01$0.03 + Speicher
Kontextfenster1M Token1,050,000 Token1,048,576 Token
Maximale Ausgabe128K Token128,000 Token65,536 Token
EingabenText, BilderText, BilderText, Bild, Video, Audio, PDF
Steuerung des ReasoningsAdaptives Denken + Aufwand (Standard: mittel)reasoning.effort none bis max (Standard: mittel)Denken unterstützt
ComputernutzungSDK-Unterstützung in der BetaUnterstützt (Responses API)Unterstützt (Vorschau)
Batch-Rabatt50%50% (Batch und Flex)50%
WissensstandJuni 202618. Mai 2026Nicht auf der Modellseite aufgeführt
Wo ausführenClaude API, Bedrock, Google Cloud, Microsoft Foundry, Claude Platform auf AWSOpenAI APIGemini API

Quellen: Anthropic-Dokumentation, Anthropic-Ankündigung, OpenAI-Modellseite, OpenAI-Preise, Google-Modellseite, Google-Preise. Listenpreise der Standardstufe, überprüft am 7. Oktober 2026.

Interaktiver Explainer

Kernerkenntnisse

  • $0.10 Eingabe und $0.50 Ausgabe pro 1M Tokens für Prompts bis 100K Tokens.
  • 1M Kontext, 128K Ausgabe, adaptives Denken mit einer Effort-Einstellung (Standard medium).
  • 72.4% bei OSWorld 2.1 gegenüber 15.7% bei Haiku 4.5 (von Anthropic berichtet).
  • Gleicher Listenpreis im kurzen Kontext wie GPT-6 Luna; Luna ist über 100K Tokens hinaus günstiger.
  • Positioniert als Subagent unter Opus 5.5 und Sonnet 5.5, nicht als Coding-Lead.


Schauen Sie sich die Technical Details an. Alle Credits gehen an die Forscherin/den Forscher dieses Projekts. Folgen Sie uns außerdem gerne auf Twitter und vergessen Sie nicht, unserem 150k+ML SubReddit beizutreten und unseren Newsletter zu abonnieren. Moment! Sind Sie auf Telegram? jetzt können Sie uns auch auf Telegram beitreten.

[Gesponsert] Das Web ist die eine API, die den meisten Agents fehlt. Datenbanken, Kalender und Repositories haben APIs. Das offene Web meistens nicht. Der TinyFish MCP server stellt jedem MCP-Client vier Tools bereit: TinySearch, TinyFetch (vollständige Seiten als Markdown, inklusive JavaScript), TinyBrowser für Logins und Formulare sowie TinyAgent für mehrstufige Aufgaben. Search und Fetch sind kostenlos.

Der Beitrag Anthropic veröffentlicht Claude Haiku 5.5: Ein kleines Modell mit 1M Kontext zum Preis von $0.10 pro Million Input-Token erschien zuerst auf MarkTechPost.

Originalquelle

MarkTechPost

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten