Mit Claude Haiku 5.5 hat Anthropic am 7. Oktober das letzte Modell der Claude-5.5-Familie nachgereicht. Nach Opus 5.5 und Sonnet 5.5 zielt das kleinste Modell auf Entwickler und Unternehmen, die große Mengen einfacher Anfragen günstig verarbeiten wollen. Die Schlagzeile ist der Preis: Für übliche Anfragen verlangt Anthropic nur noch ein Zehntel dessen, was Haiku 4.5 gekostet hat.
Was kostet Claude Haiku 5.5?
Neu ist eine zweistufige Preisstaffel. Entscheidend ist, wie lang die Eingabe (der Prompt) ist: bis 100.000 Token gilt der niedrige Tarif, darüber der höhere.
| Pro 1 Mio. Token | Haiku 5.5 (≤ 100.000 Token) | Haiku 5.5 (> 100.000 Token) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Input | 0,10 $ | 0,50 $ | 1,00 $ | 2,00 $ |
| Output | 0,50 $ | 2,50 $ | 5,00 $ | 10,00 $ |
| Cache-Lesen | 0,01 $ | 0,05 $ | 0,10 $ | 0,10 $ |
| Cache-Schreiben | 0,125 $ | 0,625 $ | 1,25 $ | 2,50 $ |
Gegenüber Haiku 4.5 sinkt der Listenpreis damit um 90 Prozent bei kurzen und um 50 Prozent bei langen Prompts. Im Mittel soll der Betrieb laut Anthropic rund 75 Prozent günstiger sein. Nebenbei hat der Hersteller auch bei Sonnet 5.5 den Preis für Cache-Lesezugriffe halbiert, von 0,20 auf 0,10 $.
Euro-Preise nennt Anthropic für die API nicht; abgerechnet wird in US-Dollar. Einen Haken sollten Sie bei der Kalkulation kennen: Laut heise zerlegt der neue Tokenizer denselben Text in etwa 30 Prozent mehr Token als bei Haiku 4.5. Die tatsächliche Ersparnis fällt deshalb etwas kleiner aus, als der reine Listenpreis vermuten lässt.
Mehr Kontext, längere Antworten
Auch technisch legt das Modell zu. Das Kontextfenster wächst von 200.000 auf 1 Million Token, die maximale Antwortlänge verdoppelt sich von 64.000 auf 128.000 Token. Haiku 5.5 versteht Text und Bilder, antwortet aber ausschließlich in Textform. Der Wissensstand reicht bis Juni 2026.
Erstmals in der Haiku-Reihe gibt es die Effort-Einstellung. Damit legen Sie fest, wie viel das Modell „nachdenkt“, in fünf Stufen von Low über Med, High und Xhigh bis Max. Wer möglichst billig und schnell antworten will, wählt eine niedrige Stufe; für schwierigere Aufgaben gibt es mehr Rechenaufwand gegen höhere Token-Kosten.
Wofür das Modell gedacht ist
Anthropic positioniert Haiku 5.5 als Arbeitstier für Routineaufgaben: Zusammenfassungen, das Verdichten großer Datenmengen, Datenbankabfragen und Klassifizierung. Dazu kommen Einsätze als Hilfsagent (Subagent), der für ein größeres Modell Teilaufgaben erledigt, sowie Live-Kundensupport und Browser-Automatisierung. Für Letzteres hat Anthropic die SDKs für Python und TypeScript um Werkzeuge zur Computer- und Browsersteuerung erweitert, vorerst als Beta.
Benchmarks: großer Sprung gegenüber Haiku 4.5
Die folgenden Werte stammen von Anthropic selbst.

Am deutlichsten wird der Fortschritt bei der Computersteuerung: Im OSWorld-Benchmark steigt der Wert von 15,7 auf 72,4 Prozent. Beim agentischen Programmieren (Terminal-Bench 4.0) löste Haiku 4.5 keine einzige Aufgabe, Haiku 5.5 kommt auf 39,2 Prozent. In fast allen gezeigten Disziplinen liegt das Modell zudem vor OpenAIs Kleinmodell GPT-6 Luna, bleibt aber klar hinter dem teureren Sonnet 5.5.
Unabhängige Messungen zeichnen ein ähnliches, aber nüchterneres Bild. Artificial Analysis kommt laut heise im Terminal-Bench auf 33 Prozent und im eigenen Intelligence Index auf 43 Punkte, 26 mehr als Haiku 4.5. Allerdings verbraucht das Modell auf höchster Stufe demnach rund 162.000 Ausgabetoken pro Aufgabe – ein Grund mehr, die Effort-Stufe bewusst zu wählen.
Verfügbarkeit und Sicherheit
Haiku 5.5 steht ab sofort über die Claude Platform sowie bei Amazon Web Services, Google Cloud und Microsoft Azure bereit. Entwickler nutzen die Modell-ID claude-haiku-5-5. Abonnenten der Max-Tarife erhalten zusätzlich monatliches API-Guthaben: 100 $ bei Max 5x, 200 $ bei Max 20x, Team-Kunden bis zu 500 $ für das gesamte Team.
Bei IT-Sicherheit greift Anthropic strenger durch als bei Haiku 4.5: Defensive Aufgaben sind erlaubt, Anfragen zu Penetrationstests blockiert das Modell. Wer solche Aufgaben beruflich erledigt, kann sich über das Cyber Verification Program freischalten lassen.
Was bedeutet das für Unternehmen in Deutschland?
Für Firmen, die große Mengen Tickets, Dokumente oder E-Mails automatisch auswerten, kann sich ein Wechsel spürbar auf die Rechnung auswirken. Ob es so viel ist, wie die Listenpreise versprechen, hängt vom eigenen Workload ab: längere Prompts, der neue Tokenizer und hohe Effort-Stufen fressen einen Teil der Ersparnis. Prüfen Sie daher mit echten Beispielanfragen, bevor Sie umstellen. Für Daten mit DSGVO-Bezug bleibt außerdem wichtig, über welchen Cloud-Anbieter und in welcher Region Sie das Modell nutzen.
Häufige Fragen
Was kostet Claude Haiku 5.5?
Bei Prompts bis 100.000 Token 0,10 $ pro Million Input-Token und 0,50 $ pro Million Output-Token. Bei längeren Prompts sind es 0,50 $ beziehungsweise 2,50 $.
Wie groß ist das Kontextfenster?
1 Million Token, fünfmal so viel wie bei Haiku 4.5. Die Ausgabe ist auf 128.000 Token begrenzt.
Ist Haiku 5.5 besser als Sonnet 5.5?
Nein. In allen von Anthropic veröffentlichten Benchmarks liegt Sonnet 5.5 vorn. Haiku 5.5 ist dafür um ein Vielfaches günstiger und für einfachere Massenaufgaben gedacht.











