Anthropic hat am 7. Oktober 2026 Claude Haiku 5.5 veröffentlicht und damit die 5.5-Generation nach Opus 5.5 und Sonnet 5.5 vervollständigt. Das kleinste Claude-Modell kostet ab 0,10 US-Dollar je 1 Million Input-Token und liegt damit exakt auf dem Listenpreis von GPT-6 Luna. Gegenüber Haiku 4.5 soll eine Aufgabe im Schnitt rund 75 Prozent weniger kosten.
Kurzfassung
- Anthropic hat Claude Haiku 5.5 veröffentlicht, ein kleines Modell für Klassifikation, Extraktion und Routing mit 1 Million Token Kontextfenster.
- Haiku 5.5 kostet bis 100.000 Token je Anfrage 0,10 US-Dollar Input und 0,50 US-Dollar Output je 1 Million Token (Stand: Oktober 2026).
- Das betrifft jede Automatisierung mit hohem Anfragevolumen, die bislang auf Haiku 4.5 oder GPT-6 Luna läuft.
Claude Haiku 5.5: Preise und Preisstufe
Claude Haiku 5.5 läuft in der API unter der Modell-ID claude-haiku-5-5, auf Amazon Bedrock als anthropic.claude-haiku-5-5. Das Kontextfenster (die maximal verarbeitbare Textmenge je Anfrage) wächst von 200.000 Token bei Haiku 4.5 auf 1 Million Token, die maximale Ausgabe liegt bei 128.000 Token. Verfügbar ist das Modell laut Modellübersicht über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS.
Neu ist die Preisstufe. Anfragen mit bis zu 100.000 Token kosten ein Fünftel dessen, was längere Anfragen kosten. Stand: Oktober 2026 gelten folgende Listenpreise in US-Dollar je 1 Million Token:
| Preisposition | Haiku 5.5 (bis 100.000 Token) | Haiku 5.5 (über 100.000 Token) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Input | 0,10 USD | 0,50 USD | 1 USD | 2 USD |
| Output | 0,50 USD | 2,50 USD | 5 USD | 10 USD |
| Cache-Reads | 0,01 USD | 0,05 USD | 0,10 USD | 0,10 USD |
| Cache-Writes (5 Minuten) | 0,125 USD | 0,625 USD | 1,25 USD | 2,50 USD |
Gegenüber Haiku 4.5 liegt der Listenpreis laut Anthropic bei Anfragen bis 100.000 Token 90 Prozent niedriger, bei längeren 50 Prozent. Im Betrieb soll Haiku 5.5 im Schnitt rund 75 Prozent weniger kosten. Ein Teil der Differenz geht auf den neuen Tokenizer zurück, also das Verfahren, das Text in Token zerlegt: Derselbe Text ergibt laut Migrationsleitfaden etwa 30 Prozent mehr Token als bei Haiku 4.5. Am selben Tag hat Anthropic die Cache-Reads (Lesezugriffe auf zwischengespeicherte Prompts) bei Sonnet 5.5 von 0,20 auf 0,10 US-Dollar halbiert.
Ein gerechnetes Beispiel, keine Messung aus einem Kundenprojekt: 10.000 Eingangsrechnungen mit je 3.000 Input-Token und 500 Output-Token kosten mit Haiku 5.5 5,50 US-Dollar. Bei Haiku 4.5 ergibt derselbe Text knapp ein Viertel weniger Token und kostet rund 42 US-Dollar. Nicht enthalten sind Denk-Token, die als Output abgerechnet werden und je nach Einstellung den Betrag erhöhen.
Benchmarks gegen Haiku 4.5 und GPT-6 Luna
Die folgenden Werte stammen aus Anthropics eigenen Release-Angaben. Es sind Messungen des Herstellers, keine unabhängige Prüfung. Alle Werte in Prozent, außer GDPval-AA (Elo-Punkte).
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 (Wissensarbeit, Elo) | 1620 | 735 | 1437 | 1840 |
| OSWorld 2.1 (Computerbedienung) | 72,4 | 15,7 | 48,9 | 83,9 |
| Humanity’s Last Exam (mit Tools) | 57,4 | 18,7 | nicht angegeben | 64,5 |
| Terminal-Bench 4.0 (Coding im Terminal) | 39,2 | 0,0 | 16,4 | 70,6 |
| FrontierCode 1.1 | 46,4 | nicht angegeben | 42,4 | 52,1 |
| Chartography (Diagramme lesen) | 46,4 | 6,4 | 29,1 | 61,6 |
Gegenüber Haiku 4.5 fällt der Sprung überall groß aus, wo Anthropic einen Vergleichswert nennt, bei der Computerbedienung von knapp 16 auf gut 72 Prozent. GPT-6 Luna, das zum identischen Basispreis angeboten wird, liegt in allen Vergleichen mit Luna-Wert dahinter. Beim Coding im Terminal bleibt der Abstand zu Sonnet 5.5 dagegen groß. Für komplexe Programmieraufgaben mit KI-Agenten bleiben Sonnet 5.5 und Opus 5.5 laut Anthropic die bessere Wahl.
Erste Kundenstimmen nennt Anthropic in der Ankündigung. Box habe in frühen Tests elf Punkte mehr als mit Haiku 4.5 gemessen, bei etwa halber Antwortzeit. Asana berichtet von über 30 Prozent weniger Latenz bei Aufgaben gegenüber dem bisher genutzten Modell. Beide Angaben sind Herstellerangaben ohne unabhängige Prüfung.
Haiku, Sonnet oder Opus
Andre Loreth teilt die drei Modelle der 5.5-Generation nach Aufgabe auf. Haiku 5.5 übernimmt große Mengen gleichförmiger Aufgaben: Belege nach Art sortieren, Felder aus Rechnungen ziehen, E-Mails dem richtigen Postfach zuweisen. Claude Sonnet 5.5 bleibt nach seiner Einschätzung das Modell für Abläufe mit mehr Urteilsvermögen, etwa die Antwort auf eine Kundenanfrage. Claude Opus 5.5 bleibt für die wenigen Schritte, bei denen ein Fehler teuer wird.
Anthropic beschreibt Haiku 5.5 ausdrücklich auch als Hilfsmodell für größere Modelle. Ein Ablauf kann damit in Stufen zerlegt werden: Haiku 5.5 sortiert vor und extrahiert, Sonnet 5.5 oder Opus 5.5 prüfen nur die Fälle, die Haiku als unsicher markiert. Welche Aufteilung trägt, zeigt erst ein Test mit echten Dokumenten aus dem eigenen Betrieb. Den Vergleich über alle Anbieter hinweg, samt Preis- und Hosting-Pfaden, enthält der LLM-Vergleich.
Zu beachten ist die Preisstufe bei 100.000 Token. Ein langer Vertrag oder ein umfangreicher Prüfbericht in einer einzigen Anfrage kostet das Fünffache des Basispreises, bleibt aber deutlich günstiger als mit Sonnet 5.5. Die Preisgleichheit mit GPT-6 Luna gilt nur unterhalb dieser Stufe. Was Luna seit September 2026 bietet, steht im Beitrag GPT-6 Sol und Luna.
Was sich für Integrationen ändert
Ein reiner Austausch der Modell-ID reicht nicht. Wer eine Automatisierung von Haiku 4.5 auf Haiku 5.5 umstellt, sollte laut Migrationsleitfaden diese Punkte vorher prüfen:
- Zähle deine Prompts neu und passe
max_tokensund Kostenschätzungen an, weil derselbe Text rund 30 Prozent mehr Token ergibt. - Ersetze
thinkingmit festembudget_tokensdurch{"type": "adaptive"}, die alte Form gibt einen Fehler. Den Denkaufwand steuert jetzteffort, voreingestellt aufmedium. - Lies Antworten nach Blocktyp aus, nicht nach Position. Das Thinking ist standardmäßig an, die Antwort kann mit einem Denk-Block beginnen.
- Entferne
temperature,top_pundtop_k, ein Wert abseits der Voreinstellung löst einen Fehler aus. - Ersetze vorausgefüllte Assistenten-Antworten (Prefill) durch strukturierte Ausgaben. Eine Anfrage, die mit einer Assistenten-Nachricht endet, schlägt fehl.
- Wechsle bei der Bildschirmsteuerung (Computer Use) auf der Claude API und bei Google Cloud auf das Werkzeugset
computer_toolset_20260801. - Fange den Abbruchgrund
refusalab. Haiku 5.5 kann Anfragen über Sicherheitsklassifikatoren ablehnen, eine automatische Wiederholung mit einem anderen Modell gibt es nicht.
Anders als bei Sonnet 5.5 bleibt erzwungene Werkzeugnutzung über tool_choice erlaubt, dann allerdings ohne vorheriges Reasoning, also ohne mehrstufiges Schlussfolgern vor der Antwort. Für eine Klassifikation mit festem Antwortschema kann das ausreichen. Wer eine Priority-Tier-Vereinbarung für Haiku 4.5 hat, muss die Kapazität neu planen: Haiku 5.5 unterstützt diese Stufe laut Anthropic nicht. Bei den Cybersicherheits-Schutzmaßnahmen liegt Haiku 5.5 zwischen Haiku 4.5 und Sonnet 5.5, Anfragen zu Penetrationstests lehnt das Modell ab.
Claude in der EU: nur über Cloud-Partner
Haiku 5.5 unterstützt als erstes Haiku-Modell den Parameter inference_geo, mit dem sich der Ort der Inferenz je Anfrage festlegen lässt. Laut Data-Residency-Dokumentation stehen dort aber nur die Regionen global und USA zur Wahl, die USA-Variante mit 10 Prozent Aufschlag. Eine garantierte Verarbeitung in der EU gibt es weiterhin nur über Amazon Bedrock oder Google Cloud mit regionalem Endpunkt, zu deren eigenen Regionalpreisen.
Ob Haiku 5.5 schon zum Start in den EU-Regionen beider Anbieter bereitsteht, geht aus der Dokumentation bislang nicht hervor. Wie sich Verarbeitungsort, Speicherung und Vertragspartner bei mehreren Anbietern sauber auseinanderhalten lassen, beschreibt der Beitrag KI und EU-Datenresidenz.
Einordnung
Andre Loreth hält den Preis für die eigentliche Nachricht. Mit Haiku 5.5 kostet ein Claude-Modell erstmals so wenig wie GPT-6 Luna und liegt in Anthropics eigenen Vergleichen vor Luna und Haiku 4.5. Für Back-Office-Abläufe mit Tausenden gleichförmiger Dokumente im Monat fallen die Modellkosten damit kaum noch ins Gewicht. Der Aufwand verschiebt sich in den Umstieg: neuer Tokenizer, neues Thinking, kein Prefill mehr. Offen bleibt, wie die Herstellerzahlen in unabhängigen Messungen abschneiden und wann Haiku 5.5 in den EU-Regionen der Cloud-Partner verfügbar ist.