Zum Inhalt springen

Claude Haiku 5.5: Anthropic zieht beim Preis mit GPT-6 Luna gleich

Anthropic hat Claude Haiku 5.5 veröffentlicht: ab 0,10 US-Dollar je 1 Million Input-Token, laut Hersteller im Schnitt rund 75 Prozent günstiger als Haiku 4.5.

Andre Loreth7 Min. Lesezeit
Teilen
Gezeichnetes Förderband mit einer Reihe gleicher Pakete, darüber eine goldene Kugel, die mit Tempolinien nach rechts fliegt

Anthropic hat am 7. Oktober 2026 Claude Haiku 5.5 veröffentlicht und damit die 5.5-Generation nach Opus 5.5 und Sonnet 5.5 vervollständigt. Das kleinste Claude-Modell kostet ab 0,10 US-Dollar je 1 Million Input-Token und liegt damit exakt auf dem Listenpreis von GPT-6 Luna. Gegenüber Haiku 4.5 soll eine Aufgabe im Schnitt rund 75 Prozent weniger kosten.

Kurzfassung

  • Anthropic hat Claude Haiku 5.5 veröffentlicht, ein kleines Modell für Klassifikation, Extraktion und Routing mit 1 Million Token Kontextfenster.
  • Haiku 5.5 kostet bis 100.000 Token je Anfrage 0,10 US-Dollar Input und 0,50 US-Dollar Output je 1 Million Token (Stand: Oktober 2026).
  • Das betrifft jede Automatisierung mit hohem Anfragevolumen, die bislang auf Haiku 4.5 oder GPT-6 Luna läuft.

Claude Haiku 5.5: Preise und Preisstufe

Claude Haiku 5.5 läuft in der API unter der Modell-ID claude-haiku-5-5, auf Amazon Bedrock als anthropic.claude-haiku-5-5. Das Kontextfenster (die maximal verarbeitbare Textmenge je Anfrage) wächst von 200.000 Token bei Haiku 4.5 auf 1 Million Token, die maximale Ausgabe liegt bei 128.000 Token. Verfügbar ist das Modell laut Modellübersicht über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS.

Neu ist die Preisstufe. Anfragen mit bis zu 100.000 Token kosten ein Fünftel dessen, was längere Anfragen kosten. Stand: Oktober 2026 gelten folgende Listenpreise in US-Dollar je 1 Million Token:

PreispositionHaiku 5.5 (bis 100.000 Token)Haiku 5.5 (über 100.000 Token)Haiku 4.5Sonnet 5.5
Input0,10 USD0,50 USD1 USD2 USD
Output0,50 USD2,50 USD5 USD10 USD
Cache-Reads0,01 USD0,05 USD0,10 USD0,10 USD
Cache-Writes (5 Minuten)0,125 USD0,625 USD1,25 USD2,50 USD

Gegenüber Haiku 4.5 liegt der Listenpreis laut Anthropic bei Anfragen bis 100.000 Token 90 Prozent niedriger, bei längeren 50 Prozent. Im Betrieb soll Haiku 5.5 im Schnitt rund 75 Prozent weniger kosten. Ein Teil der Differenz geht auf den neuen Tokenizer zurück, also das Verfahren, das Text in Token zerlegt: Derselbe Text ergibt laut Migrationsleitfaden etwa 30 Prozent mehr Token als bei Haiku 4.5. Am selben Tag hat Anthropic die Cache-Reads (Lesezugriffe auf zwischengespeicherte Prompts) bei Sonnet 5.5 von 0,20 auf 0,10 US-Dollar halbiert.

Ein gerechnetes Beispiel, keine Messung aus einem Kundenprojekt: 10.000 Eingangsrechnungen mit je 3.000 Input-Token und 500 Output-Token kosten mit Haiku 5.5 5,50 US-Dollar. Bei Haiku 4.5 ergibt derselbe Text knapp ein Viertel weniger Token und kostet rund 42 US-Dollar. Nicht enthalten sind Denk-Token, die als Output abgerechnet werden und je nach Einstellung den Betrag erhöhen.

Benchmarks gegen Haiku 4.5 und GPT-6 Luna

Die folgenden Werte stammen aus Anthropics eigenen Release-Angaben. Es sind Messungen des Herstellers, keine unabhängige Prüfung. Alle Werte in Prozent, außer GDPval-AA (Elo-Punkte).

BenchmarkHaiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
GDPval-AA v2.1 (Wissensarbeit, Elo)162073514371840
OSWorld 2.1 (Computerbedienung)72,415,748,983,9
Humanity’s Last Exam (mit Tools)57,418,7nicht angegeben64,5
Terminal-Bench 4.0 (Coding im Terminal)39,20,016,470,6
FrontierCode 1.146,4nicht angegeben42,452,1
Chartography (Diagramme lesen)46,46,429,161,6

Gegenüber Haiku 4.5 fällt der Sprung überall groß aus, wo Anthropic einen Vergleichswert nennt, bei der Computerbedienung von knapp 16 auf gut 72 Prozent. GPT-6 Luna, das zum identischen Basispreis angeboten wird, liegt in allen Vergleichen mit Luna-Wert dahinter. Beim Coding im Terminal bleibt der Abstand zu Sonnet 5.5 dagegen groß. Für komplexe Programmieraufgaben mit KI-Agenten bleiben Sonnet 5.5 und Opus 5.5 laut Anthropic die bessere Wahl.

Erste Kundenstimmen nennt Anthropic in der Ankündigung. Box habe in frühen Tests elf Punkte mehr als mit Haiku 4.5 gemessen, bei etwa halber Antwortzeit. Asana berichtet von über 30 Prozent weniger Latenz bei Aufgaben gegenüber dem bisher genutzten Modell. Beide Angaben sind Herstellerangaben ohne unabhängige Prüfung.

Haiku, Sonnet oder Opus

Andre Loreth teilt die drei Modelle der 5.5-Generation nach Aufgabe auf. Haiku 5.5 übernimmt große Mengen gleichförmiger Aufgaben: Belege nach Art sortieren, Felder aus Rechnungen ziehen, E-Mails dem richtigen Postfach zuweisen. Claude Sonnet 5.5 bleibt nach seiner Einschätzung das Modell für Abläufe mit mehr Urteilsvermögen, etwa die Antwort auf eine Kundenanfrage. Claude Opus 5.5 bleibt für die wenigen Schritte, bei denen ein Fehler teuer wird.

Anthropic beschreibt Haiku 5.5 ausdrücklich auch als Hilfsmodell für größere Modelle. Ein Ablauf kann damit in Stufen zerlegt werden: Haiku 5.5 sortiert vor und extrahiert, Sonnet 5.5 oder Opus 5.5 prüfen nur die Fälle, die Haiku als unsicher markiert. Welche Aufteilung trägt, zeigt erst ein Test mit echten Dokumenten aus dem eigenen Betrieb. Den Vergleich über alle Anbieter hinweg, samt Preis- und Hosting-Pfaden, enthält der LLM-Vergleich.

Zu beachten ist die Preisstufe bei 100.000 Token. Ein langer Vertrag oder ein umfangreicher Prüfbericht in einer einzigen Anfrage kostet das Fünffache des Basispreises, bleibt aber deutlich günstiger als mit Sonnet 5.5. Die Preisgleichheit mit GPT-6 Luna gilt nur unterhalb dieser Stufe. Was Luna seit September 2026 bietet, steht im Beitrag GPT-6 Sol und Luna.

Was sich für Integrationen ändert

Ein reiner Austausch der Modell-ID reicht nicht. Wer eine Automatisierung von Haiku 4.5 auf Haiku 5.5 umstellt, sollte laut Migrationsleitfaden diese Punkte vorher prüfen:

  • Zähle deine Prompts neu und passe max_tokens und Kostenschätzungen an, weil derselbe Text rund 30 Prozent mehr Token ergibt.
  • Ersetze thinking mit festem budget_tokens durch {"type": "adaptive"}, die alte Form gibt einen Fehler. Den Denkaufwand steuert jetzt effort, voreingestellt auf medium.
  • Lies Antworten nach Blocktyp aus, nicht nach Position. Das Thinking ist standardmäßig an, die Antwort kann mit einem Denk-Block beginnen.
  • Entferne temperature, top_p und top_k, ein Wert abseits der Voreinstellung löst einen Fehler aus.
  • Ersetze vorausgefüllte Assistenten-Antworten (Prefill) durch strukturierte Ausgaben. Eine Anfrage, die mit einer Assistenten-Nachricht endet, schlägt fehl.
  • Wechsle bei der Bildschirmsteuerung (Computer Use) auf der Claude API und bei Google Cloud auf das Werkzeugset computer_toolset_20260801.
  • Fange den Abbruchgrund refusal ab. Haiku 5.5 kann Anfragen über Sicherheitsklassifikatoren ablehnen, eine automatische Wiederholung mit einem anderen Modell gibt es nicht.

Anders als bei Sonnet 5.5 bleibt erzwungene Werkzeugnutzung über tool_choice erlaubt, dann allerdings ohne vorheriges Reasoning, also ohne mehrstufiges Schlussfolgern vor der Antwort. Für eine Klassifikation mit festem Antwortschema kann das ausreichen. Wer eine Priority-Tier-Vereinbarung für Haiku 4.5 hat, muss die Kapazität neu planen: Haiku 5.5 unterstützt diese Stufe laut Anthropic nicht. Bei den Cybersicherheits-Schutzmaßnahmen liegt Haiku 5.5 zwischen Haiku 4.5 und Sonnet 5.5, Anfragen zu Penetrationstests lehnt das Modell ab.

Claude in der EU: nur über Cloud-Partner

Haiku 5.5 unterstützt als erstes Haiku-Modell den Parameter inference_geo, mit dem sich der Ort der Inferenz je Anfrage festlegen lässt. Laut Data-Residency-Dokumentation stehen dort aber nur die Regionen global und USA zur Wahl, die USA-Variante mit 10 Prozent Aufschlag. Eine garantierte Verarbeitung in der EU gibt es weiterhin nur über Amazon Bedrock oder Google Cloud mit regionalem Endpunkt, zu deren eigenen Regionalpreisen.

Ob Haiku 5.5 schon zum Start in den EU-Regionen beider Anbieter bereitsteht, geht aus der Dokumentation bislang nicht hervor. Wie sich Verarbeitungsort, Speicherung und Vertragspartner bei mehreren Anbietern sauber auseinanderhalten lassen, beschreibt der Beitrag KI und EU-Datenresidenz.

Einordnung

Andre Loreth hält den Preis für die eigentliche Nachricht. Mit Haiku 5.5 kostet ein Claude-Modell erstmals so wenig wie GPT-6 Luna und liegt in Anthropics eigenen Vergleichen vor Luna und Haiku 4.5. Für Back-Office-Abläufe mit Tausenden gleichförmiger Dokumente im Monat fallen die Modellkosten damit kaum noch ins Gewicht. Der Aufwand verschiebt sich in den Umstieg: neuer Tokenizer, neues Thinking, kein Prefill mehr. Offen bleibt, wie die Herstellerzahlen in unabhängigen Messungen abschneiden und wann Haiku 5.5 in den EU-Regionen der Cloud-Partner verfügbar ist.

Dieser Artikel ist mit Unterstützung künstlicher Intelligenz entstanden. Bei dem, was wir hier machen, wäre alles andere seltsam gewesen.

Teilen

NeuGoogle

Mach uns zu deiner bevorzugten Quelle

Google lässt dich festlegen, welche Seiten in deinen Suchergebnissen weiter oben stehen sollen. Markierst du uns als bevorzugte Quelle, tauchen unsere Artikel bei dir zuverlässiger auf.

Bei Google hinzufügen

Noch offene Fragen?

Claude Haiku 5.5 ist Anthropics kleinstes und schnellstes Modell der 5.5-Generation, veröffentlicht am 7. Oktober 2026 unter der Modell-ID claude-haiku-5-5. Verfügbar ist es über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS.

Der Preis ist die Gebühr, die Anthropic je 1 Million verarbeiteter Token berechnet. Claude Haiku 5.5 kostet bei Anfragen bis 100.000 Token 0,10 US-Dollar Input und 0,50 US-Dollar Output, darüber 0,50 US-Dollar Input und 2,50 US-Dollar Output (Stand: Oktober 2026).

Günstiger heißt hier: niedrigere Kosten für dieselbe Aufgabe, gemessen am Listenpreis und an der Zahl der verbrauchten Token. Der Listenpreis liegt laut Anthropic bei Anfragen bis 100.000 Token 90 Prozent unter Haiku 4.5, im Betrieb soll Haiku 5.5 im Schnitt rund 75 Prozent weniger kosten, weil derselbe Text mehr Token ergibt. Unabhängig geprüft ist diese Rechnung bislang nicht.

Ein Anwendungsfall für Haiku 5.5 ist eine große Menge kurzer, gleichförmiger Aufgaben, für die Anthropic das Modell laut Dokumentation auslegt. Dazu zählen Klassifikation, Extraktion, Zusammenfassungen, das Weiterleiten von Anfragen und Teilaufgaben für größere Modelle. Für komplexe Programmieraufgaben mit KI-Agenten bleiben laut Anthropic Sonnet 5.5 und Opus 5.5 die bessere Wahl.

EU-Datenresidenz bedeutet, dass die Inferenz vertraglich zugesagt in EU-Rechenzentren läuft. Die Anthropic-API bietet dafür nur die Regionen global und USA, eine EU-Verarbeitung ist über Amazon Bedrock oder Google Cloud mit regionalem Endpunkt möglich. Datenschutzkonform ausgestaltbar ist der Einsatz damit, wenn ein Auftragsverarbeitungsvertrag besteht.

Du planst gerade eine KI-Automatisierung?

Wir gehen deinen Plan gemeinsam durch und sagen dir, wo wir anfangen würden.

Kostenloses Kennenlerngespräch

30 Minuten. Danach weißt du, welche drei Prozesse bei dir zuerst dran sind.

Lieber erst schreiben? E-Mail schreiben