Anthropic hat heute, am 22. September 2026, Claude Opus 5.5 veröffentlicht. Es ist das erste Modell der neuen “5.5”-Generation, Claude Sonnet 5.5 und Claude Haiku 5.5 sollen laut Anthropic in den kommenden Wochen folgen. Bemerkenswert ist der Zeitpunkt: Es ist die erste Veröffentlichung, seit Anthropic öffentlich dafür plädiert hat, das Tempo an der Frontier zu drosseln, also bei den leistungsstärksten verfügbaren Modellen.
Kurzfassung
Claude Opus 5.5 kostet rund 40 Prozent weniger als Opus 5, generiert Text über 30 Prozent schneller und erreicht laut Anthropic auf den meisten Aufgaben das Niveau von Claude Fable 5.1. Die API-Preise liegen bei 4 US-Dollar Input und 20 US-Dollar Output je 1 Million Token.
Was ist Claude Opus 5.5?
Claude Opus 5.5 ist Anthropics neues Frontier-Modell, also ein Modell aus der leistungsstärksten Klasse, die ein Anbieter gerade im Angebot hat. In der API läuft es unter der Modell-ID claude-opus-5-5. Es löst Opus 5 ab und steht in der Modellreihe unter dem größeren Fable 5.1. Auf den meisten Aufgaben erreicht Opus 5.5 laut Anthropic trotzdem das Niveau von Fable 5.1, kostet aber deutlich weniger.
Technisch bringt Opus 5.5 ein Kontextfenster von 1 Million Token und eine maximale Ausgabelänge von 128.000 Token mit, die Ausgabegeschwindigkeit liegt laut Anthropic mehr als 30 Prozent über der von Opus 5. Eine Änderung betrifft jedes Setup, das bislang auf schnelle, thinking-freie Antworten gebaut war: Das Thinking, also die Denkphase, in der das Modell vor der Antwort Zwischenschritte durchrechnet, lässt sich bei Opus 5.5 nicht mehr abschalten. Das kostet Token, weil jede Antwort mit einer Denkphase beginnt.
Anthropic nennt außerdem den bislang besten Wert des Modells im eigenen automatisierten Verhaltensaudit und eine verbesserte Widerstandsfähigkeit gegen Prompt Injection. Vor der Veröffentlichung hat Anthropic Opus 5.5 laut eigener Angabe von externen Prüfstellen testen lassen, darunter METR.
Benchmarks: Wo Opus 5.5 vorne liegt und wo nicht
Die folgenden Zahlen stammen aus Anthropics Release-Angaben. Es sind Messungen des Herstellers, keine unabhängige Prüfung. Werte in Prozent, außer bei GDPval-AA.
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0 (Coding im Terminal) | 66,4 | 55,8 | 52,3 | 57,9 |
| FrontierCode v1.1 | 54,4 | 50,3 | 48,0 | 53,3 |
| GDPval-AA v2.1 (Elo, Wissensarbeit) | 1846 | 1735 | 1708 | 1542 |
| OSWorld 2.0 (Computerbedienung) | 81,8 | 80,7 | 74,0 | nicht angegeben |
| AutomationBench | 40,0 | 31,4 | 26,9 | 41,4 |
| Humanity’s Last Exam (mit Tools) | 67,7 | 65,6 | 63,6 | 57,2 |
| Terminal-Bench-Science | 58,7 | 52,6 | 29,0 | 64,6 |
Auf den meisten Benchmarks liegt Opus 5.5 vorne, sowohl gegenüber dem eigenen Vorgänger Opus 5 als auch gegenüber GPT-6 Astra. Das gilt aber nicht durchgehend: Bei AutomationBench und bei Terminal-Bench-Science liegt GPT-6 Astra klar vorne. AutomationBench misst genau die Art mehrstufiger Automatisierung, um die es in vielen Unternehmensprojekten geht. Wer einen solchen Workflow plant, sollte beide Modelle am eigenen Prozess testen, statt sich auf den Gesamteindruck zu verlassen.
Was kostet Claude Opus 5.5?
Stand 22. September 2026 gelten für Claude Opus 5.5 folgende API-Listenpreise in US-Dollar je 1 Million Token, jeweils mit dem Vorgänger Opus 5 zum Vergleich:
| Preisposition | Opus 5.5 | Opus 5 |
|---|---|---|
| Input | 4 USD | 5 USD |
| Output | 20 USD | 25 USD |
| Cache-Reads | 0,20 USD | 0,50 USD |
| Cache-Writes | 5 USD | 6,25 USD |
Im Fast-Modus, der laut Anthropic bis zu 2,5-mal schneller antwortet, liegen die Preise bei 8 US-Dollar Input und 40 US-Dollar Output. Über alle Preispositionen hinweg ist Opus 5.5 günstiger als Opus 5, bei typischen Workloads beziffert Anthropic die Ersparnis mit rund 40 Prozent.
Verfügbar ist das Modell in den Claude-Apps auf den Stufen Pro, Max, Team und Enterprise, über die Claude API sowie über AWS Bedrock, Google Cloud Vertex AI und Microsoft Azure Foundry. Die Gewichte bleiben geschlossen, ein Eigenbetrieb ist nicht möglich.
Opus 5.5 oder Sonnet: Welches Modell für welche Aufgabe?
Claude Sonnet 5.5 ist zum Zeitpunkt dieses Artikels noch nicht erschienen, ein direkter Vergleich der beiden 5.5er-Modelle lässt sich deshalb noch nicht seriös führen. Was sich schon jetzt sagen lässt: Die Preissenkung bei Opus 5.5 verschiebt die Rechnung, mit der Unternehmen bislang zwischen Opus und Sonnet gewählt haben.
Die relevante Größe für die Modellwahl ist ohnehin nicht der Preis pro Token, sondern die Kosten pro erledigter Aufgabe. Ein günstigeres Modell, das einen Workflow nicht zuverlässig löst und Nacharbeit erzeugt, ist am Ende teurer als ein teureres Modell, das auf Anhieb funktioniert. Mit einem um rund 40 Prozent gesunkenen Token-Preis und laut Anthropic spürbar höherer Fähigkeit rückt Opus 5.5 für mehr Aufgaben in Reichweite, bei denen bislang aus Kostengründen ein kleineres Modell zum Einsatz kam. Für einfache, klar umrissene Routineaufgaben bleibt ein kleineres Modell trotzdem meist die wirtschaftlichere Wahl. Die Kriterien für diese Abwägung, samt Preis- und Hosting-Vergleich über mehrere Anbieter, haben wir im LLM Vergleich für Unternehmen zusammengestellt.
Was das für Automatisierung im Unternehmen heißt
Für KI-Agenten und Prozessautomatisierung sind an Opus 5.5 vor allem drei Punkte relevant. Erstens die Fähigkeit zu langlaufenden Agentenaufgaben: Anthropic nennt als Kundenbeispiel Quantium, wo eine komplexe Aufgabe von 38 Prompts über vier Tage auf 11 Prompts über drei Stunden gesunken sein soll, sowie die Prüfung einer 200.000 Zeilen umfassenden Codebasis in unter drei Stunden statt über 20 Stunden mit Opus 5. Beim Startup Lovable soll Opus 5.5 laut Anthropic ein Drittel bis die Hälfte weniger Schritte für vergleichbare Aufgaben brauchen. Das sind Herstellerangaben, keine unabhängig geprüften Zahlen, aber sie zeigen die Richtung: weniger Zwischenschritte, weniger manuelles Nachsteuern bei mehrstufigen Agentenaufgaben.
Zweitens das dauerhaft aktive Thinking. Für Automatisierungsstrecken mit engem Token-Budget bedeutet das eine Neukalkulation, weil jede Antwort einen Denkanteil enthält, den es bei früheren Modellen mit abschaltbarem Thinking nicht gab. Bei der Kalkulation eines KI-Agenten für einen Produktivprozess gehört das jetzt fest in die Budgetplanung, ebenso wie die Frage, wo genau die Grenzen eines solchen Agenten liegen. Dazu mehr in Grenzen eines KI-Agenten technisch ziehen.
Drittens die Frage der Datenverarbeitung. Direkt über die Anthropic-API gibt es weiterhin keine eigene EU-Region. Eine garantierte EU-Verarbeitung gibt es über AWS Bedrock oder Google Cloud Vertex AI mit regionalem Endpunkt. Eine Option für Zero Data Retention ist verfügbar. Neu ist außerdem eine Wasserzeichenkennung der Ausgaben, mit der Anthropic auf die Kennzeichnungsanforderungen des europäischen KI-Regelwerks reagiert. Welche Pfade für welche Datenklasse infrage kommen, ordnet der Beitrag KI und EU-Datenresidenz ein, und wie schnell sich Datenschutz-Zusagen bei einem einzelnen Anbieter verschieben können, zeigt der Fall Claude in Microsoft Copilot.
Wer bereits einen Agenten mit Opus 5 betreibt, kann den Wechsel meist mit einer neuen Modell-ID erledigen. Vorher lohnt sich ein Testlauf am echten Prozess: Die niedrigeren Token-Preise und die Denkphase, die immer mitläuft, verschieben die Kosten in entgegengesetzte Richtungen.