Gemini 4 ist noch nicht erschienen, auch wenn ein Bericht von WinFuture vom 28. September 2026 geleakte Benchmarks zu Gemini 4 Pro aufgreift. Bestätigt hat Google laut 9to5Google nur, dass sich das Modell im Post-Training befindet und möglichst bald erscheinen soll. Zu Preis, Kontextfenster und Leistung hat Google bislang nichts veröffentlicht.
Kurzfassung
- Google hat Gemini 4 noch nicht veröffentlicht und bislang weder einen Termin noch Preise oder Benchmarks genannt.
- Die kursierende Benchmark-Tabelle zu Gemini 4 Pro stammt aus einem Leak und passt nicht zu den veröffentlichten Werten der Konkurrenz (Stand: 29. September 2026).
- Das betrifft Unternehmen, die einen Wechsel zu Gemini 4 planen oder Automatisierungen bereits mit Google-Modellen betreiben.
Gemini 4: der bestätigte Stand
Offiziell ist wenig bekannt. Am 21. Juli 2026 schrieb Tulsee Doshi im Google-Blog, Google habe für Gemini 4 den bislang ehrgeizigsten Pre-Training-Lauf gestartet. Einen Tag später wiederholte Google-Chef Sundar Pichai die Aussage bei der Vorstellung der Quartalszahlen. Gemini 3.5 Pro sei in der Testphase, ergänzte Pichai.
Neuere Angaben stammen von DeepMind-Chef Koray Kavukcuoglu. Auf dem AI Agenda Live Summit des Branchendiensts The Information sagte Kavukcuoglu laut 9to5Google und The Next Web, Gemini 4 stecke in einer frühen Phase des Post-Trainings. In dieser Phase wird ein vortrainiertes Basismodell auf zuverlässiges Verhalten abgestimmt.
Google-Entwickler nutzen das Modell intern bereits im Coding-Tool Antigravity. Google wolle eine frühe Version so schnell wie möglich veröffentlichen, deutlich vor Jahresende. Ein Datum nannte der DeepMind-Chef nicht.
Alles Weitere stammt aus Leaks. Das Portal TestingCatalog nennt den Codenamen „Argon“, eine maximale Ausgabelänge von 256.000 Token und Antwortzeiten von 2,4 bis 20 Minuten bei höchster Reasoning-Stufe, also beim mehrstufigen Schlussfolgern vor der Antwort. Andere Quellen sprechen von einem Start zwischen Oktober und Dezember. Ein Preis von 2,25 US-Dollar für die Eingabe und 11,25 US-Dollar für die Ausgabe je 1 Million Token kursiert ebenfalls, eine Quelle ist nicht erkennbar.
Geleakte Benchmarks im Faktencheck
Etwa seit dem 21. September 2026 kursiert auf X eine Tabelle unbekannter Herkunft, die Portale wie Dataconomy und Nokiapoweruser aufgegriffen haben. WinFuture selbst nennt keine Zahlen und rät, die Leaks mit großer Vorsicht zu behandeln. Sie enthält folgende Werte:
| Benchmark | Gemini 4 Pro (Leak) | Claude Opus 5.5 (laut Leak) | GPT-6 Astra (laut Leak) |
|---|---|---|---|
| DeepSWE v1.1 | 88,7 | 74,2 | 74,1 |
| Terminal-Bench 2.1 | 95,3 | etwa 88 | etwa 88 |
| OSWorld 2.0 | 86,8 | 81,8 | 72,6 |
| GDPval-AA | 2.064 (v2) | 1.846 (v2.1) | 1.542 (v2.1) |
| Kontextfenster | 2 Mio. Token | 1 Mio. Token | 1,1 Mio. Token |
Quelle: Leak, von Google nicht bestätigt.
Bei näherem Hinsehen passt die Tabelle an mehreren Stellen nicht. Anthropic hat für Opus 5.5 eigene Werte veröffentlicht, darunter 66,4 Prozent auf Terminal-Bench 4.0. Der Leak nennt für Opus 5.5 dagegen rund 88 Punkte auf Terminal-Bench 2.1, einer Version, für die Anthropic keinen Wert angibt. Beim GDPval-AA legt die Tabelle bei Gemini Version 2 zugrunde, bei der Konkurrenz Version 2.1. Die Werte sind damit nicht vergleichbar.
Zweifel weckt auch die offizielle DeepSWE-Rangliste. Dort stehen GPT-6 Astra, Claude Opus 5 und Gemini 3.8 Flash (Stand: 22. September 2026) jeweils bei 74. Opus 5.5 fehlt, der Leak-Wert von 74,2 lässt sich also nicht prüfen. Die 88,7 für Gemini 4 Pro lägen knapp 15 Punkte über Googles eigenem aktuellen Flash-Modell.
Beim Kontextfenster widersprechen sich die Leaks: Sie nennen wahlweise 1,5 Millionen, 2 Millionen oder 10 Millionen Token. TestingCatalog berichtet zudem, ein auf Benchmarks spezialisierter Account habe die Qualität der gezeigten Demos nicht reproduzieren können. Andre Loreth vermutet, dass die Tabelle zum Teil aus öffentlich bekannten Werten zusammengesetzt wurde. Belegen lässt sich das nicht.
Google liegt bei Pro-Modellen zurück
Gemini 3 Pro erschien am 18. November 2025, sein Nachfolger Gemini 3.1 Pro wird im September 2026 noch immer als Vorschauversion angeboten. Gemini 3.5 Pro hatte Google auf der Entwicklerkonferenz I/O im Mai für Juni angekündigt, erschienen ist es aber nie. Laut Kavukcuoglu habe Google „einen kleinen Schritt zurück“ gemacht und sich auf die Flash-Modelle konzentriert. t3n schrieb schon im Juli, Googles Pro-Modelle lägen vor allem beim Coding deutlich hinter Anthropic und OpenAI zurück.
Dazu kommt ein Umbau an der Spitze. Laut heise wurde Demis Hassabis im August 2026 Chairman, Kavukcuoglu übernahm als CEO die Leitung von Google DeepMind, und Jeff Dean verließ Google. Die Konkurrenz hat derweil nachgelegt: OpenAI brachte am 22. September GPT-6 Sol und Luna heraus, Anthropic am selben Tag Claude Opus 5.5.
Die aktuellen Listenpreise laut Google (Stand: September 2026): Gemini 3.1 Pro kostet 2 US-Dollar für die Eingabe und 12 US-Dollar für die Ausgabe je 1 Million Token. Oberhalb von 200.000 Token liegen die Preise bei 4 und 18 US-Dollar. Für Gemini 3.8 Flash gilt bis Jahresende ein Einführungspreis von 0,75 US-Dollar für die Eingabe und 3,75 US-Dollar für die Ausgabe, ab dem 1. Januar 2027 sind es 1,50 und 7,50 US-Dollar.
EU-Rechenzentren nur für Flash-Modelle
Für viele Unternehmen zählt neben der Leistung, wo die Daten verarbeitet werden. Laut Googles Dokumentation zur Datenresidenz macht der globale Endpunkt von Vertex AI keine Zusage zum Verarbeitungsort. Der EU-Endpunkt garantiert die Verarbeitung innerhalb der EU-Mitgliedstaaten, bietet aber nur Flash-Modelle an. Gemini 3.1 Pro fehlt in der Liste. Neue Modelle kommen, wie innfactory berichtet, zuerst über den globalen Endpunkt, die EU-Regionen folgen später.
Wie sich Verarbeitungsort, Speicherung und Vertragspartner auseinanderhalten lassen, beschreibt der Beitrag KI und EU-Datenresidenz.
Hinzu kommt der EU AI Act. Google hat am 30. Juli 2025 den Verhaltenskodex für KI-Modelle mit allgemeinem Verwendungszweck unterzeichnet. Seit dem 2. August 2026 kann die EU-Kommission die Pflichten für solche Modelle laut den Leitlinien der Kommission auch mit Bußgeldern durchsetzen. Gemini 4 unterliegt dieser Aufsicht von Anfang an.
Checkliste für den Starttag
Wer Gemini 4 einsetzen will, sollte zum Start diese Punkte prüfen:
- Lies die Model Card und prüfe die Modell-ID auf ai.google.dev, bevor du Zahlen aus sozialen Netzwerken übernimmst.
- Prüfe, ob Google das Modell für den EU-Endpunkt von Vertex AI aufführt oder nur global anbietet.
- Prüfe die Preisstaffel ab 200.000 Token und ob ein Einführungspreis ausläuft.
- Warte auf unabhängige Messungen und vergleiche nur Werte derselben Benchmark-Version.
- Miss die Antwortzeit bei hoher Reasoning-Stufe in deinem eigenen Ablauf, denn Antworten nach mehreren Minuten bremsen Automatisierungen aus.
Den aktuellen Stand aller Anbieter mit Preisen und Hosting-Optionen fasst der LLM-Vergleich zusammen.
Einordnung
Ob Gemini 4 den Markt verschiebt, hält Andre Loreth für offen. Die geleakte Tabelle taugt nicht als Antwort, solange Versionen, Herkunft und Vergleichswerte nicht zusammenpassen. Aussagekräftiger ist, was Google selbst bestätigt: Das Modell läuft intern, ein angekündigtes Pro-Modell ist nicht erschienen, und der Konzern will schnell liefern.
Von einem aggressiven Preiskampf berichtet WinFuture unter Berufung auf unbestätigte Dokumente. Googles eigene Preisliste spricht eher dagegen, denn der Einführungspreis von Gemini 3.8 Flash verdoppelt sich zum 1. Januar 2027. Solange Google weder Model Card noch Preis nennt noch einen EU-Endpunkt zusagt, fehlt für den Einsatz von Gemini 4 in Automatisierungen die Planungsgrundlage. Sobald das Modell erscheint, aktualisieren wir diesen Beitrag.