Google führt inzwischen zwei Gemini-Zeitlinien, die sich nicht mehr im Gleichschritt bewegen. Die Flash-Reihe ist bis zu Gemini 3.8 Flash geprescht, gestartet am 2. September 2026, während die Pro-Reihe seit Februar bei Gemini 3.1 Pro einfriert. Wer nach einem „Gemini 3.5 Pro“ oder einem „3.6 Pro“ gesucht hat, muss zuerst das klarstellen, denn beides gibt es in keinem ehrlichen Gemini-Modellvergleich noch nicht. Dann kündigte Google am 30. September 2026 Gemini 4 Argon an, sein erstes neues Flaggschiff seit 3.1 Pro, das bisher aber nur eine kleine Gruppe geprüfter Cyberverteidiger nutzen kann.

Dieser Leitfaden bildet die gesamte Modellreihe von Gemini 2.5 bis 3.8 Flash und dem neuen Gemini 4 Argon ab, Version für Version, mit einer Benchmark- und Preistabelle zu jedem Modell, dazu wie die Modelle in der Gemini-App erscheinen und eine klare Empfehlung für jeden Anwendungsfall. Du erfährst, warum Google die Familie zweigeteilt hat, was sich bei jedem Release wirklich geändert hat und welches Modell für Coding, Alltagschat, lange Dokumente und ein knappes Budget die richtige Standardwahl ist.

Die wichtigsten Punkte

  • Gemini 3.8 Flash ist das neueste Modell, das du nutzen kannst, verfügbar seit 2. September 2026, zum Einführungspreis von $0.75 / $3.75 pro 1 Million Token. Es ist Googles drittes Flash-Release in 43 Tagen, und 3.7 Flash und 3.6 Flash liegen auf demselben Tarif.
  • Es gibt kein Gemini 3.5 Pro oder 3.6 Pro. Das aktuelle Pro-Flaggschiff ist weiterhin Gemini 3.1 Pro von Februar 2026.
  • Dieser günstige Tarif läuft aus. Alle drei Modelle, 3.8, 3.7 und 3.6 Flash, steigen am 1. Januar 2027 wieder auf $1.50 / $7.50, also solltest du über den Jahreswechsel hinweg mit der höheren Zahl planen.
  • Gemini 3.5 Flash-Lite ist mit $0.30 / $2.50 pro 1 Million Token das günstigste aktuelle Modell.
  • In der App läuft der Gratis-Plan seit dem 9. Oktober 2026 nur noch mit Gemini Flash-Lite, während 3.6 Flash zu AI Plus und höher wandert. Weder 3.7 noch 3.8 Flash sind kostenlos: 3.7 erreicht Privatnutzer nur über Spark, und für 3.8 wird der Zugang bislang nur für AI Pro- und Ultra-Abonnenten berichtet. Deep Think bleibt AI Ultra vorbehalten, während Gemini Spark in den USA und über 160 weiteren Ländern AI Pro erreicht.
  • Gemini 4 Argon, Googles erstes Gemini-4-Modell und neues Flaggschiff, wurde am 30. September 2026 zum Einführungspreis von $2 / $10 pro 1 Million Token angekündigt, kann bisher aber nur von Cyberverteidigern des Fairwind-Programms genutzt werden.

Die Gemini-Modellreihe im Überblick (2026)

Vom Herausgeber

Jedes KI-Modell in einer App

Fello AI vereint GPT-6, Claude 5.5, Gemini 3.8, Grok 4.7 und mehr in einer nativen App für Mac und iPhone.

Jetzt herunterladen!

Google gliedert Gemini in drei Stufen. Pro ist die Flaggschiff-Stufe für anspruchsvolles Reasoning, Flash ist das schnelle Alltagsarbeitstier, und Flash-Lite ist die Budgetoption. Das Verwirrende daran: Diese Stufen teilen sich keine Versionsnummer mehr, sodass das neueste Flash (3.8) dem neuesten Pro (3.1) um vier volle Releases voraus ist. Gemini 4 Argon, angekündigt am 30. September, bricht dieses Muster erneut: Es trägt statt eines Stufennamens einen Codenamen.

Hier die aktuelle Familie, vom ältesten zum neuesten Modell, mit den wichtigsten Modellen fett hervorgehoben.

ModellVeröffentlichtStufeStatusAm besten für
Gemini 2.5 ProMärz 2025ProLegacyGünstigeres Reasoning als Fallback
Gemini 2.5 FlashApr. 2025FlashLegacyÄltere Alltagsaufgaben
Gemini 2.5 Flash-LiteJun. 2025Flash-LiteLegacyHohes Volumen, niedrige Kosten
Gemini 3 ProNov. 2025ProPreviewErstes „3.0“-Flaggschiff
Gemini 3 FlashDez. 2025FlashPreviewAusgewogenes Preis-Leistungs-Verhältnis
Gemini 3.1 ProFeb. 2026ProNeuestes nutzbares ProSchwierigstes Reasoning, lange Dokumente
Gemini 3.1 Flash-LiteMärz 2026Flash-LiteAbgelöstAgentenarbeit mit Budget
Gemini 3.5 FlashMai 2026FlashAbgelöstVorheriges Arbeitstier
Gemini 3.5 Flash-LiteJul. 2026Flash-LiteAktuellGünstigste Qualitätsoption
Gemini 3.6 FlashJul. 2026FlashAbgelöstWeiterhin Standard in der kostenlosen App
Gemini 3.7 FlashAug. 2026FlashAbgelöstVorheriges Arbeitstier
Gemini 3.8 FlashSep. 2026FlashAktuelles ArbeitstierDie meisten Menschen, die meisten Aufgaben
Gemini 4 ArgonSep. 2026Flaggschiff (ohne Stufenname)Angekündigt, nur Fairwind-PartnerLanges Coding, Wissensarbeit und Cyberverteidigung

Zwei Spezialmodelle stehen außerhalb des Hauptrasters. Gemini 3 Deep Think ist eine Preview für erweitertes Reasoning aus dem Dezember 2025, und Gemini 3.5 Flash Cyber, veröffentlicht am 21. Juli, ist eine auf das Finden und Patchen von Sicherheitslücken feinabgestimmte Version von 3.5 Flash innerhalb von Googles CodeMender-System.

Warum es kein Gemini 3.5 Pro (oder 3.6 Pro) gibt

Die größte Verwirrungsquelle in jedem Gemini-Modellvergleich sind die fehlenden Pro-Releases. Als Google 3.5 Flash, dann 3.6 Flash, dann 3.7 Flash und dann 3.8 Flash herausbrachte, nahmen viele an, dass auch ein passendes Pro käme. Das war nicht der Fall.

Laut TechCrunch brachte Google am 21. Juli drei neue Modelle heraus, und zwar bewusst ohne 3.5 Pro. Laut Bloomberg-Berichten, die in dieser Berichterstattung zitiert werden, stieß Google auf interne Verzögerungen und hatte Mühe, seine eigenen Leistungsziele für 3.5 Pro zu erreichen, weshalb es weiterhin im Partnertest statt in der allgemeinen Freigabe bleibt. Produktleiter Logan Kilpatrick sagte, das Unternehmen teste es noch und hoffe, dass es „bald kommt“.

Damit bleibt Gemini 3.1 Pro aus dem Februar 2026 das neueste Pro-Modell, das du tatsächlich nutzen kannst. Die Flash-Reihe wurde währenddessen weiter ausgebaut, weshalb die Versionsnummern unpassend wirken. Die Erkenntnis ist einfach: Wer heute erstklassiges Gemini-Reasoning will, nutzt 3.1 Pro, nicht ein nicht erschienenes 3.5 oder 3.6 Pro. Im September sagte Koray Kavukcuoglu von Google DeepMind, Google habe „ein kleines Stück zurückgetreten“, um sich auf seine Flash-Modelle zu konzentrieren, und das nächste von Google angekündigte Flaggschiff war am 30. September Gemini 4 Argon, nicht ein 3.5 Pro.

Gemini 2.5: das Legacy-Fundament mit drei Stufen

Die 2.5er-Familie ist die Legacy-Generation, veröffentlicht über das ganze Jahr 2025 verteilt, und sie legte das Drei-Stufen-Muster fest, das Google noch heute nutzt. Gemini 2.5 Pro kam am 25. März, 2.5 Flash am 17. April und 2.5 Flash-Lite am 17. Juni, jeweils mit einem Kontextfenster von 1 Million Token. Diese Modelle funktionieren weiterhin und bleiben ein günstigerer Fallback, hinken der 3.x-Familie aber bei Reasoning, Coding und Agentenaufgaben hinterher.

Wie die 2.5er-Stufen in Benchmarks und Preis abschneiden

Zum Start führte 2.5 Pro das LMArena-Ranking an und erzielte 63,8 % bei SWE-Bench Verified. 2.5 Flash unterbot es deutlich, und 2.5 Flash-Lite ging mit $0.10 / $0.40 noch tiefer, weiterhin der günstigste Gemini-Tarif, den die API je hatte. Unser Leitfaden zu KI-Benchmarks erklärt, was jeder dieser Tests tatsächlich misst.

ModellVeröffentlichtPreis (Ein-/Ausgabe pro 1M)Highlight
Gemini 2.5 Pro25. März 2025$1.25 / $10.00LMArena #1 zum Start; SWE-Bench 63,8 %
Gemini 2.5 Flash17. Apr. 2025$0.30 / $2.50Schnelles Alltagsarbeitstier
Gemini 2.5 Flash-Lite17. Jun. 2025$0.10 / $0.40Günstigster Gemini-Tarif aller Zeiten

Wann sich ein 2.5er-Modell lohnt

Nutze 2.5 nur, wenn du auf älterer Infrastruktur arbeitest oder die niedrigsten möglichen Kosten brauchst und dir Spitzenqualität egal ist. Für alles Neue sind die 3.x-Stufen zu ähnlichen oder niedrigeren Preisen ein klares Upgrade.

Gemini 3.0: der Generationsneustart

Modell Gemini 3 eröffnete die aktuelle Generation. Gemini 3 Pro startete am 18. November 2025 als Preview-Flaggschiff, gefolgt von Gemini 3 Deep Think am 4. Dezember für schwierigeres mehrstufiges Reasoning und Gemini 3 Flash am 17. Dezember. Das war der Sprung, der Googles Benchmark-Position gegenüber ChatGPT und Claude neu sortierte.

Gemini 3.0: Benchmarks und Preise

Gemini 3 Pro kam mit einem Kontextfenster von 1 Million Token und 64.000 Token Ausgabe und erzielte 91,9 % bei GPQA Diamond, ein Elo von 1501 bei LMArena und 76,2 % bei SWE-Bench Verified. Gemini 3 Flash schlug dann beim Coding sein eigenes Pro-Geschwistermodell, mit 78 % bei SWE-Bench Verified für nur $0.50 / $3.00 pro 1 Million Token. Deep Think, ein Modus für erweitertes Reasoning für AI-Ultra-Abonnenten, brachte ARC-AGI-2 mit Codeausführung auf 45,1 %.

ModellVeröffentlichtPreis (Ein-/Ausgabe pro 1M)Wichtigster Benchmark
Gemini 3 Pro18. Nov. 2025n/a (Preview)GPQA 91,9 %, SWE 76,2 %, 1501 Elo
Gemini 3 Deep Think4. Dez. 2025Nur AI UltraARC-AGI-2 45,1 %
Gemini 3 Flash17. Dez. 2025$0.50 / $3.00SWE-Bench 78 %

Wie sich die 3.0-Generation heute hält

Die 3.0-Modelle führten die Architektur und die Langkontext-Arbeit ein, auf der spätere Versionen aufbauten. Die meisten wurden inzwischen von 3.1 und den neueren Flash-Releases abgelöst, also behandle 3.0 als Fundament und nicht als Modell, das du heute wählen würdest.

Gemini 3.1 Pro: das nutzbare Flaggschiff

Gemini 3.1 Pro, veröffentlicht am 19. Februar 2026, ist das Modell für maximale Leistungsfähigkeit. Es nutzt ein Sparse-Mixture-of-Experts-Design, verarbeitet ein Kontextfenster von 1 Million Token und gibt bis zu 64.000 Token in einer einzelnen Antwort aus. Es erzielt 94,3 % bei GPQA Diamond und 80,6 % bei SWE-Bench Verified, beides Googles eigene Angaben. Die unabhängige Messung ist weniger wohlwollend: Beim Artificial Analysis Intelligence Index v4.3.2, ausgelesen am 25. September 2026, landet es bei 29,7, hinter den aktuellen Flaggschiffen von OpenAI und Anthropic und, für Google noch unangenehmer, elf Punkte hinter dem eigenen Gemini 3.8 Flash mit 40,9. Googles eigenes Gemini 4 Argon liegt inzwischen mit 52,6 weit über beiden, kann aber bisher nur von Fairwind-Programm-Partnern genutzt werden.

Gemini 3.1 Pro: technische Daten und Preise

EigenschaftGemini 3.1 Pro
Veröffentlicht19. Februar 2026
Kontext / max. Ausgabe1M / 64K Token
Preis (Text)$2.00 / $12.00 pro 1M, ein Tarif
Preis (Bildausgabe)$120.00 pro 1M, etwa $0.134 pro 1K/2K-Bild
GPQA Diamond94,3 % (Google)
SWE-Bench Verified80,6 % (Google)
AA Intelligence Index v4.3.229,7 (ausgelesen 25. Sep. 2026)

Wann du 3.1 Pro nutzen solltest

Es ist die richtige Wahl für komplexes Reasoning, lange Dokumentenanalyse, Recherche und die schwierigsten agentenbasierten Coding-Aufgaben. Da Google die Pro-Stufe seit Februar nicht aktualisiert hat, bleibt 3.1 Pro wahrscheinlich das stärkste nutzbare Gemini, bis Gemini 4 Argon über Googles Fairwind-Partner hinaus öffnet.

Gemini 3.5 Flash und Flash-Lite: die Arbeitstiere der Jahresmitte 2026

Gemini 3.5 Flash kam bei Google I/O am 19. Mai 2026 heraus, zu $1.50 / $9.00 pro 1 Million Token mit einem Kontextfenster von 1 Million Token, und schlug trotz seiner Einstufung als Flash-Modell auffallend oft 3.1 Pro bei Coding- und Agenten-Benchmarks. Es diente als Alltagsarbeitstier, bis 3.6 es im Juli ablöste.

Gemini 3.5 Flash-Lite: der Budget-Champion

Gemini 3.5 Flash-Lite, veröffentlicht am 21. Juli zu $0.30 / $2.50 pro 1 Million Token, ist der aktuelle Budget-Champion. Google sagt, es schlage das ältere, größere Gemini 3 Flash bei einigen Bewertungen klar, darunter SWE-Bench Pro und OSWorld-Verified, was es zu einer starken Preis-Leistungs-Wahl für Arbeiten mit hohem Volumen macht.

ModellVeröffentlichtPreis (Ein-/Ausgabe pro 1M)KontextAnmerkung
Gemini 3.5 Flash19. Mai 2026$1.50 / $9.001MSchlug 3.1 Pro bei Coding-Bewertungen
Gemini 3.5 Flash-Lite21. Jul. 2026$0.30 / $2.501MGünstigstes aktuelles Modell

Warum die Flash-Kombination wichtig ist

Genau diese Kombination ist der Clou. Flash deckt qualitativ hochwertige Alltagsarbeit ab, während Flash-Lite die hochvolumigen, kostensensiblen Aufgaben übernimmt, und beide halten ein volles Fenster von einer Million Token. Als 3.6 Flash im Juli kam, setzte es sich über 3.5 Flash, 3.7 Flash übernahm die Spitze der Flash-Reihe drei Wochen später, und 3.8 Flash übernahm sie drei Wochen danach, während Flash-Lite durchgehend die Preisuntergrenze blieb.

Gemini 3.8 Flash: das aktuelle Arbeitstier

Gemini 3.8 Flash wurde am 2. September 2026 allgemein verfügbar, drei Wochen nach 3.7 Flash und Googles drittes Flash-Release in 43 Tagen. Jede Zeile des Datenblatts bleibt unverändert zum Vorgänger: dasselbe Kontextfenster von 1 Million Token, dasselbe Ausgabelimit von 64.000 Token, derselbe Wissensstand von März 2026, dieselbe Liste der Modalitäten und derselbe Startpreis. Das ganze Release dreht sich darum, was das Modell innerhalb dieses Rahmens leistet, und Google hat dieses Modell für langfristige Agenten statt für den reinen Coding-Fokus von 3.7 abgestimmt.

Gemini 3.8 Flash: Preise und Benchmark-Fortschritte

Der Preis hat sich nicht verändert. 3.8 Flash listet zum selben Einführungspreis von $0.75 / $3.75 pro 1 Million Token wie 3.7 und 3.6 Flash, und es trägt dieselbe Fußnote: Am 1. Januar 2027 steigen alle drei auf $1.50 / $7.50. Es schlägt 3.7 Flash in jeder von Google veröffentlichten Zeile, mit den größten Fortschritten bei BioMysteryBench Human Difficult (43,5 % auf 56,5 %), Terminal-bench 4.0 (11,2 % auf 19,1 %) und DeepSWE v1.1 (65,3 % auf 73,7 %). Es hat das Feld nicht komplett dominiert: In Googles eigenem Launch-Vergleich vom September 2026 gewann Claude Opus 5 die schwersten Agenten-Tests, mit Terminal-bench 4.0 51,8 % gegen 19,1 % und OSWorld-2.0 75,4 % gegen 59,0 %. Anthropic hat Opus 5 inzwischen durch Opus 5.5 ersetzt und Opus 5 auf seine Legacy-Liste verschoben, also lies dieses Paar als den Vergleich, den Google zum Start veröffentlichte, nicht als aktuellen Stand der Technik. Unsere Gemini 3.8 Flash-Analyse enthält die vollständige 14-Zeilen-Tabelle und die vielfach weiterverbreitete Benchmark-Zahl, die sich als falsch herausstellte.

EigenschaftGemini 3.8 Flash
Veröffentlicht2. September 2026
Preis$0.75 / $3.75 pro 1M (Einführungspreis, verdoppelt sich am 1. Januar 2027)
Kontext1M Token Eingabe, 64K Ausgabe
AA Intelligence Index v4.3.240,9 bei hoher Reasoning-Einstellung, gegenüber 39,1 für 3.7 Flash (ausgelesen 25. Sep. 2026)
DeepSWE v1.165,3 % auf 73,7 %
Terminal-bench 4.011,2 % auf 19,1 %
BioMysteryBench (schwer)43,5 % auf 56,5 %

Gemini 3.7 Flash: das vorherige Arbeitstier

Gemini 3.7 Flash kam am 13. August 2026 heraus, nur 23 Tage nach 3.6 Flash, in AI Studio, der Gemini API, Android Studio und der Gemini Enterprise Agent Platform, mit demselben Kontextfenster von 1 Million Token und demselben Ausgabelimit von 64.000 Token wie sein Vorgänger. Anders als das 3.6-Release war das hier ein echter Fähigkeitssprung statt eines reinen Effizienzschritts: Die Coding- und Agentenwerte legten in drei Wochen deutlich zu. Es hielt die Spitze der Flash-Reihe genau drei Wochen, bevor 3.8 Flash es zum selben Preis ablöste.

Gemini 3.7 Flash: Preise und Benchmark-Fortschritte

Der Preis halbierte sich auf $0.75 / $3.75 pro 1 Million Token, und Google setzte 3.6 Flash auf denselben Tarif, auf dem später auch 3.8 Flash landete, sodass alle drei heute gleich viel kosten. Lies die Fußnote, bevor du planst: Diese Tarife sind Einführungspreise und laufen am 31. Dezember 2026 aus, im Januar steigen sie auf $1.50 / $7.50. Bei den Benchmarks kletterte DeepSWE v1.1 von 49,0 % auf 65,3 %, und AutomationBench verdoppelte sich fast von 17,0 % auf 30,4 %. Das vollständige Bild, einschließlich der von Google gesperrten Regionen, liefert unsere Gemini 3.7 Flash-Analyse.

EigenschaftGemini 3.7 Flash
Veröffentlicht13. August 2026
Preis$0.75 / $3.75 pro 1M (Einführungspreis, verdoppelt sich am 1. Januar 2027)
Kontext1M Token Eingabe, 64K Ausgabe
AA Intelligence Index v4.3.239,1, gegenüber 34,0 für 3.6 Flash (ausgelesen 25. Sep. 2026)
FrontierCode 1.1 Main34,4 % auf 43,6 %
DeepSWE v1.149,0 % auf 65,3 %
AutomationBench17,0 % auf 30,4 %

Gemini 3.6 Flash: das vorherige Arbeitstier

Gemini 3.6 Flash erschien am 21. Juli 2026 und bleibt nur bis zum 9. Oktober 2026 Standard der kostenlosen Gemini-App, danach wechseln Gratiskonten zu Flash-Lite, mit einem Kontextfenster von 1 Million Token. Es ist ein Effizienz-Upgrade, keine neue Grenzstufe. Es nutzt im Artificial Analysis Index etwa 17 % weniger Ausgabe-Token als 3.5 Flash, mit Reduzierungen von bis zu 65 % bei einigen langfristigen Engineering-Aufgaben.

Gemini 3.6 Flash: Preise und Benchmark-Fortschritte

Die Preisänderung zum Start wurde oft falsch wiedergegeben. Die Senkung betraf nur die Ausgabe: Die Ausgabe fiel von $9.00 auf $7.50 pro 1 Million Token, während die Eingabe konstant bei $1.50 blieb. Google hat das Modell inzwischen erneut gesenkt, auf $0.75 / $3.75, um es an Gemini 3.7 Flash anzupassen. Bei den Benchmarks stieg DeepSWE von 37 % auf 49 %, MLE-Bench von 49,7 % auf 63,9 % und OSWorld-Verified von 78,4 % auf 83,0 %, laut Googles Ankündigung. Für eine tiefere Betrachtung dieses Releases siehe unsere vollständige Gemini 3.6 Flash-Analyse.

EigenschaftGemini 3.6 Flash
Veröffentlicht21. Juli 2026
Preis$0.75 / $3.75 pro 1M (gesenkt auf den Stand von 3.7 Flash; Start bei $1.50 / $7.50)
Kontext1M Token
AA Intelligence Index34,0 bei v4.3.2, ausgelesen 25. Sep. 2026 (bei der eingestellten v4.1.1 waren es 52)
DeepSWE37 % auf 49 %
MLE-Bench49,7 % auf 63,9 %
OSWorld-Verified78,4 % auf 83,0 %

Gemini API-Preise im Vergleich (2026)

Bei den Preisen wird die Stufentrennung praktisch spürbar. Flash und Flash-Lite sind für Volumen gebaut, während Pro mehr kostet und für die Aufgaben reserviert ist, die das rechtfertigen. Die Tabelle unten zeigt die aktuellen API-Tarife pro 1 Million Token.

ModellEingabe (pro 1M)Ausgabe (pro 1M)Kontext
Gemini 3.8 Flash$0.75$3.751M
Gemini 3.7 Flash$0.75$3.751M
Gemini 3.6 Flash$0.75$3.751M
Gemini 3.5 Flash$1.50$9.001M
Gemini 3.5 Flash-Lite$0.30$2.501M
Gemini 3.1 Pro$2.00$12.001M

Für die meisten Workloads liefert Gemini 3.8 Flash inzwischen die besten Ergebnisse in der Flash-Reihe, und weil 3.6 und 3.7 Flash auf demselben Tarif liegen, gibt es kein Preisargument, um bei einem älteren Modell zu bleiben. Alle drei Flash-Tarife sind Einführungspreise und verdoppeln sich am 1. Januar 2027. Wer riesige Mengen einfacherer Anfragen verarbeitet, senkt mit 3.5 Flash-Lite die Kosten weiter, bei überraschend starker Qualität.

Die Pro-Stufe wurde früher nach Prompt-Größe abgerechnet, mit einem zweiten Tarif ab 200.000 Token. Das ist nicht mehr so. Googles aktuelle API-Preiskarte listet für Gemini 3.1 Pro einen Texttarif, $2.00 / $12.00, über die Tabellen Standard, Batch, Flex und Priority hinweg, ohne Aufteilung nach Langkontext; die Stufe von $4.00 / $18.00, die dieser Leitfaden früher zeigte, ist verschwunden. Was Pro weiterhin separat bepreist, ist die Bildausgabe, zu $120 pro 1 Million Token, was etwa $0.134 pro 1K- oder 2K-Bild und $0.24 pro 4K-Bild ergibt. Batch und Flex halbieren den Texttarif auf $1.00 / $6.00.

Wie Gemini in der App erscheint (Gratis, Plus, Pro, Ultra)

Die meisten Menschen kommen nie mit der API in Kontakt. In der Gemini-App erscheinen die Modelle als Verbraucherpläne statt als Versionsnummern, und welches Release du bekommst, hängt davon ab, was du zahlst. Ab dem 9. Oktober 2026 läuft der Gratis-Plan nur noch mit Gemini Flash-Lite, AI Plus fügt Flash hinzu, und nur AI Pro und Ultra erreichen das Pro-Reasoning-Modell, sodass die bezahlten Stufen jetzt sowohl Modelle als auch höhere Nutzungsgrenzen und die aufwendigeren Funktionen kaufen. Beachte, dass keines der beiden neueren Flash-Releases als eigene Plan-Stufe erscheint: 3.7 Flash erreicht App-Nutzer nur innerhalb von Spark, das AI Pro oder Ultra voraussetzt, und für 3.8 Flash wird berichtet, dass es an AI Pro- und Ultra-Abonnenten ausgerollt wird, obwohl die Gemini-Apps-Release-Notes bislang keinen Eintrag dafür enthalten.

PlanPreis / MonatModellzugang und Funktionen
Gratis$0Nur Gemini Flash-Lite ab 9. Okt. (davor 3.6 Flash und wechselnd 3.1 Pro)
Google AI Plus$4.99Flash-Lite und Flash, Pro im Oktober entfernt; doppelt so hohe Grenzen wie Gratis, Videogenerierung, Daily Brief
Google AI Pro$19.994-fach höhere Grenzen, höherer Zugang zum Gemini 3.1 Pro-Reasoning, Deep Research, Agentenfunktionen, Gemini Spark in über 160 Ländern
Google AI Ultra$99.99 bis $199.99Höchster 3.1 Pro-Zugang, Deep Think, Gemini Spark, Veo 3.1, bis zum 20-Fachen der Grenzen des Pro-Plans

Die praktische Lesart ist einfach. Willst du nur einen schnellen Assistenten für Alltagsfragen, deckt das weiterhin der Gratis-Plan ab, allerdings läuft er ab dem 9. Oktober mit Flash-Lite, weshalb AI Plus zu $4.99 der günstigste Weg ist, Flash zu behalten. Steig auf AI Pro um für schwereres Reasoning, Deep Research und den Gemini Spark-Agenten, der Pro in den USA am 23. Juli 2026 und in mehr als 160 weiteren Ländern am 30. Juli erreichte. Nur die AI Ultra-Pläne fügen Deep Think hinzu. Spark ist im EWR, in Großbritannien, der Schweiz und Nigeria überhaupt nicht verfügbar.

Gemini-Benchmarks im Vergleich

Benchmarks erzählen dieselbe Geschichte der getrennten Entwicklungslinien, und zwar inzwischen deutlich lauter als früher. Beim Artificial Analysis Intelligence Index v4.3.2, einer Zusammensetzung aus zehn Bewertungen, setzt sich die Flash-Reihe nicht bloß knapp gegen das ältere Pro durch, sie schlägt es klar. Gemini 3.8 Flash erzielt bei hoher Reasoning-Einstellung 40,9 und Gemini 3.7 Flash 39,1, gegenüber 29,7 für das Flaggschiff Gemini 3.1 Pro. Gemini 3.6 Flash liegt bei 34,0, Gemini 3.5 Flash bei 32,6 und das Budget-Modell Gemini 3.5 Flash-Lite bei 22,2. Jedes dieser Modelle außer Flash-Lite ist ein Flash-Modell, das dem Pro-Modell voraus ist.

Eine Warnung zu jeder Artificial-Analysis-Zahl, die du für Gemini zitiert siehst, einschließlich der Zahlen, die dieser Leitfaden bis September 2026 geführt hat. AA hat seinen Index in sieben Wochen viermal neu skaliert, über v4.1.1, v4.2, v4.3 und v4.3.2, und jede Neuskalierung verschob alle Werte auf einmal, ohne dass sich ein Modell geändert hätte. Gemini 3.8 Flash erzielte bei v4.1.1 59 und erzielt bei v4.3.2 40,9; am Modell selbst wurde nichts schlechter. Die Zahlen auf dieser Seite wurden alle am 25. September 2026 auf den AA-Modellseiten neu ausgelesen und gelten durchgängig für v4.3.2, sie sind also untereinander vergleichbar, aber mit nichts, was vor September veröffentlicht wurde. Beachte außerdem, dass der Tooltip von AAs Ranking weiterhin v4.3 angibt, während die einzelnen Modellseiten v4.3.2 angeben; die Modellseiten sind die vertrauenswürdige Quelle. Behandle jede nackte Indexzahl ohne Versionsangabe als unbrauchbar.

ModellAA Intelligence Index (v4.3.2, 25. Sep. 2026)Ausgabegeschwindigkeit (Token/Sek.)
Gemini 3.8 Flash40,9 (hoch)304,6
Gemini 3.7 Flash39,1 (hoch)279,4
Gemini 3.6 Flash34,0 (hoch)210,0
Gemini 3.5 Flash32,6 (hoch)189
Gemini 3.1 Pro29,7113
Gemini 3.5 Flash-Lite22,2463

Zwei Details lohnen sich hervorzuheben. Erstens ist die Flash-Reihe nicht mehr flach: Bei v4.1 erzielten 3.5 und 3.6 Flash beide 50 Punkte, bei v4.3.2 trennen sie sich auf 32,6 und 34,0, während 3.7 und 3.8 sich weiter absetzen. Zweitens ist Gemini 3.1 Pro das drittlangsamste und viertbestbewertete Modell in der Tabelle seiner eigenen Familie, eine ungewöhnliche Position für ein Flaggschiff. Die eigenen Fortschritte von Gemini 3.6 zeigen sich weiterhin vor allem bei Effizienz und agentenbasiertem Coding, mit zweistelligen Sprüngen bei DeepSWE und MLE-Bench, während es etwa 17 % weniger Ausgabe-Token als 3.5 Flash nutzt. Bei reiner Geschwindigkeit spielt Flash-Lite mit 463 Token pro Sekunde in einer eigenen Klasse, gegenüber 189 für 3.5 Flash und 113 für 3.1 Pro.

Benchmark-Fortschritt über die gesamte Gemini-Familie

Verfolgt man einige Schlüssel-Benchmarks über die Releases hinweg, zeigen sich die beiden Entwicklungslinien deutlich. Die Pro-Reihe klettert stetig bei den schwierigsten Reasoning- und Coding-Tests, während die Flash-Reihe das Flaggschiff beim zusammengesetzten Index unauffällig einholt. Leere Zellen bedeuten, dass Google oder Artificial Analysis diese Zahl für das Modell nicht veröffentlicht hat.

Benchmark2.5 Pro3 Pro3.1 Pro3.5 Flash3.6 Flash3.8 Flash
GPQA Diamondn/a91,9 %94,3 %n/an/an/a
SWE-Bench Verified63,8 %76,2 %80,6 %n/an/an/a
AA Index v4.3.2n/an/a29,732,634,040,9
DeepSWEn/an/an/a37 %49 %73,7 % (v1.1)

Liest man die Pro-Spalten, ist der Trend ein klarer Anstieg bei Googles eigenen Bewertungen, GPQA Diamond von 91,9 % auf 94,3 % und SWE-Bench Verified von 63,8 % über 76,2 % auf 80,6 %. Liest man quer über die AA-Zeile, kehrt sich die Geschichte um: Flash hat den Abstand nicht nur verkürzt, sondern überholt, von 32,6 auf 40,9, während das Flaggschiff bei 29,7 liegt. Die ehrliche Lesart ist, dass sich die beiden Messungen widersprechen, weil sie unterschiedliche Dinge messen. Googles Zahlen sind Einzelbewertungen zu Reasoning und Code, bei denen 3.1 Pro tatsächlich führt; AAs zusammengesetzter Index bündelt zehn Bewertungen einschließlich Langkontext-Dokumentenarbeit und Agentenaufgaben, und auf dieser Basis verliert ein sieben Monate altes Pro-Modell gegen ein drei Wochen altes Flash-Modell. Sieht deine Arbeit wie GPQA aus, nimm Pro. Sieht sie wie alles andere aus, nimm Flash.

Welches Gemini-Modell solltest du nutzen?

Für die meisten Menschen ist Gemini 3.8 Flash die richtige Standardwahl. Es ist schnell, bis Januar günstig zu $0.75 / $3.75 pro 1 Million Token, und bewältigt Coding und Alltagsaufgaben gut. Steig auf Gemini 3.1 Pro um für das schwierigste Reasoning und lange Dokumente, und wechsle zu Gemini 3.5 Flash-Lite, wenn die Kosten am wichtigsten sind. Die Tabelle unten ordnet gängige Aufgaben dem passenden Modell zu.

Deine AufgabeBestes ModellWarum
Alltagschat und SchreibenGemini 3.8 FlashSchnell, günstig, starke allgemeine Qualität
Allgemeines CodingGemini 3.8 FlashGrößte Fortschritte bei agentenbasiertem Coding (DeepSWE v1.1 73,7 %)
Schwierigstes Reasoning und RechercheGemini 3.1 ProHöchste Werte, GPQA 94,3 % und SWE 80,6 %
Lange DokumentenanalyseGemini 3.1 Pro1M Kontext mit dem tiefsten Reasoning
Arbeit mit hohem Volumen und BudgetGemini 3.5 Flash-Lite$0.30 / $2.50 und mit 463 Tok/s am schnellsten
Arbeit an SicherheitslückenGemini 3.8 Flash CyberGoogles aktueller Sicherheitsspezialist, erschienen am 2. September 2026 im Rahmen des Fairwind-Programms; löst 3.5 Flash Cyber ab

Wenn Programmieren deine Hauptaufgabe ist, ist 3.8 Flash die Preis-Leistungs-Wahl und 3.1 Pro die Obergrenze für die schwierigsten Probleme. Eine Einschränkung für Nicht-Entwickler: Weder 3.7 noch 3.8 Flash ist in der Gemini-App kostenlos, und ab dem 9. Oktober 2026 antwortet dir die kostenlose Stufe nur noch mit Flash-Lite. Für einen breiteren Blick darauf, welches Modell zu welcher Aufgabe passt, über Anbieter hinweg, deckt unser Leitfaden wann du welches KI-Modell nutzen solltest das gesamte Feld ab.

Wie Gemini gegen ChatGPT und Claude abschneidet

Googles Strategie unterscheidet sich von der seiner Konkurrenten. Statt einem einzelnen Flaggschiff mit maximalem Benchmark-Wert nachzujagen, optimiert Google auf praktische Vielseitigkeit, Multimodalität und tiefe Integration über Search, Workspace und Android. Deshalb bekommt die Flash-Stufe so viel Aufmerksamkeit: Es ist das Modell, das die meisten Menschen tatsächlich jeden Tag nutzen. Für die Claude-Seite in voller Länge siehe den ultimativen Claude-Modellvergleich.

FlaggschiffAA Index (v4.3.2, 25. Sep. 2026)Kontext / AusgabePreis (Ein-/Ausgabe pro 1M)Veröffentlicht
Gemini 3.1 Pro29,71M / 64K$2.00 / $12.00Feb. 2026
GPT-6 Astra52,7 (max)1,05M / 128K$10.00 / $50.00Sep. 2026
Claude Opus 5.557,6 (max)1M / 128K$4.00 / $20.00Sep. 2026
Gemini 4 Argon (nur Fairwind-Partner)52,6 (hoch)1M / 1M$2.00 / $10.00 Einführung, dann $4.00 / $20.00Sep. 2026
Gemini 3.8 Flash, zum Vergleich40,9 (hoch)1M / 64K$0.75 / $3.75Sep. 2026

Das ist die Tabelle, die sich seit dem Sommer am stärksten bewegt hat, und nicht zu Googles Gunsten. Beide Konkurrenten ersetzten ihre Flaggschiffe im September 2026, und Googles Antwort kam erst am 30. September, in begrenzter Freigabe. Bei v4.3.2 liegt es hinter GPT-6 Astra mit 52,7 und Claude Opus 5.5 mit 57,6 zurück, und zwar um 23 und 28 Punkte, während der alte v4.1-Wert den Abstand noch bei 13 bis 15 Punkten ansetzte. Was übrig bleibt, ist das Preisargument, und es ist stärker als zuvor: Gemini 3.1 Pro kostet ein Fünftel des Eingabepreises und ein Viertel des Ausgabepreises von Astra sowie die Hälfte der Eingabe von Opus 5.5. Googles neues Flaggschiff, Gemini 4 Argon, schließt den größten Teil des Punkteabstands mit 52,6, knapp hinter Astra, kann aber bisher nur von Cyberverteidigern des Fairwind-Programms genutzt werden. Unter den Geminis, die du heute abrufen kannst, ist Googles eigentliche Antwort auf beide gar nicht seine Pro-Stufe. Es ist Gemini 3.8 Flash, das mit 40,9 mehr erzielt als Pro, zu $0.75 / $3.75, und das ist die Zeile, die ein Vergleich von Kosten pro Qualität eigentlich heranziehen sollte.

Alle drei Flaggschiffe verarbeiten inzwischen rund eine Million Token Kontext, sodass der eigentliche Zielkonflikt Reasoning-Tiefe und Preis betrifft statt Fenstergröße. Ein praktischer Unterschied: OpenAI und Anthropic erlauben mit 128.000 Ausgabe-Token deutlich längere Einzelantworten als Geminis 64.000, was bei großer Codegenerierung oder langen Berichten eine Rolle spielt. Gemini 4 Argon kehrt das mit bis zu 1 Million Ausgabe-Token um, sobald du es nutzen kannst.

Bei Googles eigenen Bewertungen tritt 3.1 Pro gegen die besten GPT-6- und Claude-5-Modelle an, ohne das Feld anzuführen; beim unabhängigen zusammengesetzten Index tritt es gegen sie gar nicht an, und Flash ist es, das über seiner Preisklasse punktet. Das vollständige Bild über alle Anbieter hinweg zeigen unser Vergleich der besten KI-Modelle und die ausführliche Gemini 3.5-Bewertung.

Was als Nächstes für Gemini kommt (3.5 Pro und Gemini 4)

Das Erste ist Gemini 3.5 Pro, weiterhin im Partnertest festhängend, nachdem Google seine eigenen internen Ziele verpasst hat. Im Juli sagte das Produktteam nur, es hoffe, das Modell komme „bald“, und im September sagte Koray Kavukcuoglu von Google DeepMind, Google habe „ein kleines Stück zurückgetreten“, um sich auf Flash zu konzentrieren. Google hat nicht gesagt, ob 3.5 Pro überhaupt noch erscheint.

Das Zweite ist teilweise schon da. Google bestätigte im Juli, dass es seinen „bisher ambitioniertesten Pretraining-Lauf“ für Gemini 4 begonnen habe, und am 30. September 2026 kündigte es Gemini 4 Argon an, das erste Gemini-4-Modell. Es wird zuerst an Cyberverteidiger in Googles Fairwind-Programm ausgerollt, dann an zahlende API-Kunden und Google-AI-Ultra-Abonnenten, ohne Datum für beides, sodass die Übersicht oben noch eine Weile das bleibt, womit die meisten Menschen arbeiten.

Jedes Top-Modell der Gemini-Klasse nutzen, ohne eine Version festzulegen

Das Versionslabyrinth, das dieser Artikel gerade abgebildet hat, sind die wahren Kosten der Wahl einer Gemini-Stufe. Google AI Pro kostet $19.99 im Monat und antwortet dir trotzdem mit dem Release, das die App gerade entscheidet, und auf der API-Seite behältst du im Blick, welcher Flash-Tarif ein Einführungspreis ist und welche Pro-Schwelle deine Rechnung verdoppelt.

Fello AI ist eine native Mac-, iPhone- und iPad-App, die dir Gemini über ein einziges Abo gibt, zusammen mit ChatGPT, Claude, Grok, DeepSeek, Perplexity, Kimi, GLM und Qwen. Sie startet bei $9.99 im Monat, halb so viel wie Google AI Pro, mit einer Gratisversion zum Ausprobieren und einer Bewertung von 4,7 Sternen bei über 27.000 Rezensionen. Die aktuell öffentlich verfügbaren Gemini-Modelle sind einfach da, wenn du die App öffnest, und du kannst dieselbe Frage im selben Gespräch an ein konkurrierendes Modell stellen, statt dich auf eine Version und eine Preistabelle festzulegen.

Fazit

Der ehrliche Gemini-Modellvergleich für 2026 ist die Geschichte zweier Entwicklungslinien. Flash ist bis 3.8 gesprintet, drei Releases in 43 Tagen und günstiger als je zuvor, während Pro bei 3.1 steht und 3.5 Pro weiterhin nicht erschienen ist. Für fast jeden gilt: Starte mit Gemini 3.8 Flash, steige für die schwierigste Arbeit auf 3.1 Pro um und wechsle zu 3.5 Flash-Lite, wenn das Budget entscheidet. Da Gemini 4 Argon am 30. September angekündigt wurde, aber auf Fairwind-Partner begrenzt ist, erwarte, dass sich die Übersicht noch einmal verschiebt, sobald es sich für zahlende API-Kunden und Google-AI-Ultra-Abonnenten öffnet.

FAQ

Gibt es ein Gemini 3.5 Pro?

Nein. Stand September 2026 ist Gemini 3.5 Pro nicht erschienen und hat keinen Eintrag im API-Änderungsprotokoll. Google testet es weiterhin mit Partnern nach internen Verzögerungen, weshalb das aktuelle Pro-Flaggschiff weiterhin Gemini 3.1 Pro von Februar 2026 ist. Die Flash-Reihe ist währenddessen bis zu 3.8 Flash vorangeschritten. Googles nächstes Flaggschiff war schließlich Gemini 4 Argon, angekündigt am 30. September 2026.

Welches Gemini-Modell sollte ich nutzen?

Für die meisten Menschen ist Gemini 3.8 Flash die beste Standardwahl, weil es schnell, zu $0.75 / $3.75 pro 1 Million Token günstig und das stärkste Flash-Release bei Coding und Agentenarbeit ist. Wähle Gemini 3.1 Pro für das schwierigste Reasoning und lange Dokumente, und Gemini 3.5 Flash-Lite, wenn du die niedrigsten Kosten brauchst.

Was ist der Unterschied zwischen Gemini 3.5 Flash und 3.6 Flash?

Gemini 3.6 Flash löste 3.5 Flash als Arbeitstier ab. Es nutzt etwa 17 % weniger Ausgabe-Token, senkte den Ausgabepreis zum Start von $9 auf $7.50 pro 1M, während die Eingabe bei $1.50 blieb, und erzielte große Fortschritte beim Coding, etwa DeepSWE von 37 % auf 49 %. Es war ein Effizienz-Upgrade, keine neue Grenzstufe, und läuft inzwischen zu $0.75 / $3.75 neben Gemini 3.7 Flash und Gemini 3.8 Flash.

Was ist der Unterschied zwischen Gemini 3.7 Flash und 3.8 Flash?

Nichts beim Datenblatt und nichts beim Preis. Gemini 3.8 Flash, veröffentlicht am 2. September 2026, hat dasselbe Kontextfenster von 1 Million Token, dasselbe Ausgabelimit von 64.000 Token, denselben Wissensstand von März 2026 und denselben Einführungstarif von $0.75 / $3.75 wie 3.7 Flash. Der Unterschied liegt in der gemessenen Qualität: Es schlägt 3.7 Flash in jeder von Google veröffentlichten Benchmark-Zeile, mit DeepSWE v1.1 von 65,3 % auf 73,7 % und Terminal-bench 4.0 von 11,2 % auf 19,1 %. Da der Preis identisch ist, gibt es keinen Grund, ein neues Projekt mit 3.7 Flash zu starten.

Welche Gemini-Modelle enthalten die App-Pläne?

Ab dem 9. Oktober 2026 läuft der Gratis-Plan nur noch mit Gemini Flash-Lite, AI Plus fügt Flash hinzu, und AI Pro und Ultra fügen 3.1 Pro und Deep Think hinzu. Google AI Pro zu $19.99 erhöht die Grenzen und gibt höheren Zugang zum Pro-Reasoning-Modell plus Deep Research, und die AI-Ultra-Pläne, von $99.99 bis $199.99, fügen Deep Think hinzu. Gemini Spark ist in den USA und in über 160 weiteren Ländern auf AI Pro verfügbar, aber nicht im EWR, in Großbritannien, der Schweiz oder Nigeria.

Was ist das günstigste Gemini-Modell?

Gemini 3.5 Flash-Lite, veröffentlicht am 21. Juli 2026, ist mit $0.30 Eingabe und $2.50 Ausgabe pro 1 Million Token das günstigste aktuelle Modell. Google sagt, es schlage das ältere Gemini 3 Flash bei einigen Coding- und Agenten-Benchmarks, was es zu einer starken Wahl für Arbeiten mit hohem Volumen macht.

Ist Gemini 4 schon verfügbar?

Es ist da, in begrenzter Form. Google kündigte Gemini 4 Argon, das erste Gemini-4-Modell, am 30. September 2026 an, aber bisher können nur Cyberverteidiger in seinem Fairwind-Programm es nutzen. Zahlende API-Kunden und Google-AI-Ultra-Abonnenten folgen als Nächstes, ohne Datum, und Gemini 3.5 Pro ist weiterhin nicht erschienen.