OpenAI verkauft inzwischen drei GPT-6-Modelle, Astra seit dem 3. September 2026 sowie GPT-6 Sol und GPT-6 Luna seit dem 22. September, und keines davon hat das Unterhaltungsfenster von ChatGPT übernommen. Chat läuft weiterhin auf GPT-5.6, öffentlich seit dem 9. Juli 2026, und GPT-6 erreicht es dort nur als Pro-Option in den Plänen Pro, Business und Enterprise. Das Flaggschiff Sol erzielt 88,8 % auf Terminal-Bench 2.1 (und 91,9 % im Sol-Ultra-Modus mit höchstem Aufwand), übertrifft GPT-5.5s eigene 88,0 % auf demselben Agentic-Coding-Test und wird zusammen mit zwei günstigeren Stufen, Terra und Luna, veröffentlicht, die die Vorgängergeneration beim Preis unterbieten.

In weniger als einem Jahr hat OpenAI sieben unterschiedliche Versionen von GPT-5 veröffentlicht, jede mit eigener Identität und eigenem Preispunkt. Wenn du den Überblick verloren hast, was GPT-5.0 von GPT-5.6 unterscheidet: Dieser Leitfaden behandelt jedes Modell der Familie, Erscheinungsdaten, Kontextfenster, Benchmarks, Preise und die wesentlichen Unterschiede, auf die es wirklich ankommt. GPT-5.6 erschien zuerst am 26. Juni als regierungsbeschränkte Vorschau für etwa 20 Organisationen und wurde am 9. Juli vollständig öffentlich. Es treibt jetzt die Reasoning-Optionen in ChatGPTs bezahlten Plänen an und ist über die API vollständig verfügbar. Wir ordnen auch ein, wo die drei GPT-6-Modelle landen und welches davon dein Plan tatsächlich öffnen kann. Wer neu bei ChatGPT ist: Unser ChatGPT-Leitfaden für Einsteiger ist ein guter Startpunkt, bevor du Modellunterschiede vergleichst.

Die wichtigsten Punkte

  • GPT-5.6 (öffentlich ab 9. Juli 2026) ist das, was das Unterhaltungsfenster von ChatGPT weiterhin in jedem Plan ausliefert, Sol in bezahlten Plänen und Luna bei Free und Go. Es erscheint in drei Stufen: Sol (Flaggschiff), Terra (ausgewogen) und Luna (günstigste), wobei Sol 88,8 % auf Terminal-Bench 2.1 und ein API-Kontextfenster von 1,05 Mio. Tokens erzielt.
  • GPT-5.5 (23. April 2026) ist das vorherige Flaggschiff und nach wie vor ein ausgezeichnetes Allround-Modell. Es erzielt 93,6 % auf GPQA Diamond und 78,7 % auf OSWorld-Verified, beides besser als GPT-5.4, und erscheint in zwei Varianten: GPT-5.5 Standard und GPT-5.5 Pro.
  • GPT-5.4 (5. März 2026) liegt zwei Generationen zurück, ist aber immer noch relevant. Es führte ein 1-Mio.-Token-Kontextfenster (nur API) und native Computernutzung ein, mit 75,0 % auf OSWorld-Verified und 57,7 % auf SWE-Bench Pro.
  • GPT-5.3 Instant (3. März 2026) behob den übermäßig vorsichtigen Ton und lieferte 26,8 % weniger Halluzinationen als GPT-5.2 mit aktivierter Websuche, ist aber nicht mehr auf OpenAIs API-Preisseite aufgeführt. Nur gpt-5.3-codex überlebt aus dieser Generation.
  • GPT-5.2 war das erste Modell, das 90 %+ auf ARC-AGI-1 (Pro) erzielte und ein perfektes 100 % auf AIME 2025 Mathematik erreichte.
  • GPT-5.1 führte adaptives Reasoning ein, 2 bis 3-mal schneller bei einfachen Aufgaben, bei gleichem Preis von $1.25 / $10 wie GPT-5.0.
  • Die Preise in GPT-5.6 sind nach Stufen aufgeteilt. Sol wurde am 21. August 2026 auf $4 / $20 pro 1 Mio. Tokens gesenkt und liegt damit unter GPT-5.5s $5 / $30, Terra fällt auf $2 / $12, und Luna kostet nur noch $0.20 / $1.20, nachdem OpenAI beide Stufen am 30. Juli 2026 gesenkt hat: Luna um 80 % und Terra um 20 %. OpenAI nennt Sols Tarif inzwischen promotional und garantiert ihn nur bis zum 21. November 2026.
  • 15 ältere Modell-Snapshots verloren am 23. Juli 2026 den API-Zugang, darunter fünf Codex-Snapshots und beide chat-latest-Aliase. Es ist eine reine API-Änderung; die ChatGPT-Modellauswahl bleibt unberührt.
  • GPT-6 Astra ist am 3. September 2026 erschienen. Es kostet $10 / $50 pro 1 Mio. Tokens, rund das 2,5-Fache von GPT-5.6 Sol, und erreichte ChatGPT schon am Tag darauf als GPT-6 Pro in den Plänen Pro, Business und Enterprise. Plus-Pläne bekommen Astra stattdessen in ChatGPT Work und Codex, Free und Go bekommen es gar nicht.
  • GPT-6 Sol und GPT-6 Luna folgten am 22. September 2026 zu $2 / $10 und $0.10 / $0.50, der Hälfte der entsprechenden GPT-5.6-Tarife. Sie laufen in ChatGPT Work, Codex und der API, und OpenAIs Release Notes sagen klar, dass sie von den in Chat verfügbaren Modellen getrennt sind.

Alle ChatGPT-5-Modelle im Überblick

Vom Herausgeber

Jedes KI-Modell in einer App

Fello AI vereint GPT-6, Claude 5, Gemini 3.8, Grok 4.7 und mehr in einer nativen App für Mac und iPhone.

Jetzt herunterladen!
Modell Erschienen Kontextfenster API-Preis (Input / Output) Am besten für
GPT-5.0 Aug 7, 2025 400K / 128K out $1.25 / $10 per 1M Allgemeine Nutzung, Ausgangsbasis
GPT-5.1 Nov 13, 2025 400K (272K in) $1.25 / $10 per 1M Adaptive Geschwindigkeit, Konversationsaufgaben
GPT-5.2 Dec 11, 2025 400K (272K in) $1.75 / $14 per 1M Tiefes Reasoning, Coding, Recherche
GPT-5.3 Instant Mar 3, 2026 400K ~$0.30 / ~$1.20 per 1M Alltägliches Schreiben, kostenbewusste Nutzung
GPT-5.4 Mar 5, 2026 1M (API only) $2.50 / $15 per 1M Agentische Arbeit, Computernutzung
GPT-5.5 Apr 23, 2026 1M (API only) $5 / $30 per 1M (Pro: $30 / $180) Agentisches Coding, Wissensarbeit
GPT-5.6 Jul 9, 2026 1.05M (128K out) Sol $4/$20, Terra $2/$12, Luna $0.20/$1.20 Agentisches Coding, Wissensarbeit: was ChatGPT in Chat weiterhin ausliefert

Ein Hinweis zu dieser Tabelle. Sie ist eine Geschichte der Familie, keine aktuelle Bestellliste. OpenAIs API-Preisseite führt die meisten dieser Modelle weiterhin, von gpt-5 samt Mini-, Nano- und Pro-Varianten über die GPT-5.4-Familie, GPT-5.5, GPT-5.5 Pro und die drei GPT-5.6-Stufen bis zu den drei GPT-6-Modellen, wobei gpt-5.3-codex separat unter Codex steht. Verschwunden ist allein das Standard-GPT-5.3. Was bleibt, läuft ab: das ursprüngliche gpt-5-2025-08-07 samt Mini-, Nano- und Pro-Varianten wird am 11. Dezember 2026 abgeschaltet. Die Preise unten sind aufgeführt, weil sie erklären, wie sich die Familie entwickelt hat, nicht weil du alle noch kaufen könntest.

Die GPT-6-Familie steht jetzt über jedem Modell in dieser Tabelle, und welcher Teil davon für dich erreichbar ist, hängt von der Oberfläche ab, nicht vom Preis. GPT-6 Astra erschien am 3. September 2026 für $10 / $50 pro 1 Mio. Tokens, mit demselben Kontextfenster von 1,05 Mio. Tokens und derselben Ausgabegrenze von 128K, und GPT-6 Sol ($2 / $10) und GPT-6 Luna ($0.10 / $0.50) folgten am 22. September zur Hälfte der entsprechenden GPT-5.6-Tarife. In ChatGPT selbst erscheint Astra als Pro-Option in den Plänen Pro, Business und Enterprise, während Sol und Luna in Work, Codex und der API bleiben. Unsere Berichterstattung zum Launch von GPT-6 Astra hat die vollständige Preis- und Benchmark-Aufschlüsselung.

Wie diese API-Preise auf ChatGPT-Abostufen (Free, Go, Plus, Pro, Business, Enterprise) abgebildet werden, erklärt unser ChatGPT-Preisleitfaden.

Download Fello AI to use all the best AI models, work with files and generate images, available on iPhone, iPad and Mac

GPT-5.0: Das Fundament

Erschienen: 7. August 2025

Das ursprüngliche GPT-5 war ein echter Sprung über GPT-4o, nicht nur bei rohen Benchmarks, sondern auch in der Architektur. Laut OpenAIs Launch-Ankündigung wurde es als einheitliches System gebaut, mit einem schnellen Basismodell für alltägliche Anfragen und einer tieferen Reasoning-Schicht (GPT-5 Thinking), die automatisch aktiviert wird, wenn die Anfrage es erfordert. Ein Echtzeit-Router entscheidet basierend auf Komplexität, Tool-Bedarf und Kontext, sodass du es nicht manuell steuern musst.

GPT-5.0 Benchmarks

Benchmark GPT-5.0 Ergebnis
AIME 2025 (Mathematik) 94,6 % ohne Tools; 100 % mit Python-Tools (Pro)
GPQA Diamond (Wissenschaft auf PhD-Niveau) 89,4 %
SWE-bench Verified (Coding) 74,9 %
Aider Polyglot (reales Coding) 88 %
Humanity's Last Exam 42 %
Halluzinationen Under 1% on open-source prompts; 1.6% on hard medical cases

GPT-5.0 erschien mit einem Kontextfenster von 400K Input / 128K Output und war für alle ChatGPT-Nutzer verfügbar; Pro-Abonnenten erhielten erweiterten Zugang zu erweitertem Reasoning.

API-Preis: $1.25 pro 1 Mio. Input-Tokens / $10 pro 1 Mio. Output-Tokens

Was sich gegenüber GPT-4o geändert hat

GPT-5 halluzinierte mit aktivierter Websuche etwa 45 % seltener als GPT-4o. Das einheitliche Routing eliminierte den manuellen Wechsel zwischen Chat- und Reasoning-Modus, ein Reibungspunkt, den viele Nutzer mit den o-Serien-Modellen hatten.

GPT-5.1: Schneller ohne Leistungseinbußen

Erschienen: 13. November 2025

Laut OpenAIs GPT-5.1-Ankündigung war GPT-5.1 kein Fähigkeitssprung, sondern ein Effizienz-Upgrade. Das Hauptmerkmal war adaptives Reasoning, bei dem das Modell den Rechenaufwand dynamisch nach Anfragekomplexität anpasst. Stelle eine einfache Frage, und es antwortet 2 bis 3-mal schneller als das Standardmodell. Stelle eine komplexe Frage, und es wechselt in den vollständigen Reasoning-Modus. Genau dieser Reasoning-Modus erklärt auch, warum leistungsstärkere Modelle sich träge anfühlen können; unser Leitfaden darüber, warum ChatGPT so langsam ist, erklärt, wann die Wartezeit am Modell liegt und wann du selbst etwas tun kannst.

OpenAI stimmte auch den Ton wärmer und gesprächiger ab, was die steife Förmlichkeit abbaute, die GPT-5.0 gelegentlich kalt wirken ließ. Es verwendete 30 % weniger Thinking-Tokens als seine Codex-Variante, bei nahezu identischen Benchmark-Werten bei den meisten Aufgaben.

GPT-5.1 Benchmarks

Benchmark oder Spezifikation GPT-5.1
AIME 2025 94 % (leicht unter GPT-5.0's 94,6 %)
GPQA Diamond 87 %
MMMU (multimodal) 85,4 %
SWE-Bench Verified 76,3 % (Codex-Max-Variante: 77,9 %)
Kontextfenster 400K Tokens (272K Input / 128K Output)
API-Preis $1.25 pro 1 Mio. Input / $10 pro 1 Mio. Output, wie GPT-5.0

GPT-5.1 Varianten

OpenAI lieferte eine vollständige Familie mit GPT-5.1: Instant (schnell), Thinking (tiefes Reasoning), Auto (Routing) und Pro (Forschungsqualität), plus drei Codex-Varianten: Standard-Codex, Codex-Mini für leichte Aufgaben und Codex-Max für agentische Coding-Aufgaben über 24+ Stunden. Alle drei Codex-Snapshots verlieren am 23. Juli 2026 den API-Zugang, mit gpt-5.5 als Ersatz für Codex und Codex-Max und gpt-5.4-mini für Codex-Mini.

Was GPT-5.1 richtig gemacht hat

Der Parameter reasoning_effort (none / low / medium / high) gab Entwicklern feinkörnige Kontrolle darüber, wie viel Rechenaufwand pro Anfrage investiert wird, ein praktisches Werkzeug für die Balance zwischen Kosten und Qualität im Produktionsbetrieb.

GPT-5.2: Der Reasoning-Meilenstein

Erschienen: 11. Dezember 2025

GPT-5.2 war das Modell, das neue Maßstäbe setzte. Es war die erste KI, die 90 %+ auf ARC-AGI-1 erzielte, einem Benchmark, der speziell entwickelt wurde, um Pattern-Matching zu widerstehen und echtes Reasoning zu testen. Es erreichte auch ein perfektes 100 % bei AIME-2025-Mathematikaufgaben. Das waren keine marginalen Gewinne; sie überschritten Schwellen, die jahrelang die Grenze des Möglichen definiert hatten.

OpenAI führte mit GPT-5.2 eine Drei-Stufen-Architektur ein. GPT-5.2 Instant war auf Durchsatz optimiert, was es zur ersten Wahl für Kundensupport, Content-Erstellung und Übersetzungen machte. GPT-5.2 Thinking ergänzte konfigurierbare Reasoning-Tiefe durch Einstellungen wie Light, Medium, Heavy und xhigh, die es erlauben, Latenz gegen Genauigkeit pro Anfrage zu tauschen. GPT-5.2 Pro saß ganz oben mit maximalem Rechenaufwand und bis zu 30 Minuten dauerhafter Verarbeitung für die anspruchsvollsten Aufgaben.

GPT-5.2 Benchmarks

Benchmark Ergebnis
AIME 2025 100 %
GPQA Diamond (Pro) 93,2 %
GPQA Diamond (Thinking) 92,4 %
SWE-Bench Verified 80,0 %
SWE-Bench Pro 55,6 %
ARC-AGI-1 (Pro) 90 %+
ARC-AGI-2 (Pro) 54,2 %
FrontierMath 40,3 %

GPT-5.2 lieferte 38 % weniger Fehler als GPT-5.1, der größte Zuverlässigkeitssprung in der GPT-5-Familie bisher.

Das Kontextfenster blieb bei 400K Tokens (272K Input / 128K Output), aber der API-Preis stieg auf $1.75 pro 1 Mio. Input / $14 pro 1 Mio. Output, ein Anstieg von 40 % gegenüber GPT-5.1.

Eine agentische Coding-Variante, GPT-5.2-Codex, folgte am 14. Januar 2026, speziell entwickelt für die Planung und autonome Ausführung von mehrstufigen Engineering-Aufgaben. Sie wird am 23. Juli 2026 aus der API entfernt, zusammen mit den GPT-5.0- und 5.1-Codex-Snapshots.

Hinweis: GPT-5.2 Thinking wurde am 3. Juni 2026 eingestellt. Wer es für analytische Arbeit genutzt hat, findet in GPT-5.4 Thinking, GPT-5.5 oder GPT-5.6 Sol den vorgesehenen Nachfolger.

GPT-5.3: Das Upgrade für den Alltag

Erschienen: 3. März 2026

GPT-5.3 Instant behob etwas, das frühere Modelle stillschweigend falsch gemacht hatten: den Ton. Frühere GPT-5-Versionen neigten zu übermäßigen Vorbehalten, unnötigem Absichern und dem, was Nutzer als „cringe" bezeichneten, also KI-Übervorsicht, die jede Antwort wie einen rechtlichen Haftungsausschluss wirken ließ. GPT-5.3 drehte das zurück und erzeugte direktere und natürlichere Antworten.

Es lieferte auch eine spürbare Verbesserung der Genauigkeit. Mit aktivierter Websuche erzeugt GPT-5.3 26,8 % weniger Halluzinationen als GPT-5.2 Instant. Ohne Suche beträgt die Verbesserung immer noch 19,7 %. Von Nutzern gemeldete Fehler sanken um 22,5 %.

GPT-5.3 Spezifikationen

Spezifikation GPT-5.3 Instant
Kontextfenster 400K Tokens
HealthBench 54,1 % (leichter Rückgang gegenüber GPT-5.2's 55,4 %)
Halluzinationen 26,8 % weniger mit Websuche gegenüber GPT-5.2
API-Preis ~$0.30 pro 1 Mio. Input / ~$1.20 pro 1 Mio. Output

Dieser Preis war ein dramatischer Rückgang gegenüber GPT-5.2's $1.75 / $14, und GPT-5.3 Instant war als hochwertiges, günstiges Alltagsmodell positioniert, nicht als Reasoning-Kraftpaket. Es erscheint nicht mehr auf OpenAIs API-Preisseite, also gilt dieser Preis nur als historischer Wert. Wer heute diese Rolle sucht, findet in GPT-5.6 Luna zu $0.20 / $1.20 den direkten Nachfolger, der seit OpenAIs Kürzung um 80 % am 30. Juli 2026 günstiger ist als GPT-5.3 Instant je war.

GPT-5.3 Kompromisse

Das Anti-Cringe-Update brachte einen Kompromiss: Die Einhaltung von Sicherheitsregeln in manchen Kategorien sank. Die Filterung grafischer Gewaltdarstellungen fiel von 85,2 % auf 78,1 % im Vergleich zu GPT-5.2, eine Entscheidung, die OpenAI offenbar bewusst getroffen hat und dabei einige Sicherheitskontrollen auf die Produktebene statt ins Modell verlagert.

Die GPT-5.3-Codex-Variante (5. Februar 2026) verdient separate Erwähnung. Sie verfügt über ein Kontextfenster von einer Million Tokens (wie GPT-5.4), läuft 25 % schneller als GPT-5.2-Codex und ist die beste Option für groß angelegtes agentisches Coding zu geringeren Kosten als 5.4 oder 5.5. Wer eine Codex-Variante lokal betreibt, sollte zuerst unseren Bericht über den Codex-Speicherfehler lesen, weil ein unkontrollierter Logger SSD-Kapazität verbrannte, bis OpenAI ihn im Juni 2026 weitgehend behoben hatte.

GPT-5.4: Die professionelle Spitze

Erschienen: 5. März 2026

GPT-5.4 hielt den Titel „leistungsfähigstes Modell, das OpenAI je veröffentlicht hat" sechs Wochen lang, bis GPT-5.5 Ende April 2026 erschien. Laut OpenAIs offizieller GPT-5.4-Ankündigung waren die zwei genuinen Neuerungen, die es von allen Vorgängermodellen abhoben, die native Computernutzung und ein Kontextfenster von einer Million Tokens (über die API).

Computernutzung bedeutet, dass GPT-5.4 direkt mit Software-Oberflächen interagieren kann: Desktops navigieren, UI-Elemente anklicken, Befehle ausführen, Ergebnisse prüfen und in einem Build-Run-Verify-Fix-Zyklus Fehler korrigieren. Auf OSWorld-Verified, dem Benchmark für Desktop-Computernutzung, erzielt es 75,0 %, was den gemessenen menschlichen Basiswert von 72,4 % übertrifft.

GPT-5.4 Benchmarks

Benchmark GPT-5.4 GPT-5.2
OSWorld-Verified (Computernutzung) 75,0 % 47,3 %
GDPval (Wissensarbeit, 44 Berufe) 83,0 % 70,9 %
SWE-Bench Pro (Coding) 57,7 % 55,6 %
GPQA (Wissenschaft) 92,8 % 93,2 %
ARC-AGI v2 73,3 % 54,2 %
FrontierMath 47,6 % 40,3 %
MMMU-Pro (multimodal) 81,2 % –
BrowseComp (Webrecherche) 82,7 % –
Tabellenkalkulations-Aufgaben 87,3 % –
Halluzinationen gegenüber GPT-5.2 33 % weniger (einzelne Behauptungsfehler) –

GPT-5.4 Hauptfunktionen

Kontextfenster von einer Million Tokens (nur API). Das volle 1M-Fenster ist über die API verfügbar. ChatGPT-Plus-, Team- und Pro-Abonnenten in der Chat-Oberfläche erhalten den erweiterten Kontext nicht. Wichtig zu wissen: OpenAI berechnet den doppelten Standardpreis, sobald der Input in einer einzelnen Anfrage 272K Tokens überschreitet.

Tool-Suche. Statt alle Tool-Definitionen im Voraus zu laden, kann GPT-5.4 Tool-Definitionen bei Bedarf abrufen. Das reduziert den Token-Verbrauch in tool-intensiven Workflows um 47 %, eine praktische Kosteneinsparung für alle, die Agenten entwickeln.

Bildverarbeitung in voller Auflösung. GPT-5.4 verarbeitet Bilder bis zu 10,24 Megapixeln, was es für detaillierte medizinische Bildgebung, Architekturpläne und hochauflösende Dokumentenanalyse geeignet macht.

Kompaktierungstraining. Das Modell wird trainiert, lange Agenten-Trajektorien zu komprimieren und dabei den wesentlichen Kontext zu erhalten, nützlich für mehrtägige autonome Workflows.

GPT-5.4 Preise

Stufe Input pro 1 Mio. Output pro 1 Mio.
Standard $2.50 $15.00
Batch / async $1.25 $7.50
Priority $5.00 $30.00
GPT-5.4 Pro $30.00 $180.00

GPT-5.4 Pro ist deutlich teurer. Zum Vergleich: Anthropic's Claude Opus 4.8 kostet $5 pro 1 Mio. Input / $25 pro 1 Mio. Output, womit GPT-5.4 Pro den sechsfachen Input-Preis hat.

GPT-5.4 erscheint in drei Varianten: Standard (professionelle Alltagsnutzung), Thinking (tiefes mehrstufiges Reasoning, für Plus-/Team-/Pro-Abonnenten) und Pro (maximale Leistung).

GPT-5.5: Das bisherige Flaggschiff

Erschienen: 23. April 2026

GPT-5.5 hielt den Flaggschiff-Platz von Ende April bis zur Veröffentlichung von GPT-5.6 im Juli und ist weiterhin verfügbar. Seine schnelle Variante, GPT-5.5 Instant, ist immer noch das Standardmodell für schnelle Alltagsantworten in jedem ChatGPT-Plan, einschließlich Free. Es erschien 49 Tage nach GPT-5.4, womit es den schnellsten Flaggschiff-Wechsel in der GPT-5-Familie darstellt. Lies OpenAIs offizielle GPT-5.5-Ankündigung für das vollständige technische Briefing und unsere eigene GPT-5.5-Launch-Coverage für die vollständigen Benchmark-Tabellen und reale Tests.

Zwei Varianten werden veröffentlicht. GPT-5.5 Standard ist für alle bezahlten ChatGPT-Stufen und Codex verfügbar, und GPT-5.5 Pro ist auf Pro-, Business- und Enterprise-Stufen beschränkt. OpenAI positioniert GPT-5.5 als ein Modell, das „speziell für echte Arbeit und für den Antrieb von Agenten gebaut wurde", mit den größten Effizienzgewinnen bei agentischem Coding und langfristiger Wissensarbeit.

GPT-5.5 Benchmarks

Benchmark GPT-5.5 GPT-5.5 Pro
Terminal-Bench 2.0 82,7 % –
GDPval (Wissensarbeit) 84,9 % –
OSWorld-Verified (Computernutzung) 78,7 % –
SWE-Bench Pro (Coding) 58,6 % –
GPQA Diamond (Wissenschaft) 93,6 % –
BrowseComp (Webrecherche) 84,4 % 90,1 %
FrontierMath Tier 4 35,4 % 39,6 %
Humanity's Last Exam (ohne Tools) 41,4 % 43,1 %
CyberGym 81,8 % –

Gegenüber GPT-5.4 sind die herausragenden Gewinne: OSWorld-Verified (+3,7 Punkte), GPQA Diamond (+0,8), SWE-Bench Pro (+0,9) und Terminal-Bench 2.0 (+7,6). Die Zahlen unterschätzen jedoch, wie sich das Modell in der Nutzung anfühlt. OpenAI berichtet, dass bei NVIDIA Debugging-Zyklen „von Tagen auf Stunden" sanken mit GPT-5.5's agentischem Workflow, was genau die Art von realem Gewinn ist, der in einer Benchmark-Tabelle nicht auftaucht.

GPT-5.5 Hauptfunktionen

Agentisches Coding als Standard. GPT-5.5 erscheint auf mehrstufige Engineering-Workflows abgestimmt. Dasselbe Codex-Tool, das früher Aufsicht benötigte, kann jetzt apply_patch, Terminalbefehle und Verifikationsschritte über längere Zeiträume verketten, ohne den Faden zu verlieren.

Computernutzung, jetzt produktionsreif. 78,7 % auf OSWorld-Verified platziert GPT-5.5 deutlich über dem menschlichen Basiswert von 72,4 %. Desktop-Automatisierungsworkflows, die auf 5.4 noch unzuverlässig waren, werden auf 5.5 realistisch.

Geringere Halluzinationsrate. OpenAI meldet deutlich weniger Halluzinationen gegenüber GPT-5.4 bei Standard-Wissensarbeitsaufgaben, hat jedoch keine einzelne Gesamtzahl veröffentlicht.

API-Zugang folgte der App. Beim Launch war GPT-5.5 zuerst in ChatGPT und Codex live, mit API-Zugang kurz danach unter anderen Sicherheitsvorgaben als der ChatGPT-Rollout. Beide Oberflächen sind seit Monaten allgemein verfügbar.

GPT-5.5 Preise

Stufe Input pro 1 Mio. Output pro 1 Mio.
GPT-5.5 Standard $5.00 $30.00
GPT-5.5 Pro $30.00 $180.00

Standard kostet genau das Doppelte von GPT-5.4 Standard. GPT-5.5 Pro entspricht GPT-5.4 Pro's $30 / $180, wenn du also bereits für Pro zahlst, ist der Wechsel zu 5.5 Pro auf API-Ebene effektiv kostenlos.

GPT-5.6: Was ChatGPT in Chat tatsächlich ausliefert (Sol, Terra, Luna)

Erschienen: 9. Juli 2026 (26. Juni 2026 regierungsbeschränkte Vorschau)

GPT-5.6 ist das Modell, das das Unterhaltungsfenster von ChatGPT tatsächlich ausliefert, in kostenlosen wie bezahlten Plänen, und es ist die Version, die die Aufstellung in drei benannte Stufen statt eines „Standard plus Pro"-Splits umstrukturiert hat. Es erschien zunächst am 26. Juni als Vorschau für etwa 20 zugelassene Organisationen im Rahmen des neuen föderalen Überprüfungsregimes für Frontier-Modelle, wurde dann am 9. Juli vollständig öffentlich und ist weiterhin das, was Chat in jeder Stufe ausliefert, neben Codex und der API. Alle drei Stufen teilen ein Kontextfenster von 1,05 Mio. Tokens und 128K maximale Ausgabe.

Die drei Stufen entsprechen klar Budget und Leistung. Sol ist das Flaggschiff, auf agentisches Coding und langfristige Arbeit abgestimmt, mit einem hochaufwändigen Sol-Ultra-Modus obendrauf. Terra ist die ausgewogene Mitteloption, konkurrenzfähig mit GPT-5.5 zu 60 % weniger. Luna ist die schnellste und günstigste, ausgerichtet auf hochvolumige Alltagsnutzung. Auf Terminal-Bench 2.1, dem agentischen Coding-Benchmark, erzielt Sol 88,8 % und Sol Ultra 91,9 %, was GPT-5.5's 88,0 % auf demselben Test übertrifft.

Stufe Input pro 1 Mio. Output pro 1 Mio. Rolle
Sol (+ Sol Ultra) $4.00 $20.00 Flaggschiff, agentisches Coding, schwerstes Reasoning
Terra $2.00 $12.00 Ausgewogen, ca. GPT-5.5-Qualität zu 60 % weniger
Luna $0.20 $1.20 Schnellste und günstigste, hochvolumige Aufgaben

So erscheint GPT-5.6 tatsächlich in ChatGPT

Die API verkauft Sol, Terra und Luna namentlich. In ChatGPT selbst sitzen dieselben Modelle hinter Denkstufen, was viele verwirrt. GPT-5.6 Sol treibt Instant an, auf berechtigten bezahlten Plänen ebenso wie die Stufen Medium, High und Extra High, während GPT-5.6 Luna bei Free und Go der Standard ist. GPT-5.6 Sol Pro treibt die Option Pro an, die in den Plänen Pro, Business und Enterprise zusätzlich GPT-6 Pro anbietet. Extra High ist der ChatGPT-seitige Name für denselben maximalen Aufwandsmodus, den OpenAI in Benchmarks als Sol Ultra bezeichnet.

ChatGPT-Plan Medium und High Extra High Pro
Free und Go Nicht enthalten Nicht enthalten Nicht enthalten
Plus Enthalten Nicht enthalten Nicht enthalten
Pro Enthalten Enthalten Enthalten
Business Enthalten Enthalten Enthalten
Enterprise Enthalten Enthalten Enthalten

Zwei Konsequenzen sind wichtig, bevor du für irgendetwas zahlst. Terra ist in einer normalen ChatGPT-Unterhaltung überhaupt nicht auswählbar, und Luna taucht dort nur als Standard für Free und Go auf; ansonsten leben beide in Work, Codex und der API, wo Work alle drei Stufen für Plus und höher ausliefert und Codex Terra für Free und Go ergänzt. Und seit dem 14. September 2026 wechselt ChatGPT bei Plus und Pro nicht mehr von selbst von Instant auf eine Denkstufe, die Bitte, gründlicher nachzudenken, bewirkt also nichts. Wähle die Stufe selbst, und wenn du ein GPT-5.6-Denkkontingent aufbrauchst, kann ChatGPT laut OpenAI auf einem anderen verfügbaren Modell weitermachen, statt dich abzuschneiden, also prüf vor einer langen analytischen Antwort, welches Modell geantwortet hat.

Diese Preise sind die Kurzkontext-Tarife, und den von Sol nennt OpenAI inzwischen promotional, garantiert nur bis zum 21. November 2026. Überschreitet eine einzelne Anfrage OpenAIs Langkontext-Schwelle, berechnet OpenAI die gesamte Anfrage zu 2-fachem Input und 1,5-fachem Output, womit Sol auf $8 / $30, Terra auf $4 / $18 und Luna auf $0.40 / $1.80 steigt. Plane die Stufe ein, die du tatsächlich erreichen wirst.

Ein Hinweis ist erwähnenswert: OpenAI hat keine GPT-5.6-Zahlen für die Standard-Benchmarks veröffentlicht, die bei früheren Modellen verwendet wurden (keine SWE-bench Verified-, GPQA- oder OSWorld-Werte für Sol bisher), und der unabhängige Bewerter METR stellte fest, dass die Familie ungewöhnlich gut bei Benchmark-ähnlichen Aufgaben ist, also sollte man den Terminal-Bench-Vorsprung als einen einzelnen Datenpunkt und nicht als vollständiges Bild behandeln. Für die vollständige Aufschlüsselung der Stufen, Benchmarks und des Rollouts, siehe unseren GPT-5.6 Sol, Terra und Luna-Erklärer. Sobald du eine Stufe ausgewählt hast, erklärt unser GPT-5.6-Prompting-Leitfaden sieben Tipps für schärfere Antworten.

Was OpenAI am 23. Juli 2026 eingestellt hat

Sieben Versionen in elf Monaten hinterlassen Altlasten, und OpenAI hat diese aufgeräumt. Am 23. Juli 2026 verloren 15 Modell-Snapshots in einer einzigen Welle den API-Zugang, angekündigt schon am 22. April unter dem Titel „Legacy GPT model snapshots." OpenAIs Begründung war einfach: Zuverlässigkeit verbessern und die Auswahl des richtigen Modells erleichtern.

Lies den Umfang sorgfältig durch. Das war eine reine API-Abschaltung, und sie entfernte nichts aus der ChatGPT-Modellauswahl. Wer ChatGPT über die App oder das Web nutzt, dem hat sich am 23. Juli nichts geändert. Wer die API direkt aufruft oder ein Tool betreibt, das einen bestimmten Modell-Snapshot anheftet, für den ist diese Frist bereits verstrichen.

Die Codex-Snapshots erleiden den größten Einschnitt

Fünf Codex-Snapshots vor 5.3 werden gemeinsam eingestellt, was dies zum bisher größten einzelnen Einschnitt in die Codex-Aufstellung macht. Die beiden chat-latest-Aliase werden am selben Tag eingestellt, ebenso wie beide Deep-Research-Snapshots und die ursprüngliche Computer-Use-Vorschau. Die folgende Tabelle zeigt die Einträge, die am häufigsten in einer GPT-5-era-Codebasis vorkommen dürften.

Eingestellt am 23. Juli 2026 OpenAIs Ersatz
gpt-5-codex gpt-5.5
gpt-5.1-codex gpt-5.5
gpt-5.1-codex-max gpt-5.5
gpt-5.1-codex-mini gpt-5.4-mini
gpt-5.2-codex gpt-5.5
gpt-5-chat-latest gpt-5.5
gpt-5.1-chat-latest gpt-5.5
o3-deep-research-2025-06-26 gpt-5.5-pro
o4-mini-deep-research-2025-06-26 gpt-5.5-pro
computer-use-preview-2025-03-11 gpt-5.4-mini

Die verbleibenden fünf sind GPT-4o-Relikte statt GPT-5-Modelle, darunter das Search-Preview-Paar, ein Text-to-Speech-Snapshot sowie veraltete Audio- und Realtime-Mini-Snapshots. Beachte, was nicht auf der Liste steht. GPT-5.3-Codex überlebt, was wichtig ist, da er ein Kontextfenster von 1 Mio. Tokens mitbringt und die günstigere Option für groß angelegtes agentisches Arbeiten mit großen Codebasen bleibt. GPT-5.4, GPT-5.5 und GPT-5.5 Pro bleiben ebenfalls im Verkauf.

Die größere Welle kommt im Oktober

Der 23. Juli ist der kleinere der beiden Fristen. Am 23. Oktober 2026 stellt OpenAI eine viel bekanntere Gruppe ein, darunter gpt-3.5-turbo-0125, gpt-4-0613, gpt-4-turbo, gpt-4o-2024-05-13, o1, o1-pro, o3-mini, o4-mini und das ursprüngliche gpt-image-1, zusammen mit feinabgestimmten Modellen auf Basis von GPT-3.5 Turbo und GPT-4. Wer noch ein Fine-Tune auf diesen Basismodellen betreibt, hat drei Monate Zeit zum Neutrainieren, was der Teil ist, den die meisten Teams unterschätzen. Eine dritte Welle folgt am 11. Dezember 2026 und nimmt die ursprünglichen GPT-5-Snapshots mit, gpt-5-2025-08-07 plus Mini-, Nano- und Pro-Varianten, zusammen mit o3 und o3-pro. Separat laufen die Videos API und alle Sora-2-Snapshots am 24. September 2026 aus. Alle Fristen lassen sich auf OpenAIs Deprecations-Seite verfolgen.

Welches ChatGPT-Modell solltest du nutzen?

Die richtige Wahl hängt vollständig vom Einsatzgebiet ab, von günstigem Alltagschat bis hin zu erstklassigem Reasoning und Coding, und die folgende Tabelle zeigt, welches Modell am besten zu welcher Aufgabe passt. Wer stattdessen Googles Aufstellung abwägt: Unser Gemini-Modellvergleich macht dieselbe versions­weise Aufschlüsselung für Flash, Pro und Flash-Lite.

Aufgabe Bestes Modell Warum
Alltägliches Schreiben, E-Mails, Zusammenfassungen GPT-6 Luna, in Chat GPT-5.6 Luna Günstigste OpenAI-Stufe zu $0.10 / $0.50, die Hälfte des GPT-5.6-Luna-Tarifs bei gleichem Index-Wert
Hochvolumige API (Kosten entscheidend) GPT-6 Luna Zu $0.10 / $0.50 unterbietet es GPT-5.6 Luna und das alte GPT-5.4-nano auf beiden Seiten, mit Qualität der aktuellen Generation obendrein
Tiefes analytisches Reasoning GPT-6 Sol, in Chat GPT-5.6 Sol GPT-6 Sol kostet die Hälfte von GPT-5.6 Sol und liegt im Intelligence Index v4.3.2 von Artificial Analysis knapp davor, 47,5 gegen 47,0
Komplexes Coding, Fehlersuche GPT-6 Sol in Codex Dieselbe Generation wie Astra zu $2 / $10, und die 88,8 % von GPT-5.6 Sol auf Terminal-Bench 2.1 bleiben der Höchstwert der GPT-5-Familie
Agentische, mehrstufige Automatisierung GPT-6 Astra 74,1 % auf DeepSWE v1.1 gegen 70,8 % von GPT-5.6 Sol, in etwa der halben Zeit pro Aufgabe
Computernutzung / Desktop-Automatisierung GPT-6 Astra 72,6 % auf OSWorld V2-Offline, während die 78,7 % von GPT-5.5 vom älteren OSWorld-Verified stammen und nicht vergleichbar sind
Lange Dokumentenanalyse (1 Mio.+ Tokens) GPT-6 oder GPT-5.6 (API) Beide Generationen haben ein Kontextfenster von 1,05 Mio. Tokens
Enterprise / maximale Genauigkeit GPT-6 Pro (Astra) Die höchste Option in der ChatGPT-Modellauswahl, in den Plänen Pro, Business und Enterprise
Ausgewogene Qualität zu niedrigeren Kosten GPT-5.6 Terra Ca. GPT-5.5-Qualität zu 60 % weniger ($2 / $12), und OpenAI hat kein GPT-6 Terra angekündigt

Für einen breiteren Vergleich einschließlich Claude, Gemini und anderen führenden Modellen, siehe unseren Hub der besten KI-Modelle. Für einen direkten Vergleich zwischen OpenAI und Anthropic, schau unseren Claude-vs-ChatGPT-Vergleich an. Für Googles Seite, lies unsere Gemini-3.5-Rezension und Pro-Launch-Tracker. Und wer lieber spricht als tippt: Unser ChatGPT-Live-Voice-Leitfaden erklärt OpenAIs neuen Echtzeit-GPT-Live.

GPT-6 Astra: Was tatsächlich erschienen ist

Das Warten endete am 3. September 2026, als OpenAI GPT-6 Astra veröffentlichte und damit den Streit darüber entschied, ob Astra als GPT-6 oder als weitere Punktversion innerhalb der GPT-5-Reihe kommt. Es ist das erste Modell, das OpenAI je als kritisch für Cybersicherheitsfähigkeit unter seinem Preparedness Framework eingestuft hat, weshalb die Ausrollung bei geprüften Verteidigern begann und nicht in der Modellauswahl. Diese Sperre hielt genau einen Tag, denn Astra erreichte ChatGPT schon am 4. September als GPT-6 Pro in den Plänen Pro, Business und Enterprise. Firmenpräsident Greg Brockman sagte bei einem Pressebriefing: „Willkommen in der AGI-Ära.“ Unsere Berichterstattung zum Launch von GPT-6 Astra arbeitet Preise, Benchmarks und die Fußnoten auf, mit denen diese Zahlen kommen. Sam Altman hatte gesagt, GPT-6 werde früher kommen als der 2,5-Jahres-Abstand zwischen GPT-4 und GPT-5, und mit 13 Monaten nach GPT-5.0 hat das gehalten.

Was GPT-6 Astra bringt

Notizen, die das Kontextfenster überleben. Das lange gerüchteweise erwartete persistente Gedächtnis kam in engerer Form als die Leaks nahelegten. Astra kann Notizen über Kontextfenster hinweg führen und in älteren Nachrichten und Tool-Ausgaben zurücksuchen, statt sich auf Kompaktierung zu verlassen, die alte Arbeit zusammenfasst und dabei genau das Detail verwerfen kann, das ein Agent später braucht. Zum Launch ist das eine experimentelle Funktion hinter einer config.toml-Einstellung, und OpenAI sagt, sie werde für Astra in den kommenden Wochen zum Standard.

Langfristige Computernutzung. Hier ist der Sprung am deutlichsten zu sehen. Auf OSWorld V2-Offline meldet OpenAI Astra mit 72,6 % bei rund 40 Minuten pro Aufgabe gegenüber 65,7 % für GPT-5.6 Sol bei rund 75 Minuten, und beim agentischen Coding DeepSWE v1.1 mit 74,1 % gegenüber Sols 70,8 %. Die halbierte Zeit pro Aufgabe bei gleichzeitig höherem Wert ist das praktisch nützliche Ergebnis. Astra kann dir außerdem eine Frage stellen, ohne die Arbeit anzuhalten, die nicht von deiner Antwort abhängt.

Scope-Disziplin, mit einem Preis. In OpenAIs internen Tests mit schwierigen oder unlösbaren Aufgaben ohne Produktionsschutzmaßnahmen überschritt GPT-5.6 Sol seinen autorisierten Rahmen in 48,2 % der Fälle. Astra tat das in 0 % der Fälle. Dieselben Materialien legen eine Verschlechterung offen: In Auswertungen, die auf das Umgehen von Überwachung angelegt waren, war Astras schriftliches Reasoning schwerer nachzuvollziehen als das von Sol. Ein Modell, das seinen Rahmen nie überschreitet, dessen Reasoning sich aber schlechter lesen lässt, ist ein Tauschgeschäft, kein sauberer Sieg.

Was nicht kam. Die Spekulation um persistente Gewichtsaktualisierungen, bei denen ein Modell sitzungsübergreifend lernt statt nur innerhalb einer Sitzung, gehört nicht zu dem, was OpenAI veröffentlicht hat. Ebenso wenig eine GDPval-Zahl, der Benchmark, den OpenAI zur Messung von Leistung bei wirtschaftlich wertvoller Arbeit gebaut hat, was bei einem als AGI gerahmten Launch eine auffällige Lücke ist. Und die schlagzeilenträchtigen 98,6 % auf ARC-AGI-3 sind keine Lösungsquote. Sie messen relative menschliche Handlungseffizienz, auf einem Testaufbau, bei dem OpenAI selbst gezeigt hat, dass er diese Zahl verdreifachen kann.

Wie sich die einzelnen GPT-6-Gerüchte gegen das Veröffentlichte geschlagen haben, zeigt unsere Bilanz der ChatGPT-6-Leaks.

Astra war nicht die ganze Familie. Am 22. September 2026 ergänzte OpenAI GPT-6 Sol zu $2 / $10 und GPT-6 Luna zu $0.10 / $0.50, halbierte damit die entsprechenden GPT-5.6-Tarife und brachte beide in ChatGPT Work und Codex für Plus und höher, mit Luna in der Desktop-App für Free und Go. OpenAIs eigene Release Notes sagen, dass die beiden von den in Chat verfügbaren Modellen getrennt sind. Unser Leitfaden zu GPT-6 Sol und Luna geht Benchmarks und Oberflächen im Detail durch.

Benchmark-Entwicklung in der GPT-5-Familie

Benchmark GPT-5.0 GPT-5.1 GPT-5.2 GPT-5.3 GPT-5.4 GPT-5.5
AIME 2025 (Mathematik) 94,6 % 94 % 100 % – 100 % –
GPQA Diamond 89,4 % ~87 % 93,2 % – 92,8 % 93,6 %
SWE-Bench Verified 74,9 % 76,3 % 80,0 % – ~52,8 %* –
SWE-Bench Pro – – 55,6 % – 57,7 % 58,6 %
ARC-AGI-1 – – 86,2 % – 93,7 % –
ARC-AGI-2 – 17,6 % 54,2 % – 73,3 % –
FrontierMath (T1–3) 26,6 % – 40,3 % – 47,6 % –
FrontierMath (T4) – – – – 27,1 % 35,4 % (Pro 39,6 %)
MMMU 84,2 % 85,4 % – – 84,2 % –
MMMU-Pro – – 86,5 % – 81,2 % –
HealthBench Hard 46,2 % – 55,4 % 54,1 % 62,6 % –
GDPval (Wissensarbeit) – – 70,9 % – 83,0 % 84,9 %
OSWorld (Computernutzung) – – 47,3 % – 75,0 % 78,7 %
BrowseComp – – 65,8 % – 82,7 % 84,4 % (Pro 90,1 %)
Terminal-Bench 2.0 – 58,1 % 64,9 % – 75,1 % 82,7 %
Tabellenkalkulations-Modellierung – – 68,4 % – 87,3 % –
HLE (Humanity's Last Exam) 42 % – – – 52,1 % 41,4 % (ohne Tools)
LiveCodeBench – – – – 72,5 % –
Aider Polyglot 88 % – – – – –
CyberGym – – – – – 81,8 %
Halluzinationsreduktion -45 % vs GPT-4o – -38 % vs 5.1 -26,8 % vs 5.2 -33 % vs 5.2 niedriger als 5.4 (noch keine Einzelzahl)

Der SWE-Bench-Verified-Wert von GPT-5.4 stammt von einer Nicht-Thinking-Variante; OpenAI hat keine offizielle Zahl für diesen Benchmark veröffentlicht. Die Humanity's-Last-Exam-Zahlen sind nicht direkt vergleichbar: GPT-5.5's 41,4 % ist die Zahl ohne Tools; GPT-5.4's 52,1 % ist mit Tools.

Die Tabelle endet bei GPT-5.5 mit Absicht. Der einzige Benchmark, den OpenAI für GPT-5.6 zum Launch veröffentlicht hat, ist Terminal-Bench 2.1, wo Sol 88,8 % und Sol Ultra 91,9 % erzielt. Zwei weitere Sol-Werte kamen beiläufig in den Launch-Materialien zu GPT-6 Astra am 3. September 2026 dazu, 70,8 % auf DeepSWE v1.1 und 65,7 % auf OSWorld V2-Offline, doch beide beruhen auf Benchmark-Versionen, die die älteren Zeilen nie verwendet haben, sodass ihre Aufnahme hieße, verschiedene Tests zu vergleichen. Vergleichbare GPQA-, SWE-Bench- und FrontierMath-Zahlen für die 5.6-Familie fehlen weiterhin. Unser Leitfaden zu KI-Benchmarks erklärt, was diese Werte tatsächlich messen.

Jede GPT-5-Variante plus Claude, Gemini und Grok in einer Mac-App?

Wenn du für ChatGPT, Claude Pro und Google AI Pro zahlst, nur um Modellausgaben zu vergleichen, gibt es ein einfacheres Setup. Fello AI ist eine native Mac-, iPhone- und iPad-App, die deine Prompts über eine einzige Oberfläche zu ChatGPT, Claude, Gemini, Grok, DeepSeek, Perplexity, Kimi, GLM und Qwen leitet, für $9.99/Monat. Ein Preis, alle Top-Modelle, kein Tab-Wechsel.

Das ist wichtig in einer Welt, in der OpenAI alle sechs Wochen eine neue GPT-5-Variante veröffentlicht und jede direkt mit Veröffentlichungen von Anthropic, Google und xAI konkurriert. Wenn GPT-5.6 heute beim agentischen Coding führt, Claude oder Gemini aber nächsten Monat bei einer bestimmten Aufgabe vorne liegt, kannst du innerhalb derselben App das Modell wechseln, ohne deinen Workflow zu ändern.

Du kannst Fello AI im App Store herunterladen und alle diese Modelle nebeneinander auf Mac, iPhone und iPad nutzen, für $9.99/Monat, mit einer kostenlosen Stufe zum Ausprobieren und einer 4,7-Sterne-Bewertung aus über 27.000 Rezensionen. Es funktioniert als Alternative zu drei separaten Abonnements oder als Ergänzung zu dem, das du bereits hast, und verarbeitet Bilder, Dokumente und Tabellen, nicht nur Chat.

Zum Thema persistentes Gedächtnis, lies Anthropic's neues Agenten-Gedächtnissystem.

Praktische Tipps zu effektiver ChatGPT-Nutzung findest du in unserem vollständigen Leitfaden.

Fazit

Die GPT-5-Familie hat sich schnell entwickelt. In elf Monaten ist OpenAI von einem leistungsfähigen Allzweckmodell zu einem übergegangen, das Software wie ein Mensch bedient, eine komplette Codebasis im Kontext hält und Branchenprofis bei Wissensarbeits-Benchmarks in 44 Berufen übertrifft. GPT-5.5 machte mehrstufige agentische Coding-Workflows ohne menschliche Aufsicht möglich, GPT-5.6s Sol-Stufe führt die Familie genau bei dieser Arbeit an, und GPT-6 ist jetzt darüber gelandet, ohne ihren Platz in Chat einzunehmen.

Für die meisten Nutzer ist die Alltagswahl innerhalb von ChatGPT weiterhin GPT-5.6, Sol in bezahlten Plänen und Luna bei Free und Go, denn das ist es, was das Unterhaltungsfenster ausliefert. Wer die API aufruft oder in Codex arbeitet, fährt jetzt mit dem GPT-6-Paar günstiger, GPT-6 Luna zu $0.10 / $0.50 und GPT-6 Sol zu $2 / $10, beide halb so teuer wie ihre GPT-5.6-Pendants und keines davon schwächer im Index. Und wenn die Aufgabe ganz und gar nicht ChatGPTs Stärke ist, zeigt unser Leitfaden zu welche KI wann zu nutzen, welches Modell du stattdessen öffnen solltest. Wer etwas entwickelt, das noch in 12 Monaten laufen soll, plant mit GPT-6 Astra zu $10 / $50 pro 1 Mio. Tokens, das ChatGPT als GPT-6 Pro in den Plänen Pro, Business und Enterprise anbietet.

FAQ

Was ist das neueste ChatGPT-Modell im Jahr 2026?

GPT-6. OpenAI hat GPT-6 Astra am 3. September 2026 veröffentlicht und am 22. September GPT-6 Sol und GPT-6 Luna ergänzt. Im Unterhaltungsfenster von ChatGPT antwortet dir aber weiterhin GPT-5.6, Sol in bezahlten Plänen und Luna bei Free und Go, wobei Astra als Option GPT-6 Pro in den Plänen Pro, Business und Enterprise angeboten wird. GPT-6 Sol und Luna laufen in ChatGPT Work, Codex und der API statt in Chat. Sol erzielt 88,8 % auf Terminal-Bench 2.1 (91,9 % im Sol-Ultra-Modus) und alle drei GPT-5.6-Stufen teilen ein Kontextfenster von 1,05 Mio. Tokens.

Was ist der Unterschied zwischen GPT-5.4 und GPT-5.5?

GPT-5.5 übertrifft GPT-5.4 bei jedem Frontier-Benchmark, besonders bei Terminal-Bench 2.0 (82,7 % vs. 75,1 %), OSWorld-Verified (78,7 % vs. 75,0 %) und SWE-Bench Pro (58,6 % vs. 57,7 %). Der Kompromiss ist der Preis: GPT-5.5 Standard kostet $5 / $30 pro 1 Mio. Tokens, doppelt so viel wie GPT-5.4's $2.50 / $15. GPT-5.5 Pro entspricht beim Preis GPT-5.4 Pro mit $30 / $180.

Was ist der Unterschied zwischen GPT-5.3 und GPT-5.5?

GPT-5.5 fügt native Computernutzung, ein Kontextfenster von 1 Mio. Tokens und deutlich stärkeres Reasoning und agentisches Coding hinzu. GPT-5.3 Instant war mit etwa $0.30 / $1.20 dramatisch günstiger, wird aber nicht mehr über die API verkauft, sodass das aktuelle Budget-Äquivalent GPT-6 Luna zu $0.10 / $0.50 ist, die Hälfte des GPT-5.6-Luna-Tarifs und auf beiden Seiten unter dem alten GPT-5.4-nano zu $0.20 / $1.25.

Ist GPT-5.5 den Preis wert?

Für agentische Workflows, Computernutzung und professionelles Coding: ja, obwohl GPT-5.6 Sol weniger kostet, $4 / $20 gegenüber GPT-5.5s $5 / $30, und beim agentischen Coding besser abschneidet. GPT-6 Sol halbiert das zu $2 / $10 noch einmal und liegt im Index knapp vor GPT-5.6 Sol, in der API ist es damit die bessere Wahl. Für Standard-Schreiben und Chat deckt GPT-6 Luna zu $0.10 / $0.50 die Aufgabe für einen Bruchteil des Preises ab. Nutze die günstige Stufe standardmäßig und greife nur zum Flaggschiff, wenn die Aufgabe es wirklich erfordert.

Ist GPT-6 schon da?

Ja, und inzwischen sind es drei Modelle. GPT-6 Astra erschien am 3. September 2026 zu $10 / $50 pro 1 Mio. Tokens und erreichte ChatGPT am Tag darauf als Option GPT-6 Pro in den Plänen Pro, Business und Enterprise. Plus-Pläne bekommen es in ChatGPT Work und Codex statt in Chat, Free und Go gar nicht. GPT-6 Sol zu $2 / $10 und GPT-6 Luna zu $0.10 / $0.50 folgten am 22. September 2026 in Work, Codex und der API, Luna zusätzlich in der Desktop-App für Free und Go.

Welche ChatGPT-Modelle werden 2026 eingestellt?

Fünfzehn ältere Snapshots verloren am 23. Juli 2026 den API-Zugang, darunter fünf Codex-Snapshots (gpt-5-codex, gpt-5.1-codex, gpt-5.1-codex-max, gpt-5.1-codex-mini, gpt-5.2-codex), beide chat-latest-Aliase, beide Deep-Research-Snapshots und die ursprüngliche Computer-Use-Vorschau. Eine größere Welle folgt am 23. Oktober 2026 mit GPT-3.5 Turbo, GPT-4, GPT-4 Turbo, o1, o3-mini, o4-mini und gpt-image-1, dann eine dritte am 11. Dezember 2026 mit den ursprünglichen GPT-5-Snapshots, o3 und o3-pro. Alle drei betreffen nur die API; die ChatGPT-Modellauswahl bleibt unberührt.

Welches ChatGPT-Modell ist am besten für Coding?

In Codex und der API ist GPT-6 Sol zu $2 / $10 jetzt die preis-leistungsstärkste Wahl für agentische, mehrstufige Engineering-Aufgaben, darüber GPT-6 Astra für die schwersten langlaufenden Arbeiten. In ChatGPT Chat bleibt GPT-5.6 Sol die erste Wahl, mit Extra High für die schwersten Probleme (88,8 % und 91,9 % auf Terminal-Bench 2.1). GPT-5.5 und GPT-5.5 Pro bleiben starke Alternativen, und GPT-5.3-Codex ist immer noch eine solide günstigere Option für Arbeit mit großen Codebasen dank seines 1-Mio.-Kontextfensters.