Weiter zum Inhalt

GPT-5.6 Sol, Terra und Luna: OpenAIs Next-Generation-Modellfamilie

OpenAIs GPT-5.6 bringt die Modelle Sol, Terra und Luna. Wir erklären Benchmarks, Preise und den Vergleich mit GPT-5.5, Claude und Gemini.
Aktualisiert 23. Sept. 2026  · 8 Min. lesen

Mit KI erkunden

ChatGPTClaudePerplexity

Hinweis: OpenAI hat am 3. September 2026 GPT-6 Astra und am 23. September 2026 GPT-6 Sol und Luna veröffentlicht.

\n

GPT-5.6 ist eine Serie aus drei Modellen, die heute in einer eingeschränkten Vorschau startet, koordiniert mit der US-Regierung. 

\n

Für den breiten Einsatz ist es noch nicht verfügbar, aber es gibt bereits viele Neuigkeiten zu den Fähigkeiten – besonders in den Bereichen Coding, Biologie und Cybersicherheit. Darauf gehen wir gleich ein.

\n

Wenn du OpenAI-News zu früheren Modellen nachlesen willst, findest du zu jeder Veröffentlichung einen Überblick: GPT-5.5 Instant, GPT-5.3 Instant und GPT-5.2. 

\n

Und wenn du GPT-5.6 mit den aktuellsten verfügbaren Modellen vergleichen willst, haben wir dazu ebenfalls Artikel: Gemini 3.1 Pro, Claude Opus 5, Claude Mythos 5, Claude Fable 5. 

\n

Was ist GPT-5.6?

\n

GPT-5.6 ist OpenAIs neueste Modellgeneration. Genau genommen ist es eine Familie aus drei Modellen – und endlich gibt es eine neue Namenskonvention.

\n

In dem neuen System steht die Zahl für die Generation (5.6) und der Name für die Fähigkeitsstufe (Sol, Terra, Luna). Ein Vorteil der neuen Konvention: Jede Stufe kann sich in ihrem eigenen Tempo weiterentwickeln – weniger Verwirrung. \"Instant\" war kein idealer Name für das jeweils neueste Basismodell.

\n

Was ist GPT-5.6 Sol?

\n

Sol ist das Flaggschiff und das stärkste, fähigste Modell der Serie. Es führt in allen Benchmarks der Veröffentlichung und ist das einzige Modell, das die neue Einstellung für max-Reasoning und den ultra-Modus freischaltet (beides unten mehr).

\n

Bei Sol sind auch die Fortschritte in Cybersicherheit und Biologie am deutlichsten. Sol ist das richtige Modell, wenn du die höchste Leistung bei komplexen, mehrstufigen Aufgaben willst und die höheren Token-Kosten akzeptierst.

\n

Wir haben es mit den neuen Flaggschiffmodellen von Anthropic und SpaceXAI verglichen: Claude Opus 5 und Grok 4.6.

\n

Was ist GPT-5.6 Terra?

\n

Terra ist das ausgewogene Modell für den Arbeitsalltag – quasi der Standard. Terra erreicht eine konkurrenzfähige Performance zu GPT-5.5 und ist dabei etwa doppelt so günstig. Das könnte sich als Muster etablieren: ungefähr Flaggschiff-Qualität der letzten Generation zum Mid-Tier-Preis. 

\n

Was ist GPT-5.6 Luna?

\n

Luna ist die schnelle, preiswerte Stufe. Gedacht für große Volumina, niedrige Latenzen oder enge Budgets. Wie die Benchmark-Tabelle unten zeigt, heißt \"am günstigsten\" nicht automatisch \"bei jeder Aufgabe am schwächsten\". Das ist wichtig, damit du Luna nicht übersiehst.

\n

Kurz zusammengefasst: 

\n
    \n
  • Sol ist das stärkste Modell mit dem umfangreichsten Sicherheits-Stack
  • \n
  • Terra ist ähnlich wie GPT‑5.5, nur günstiger
  • \n
  • Luna hat die niedrigsten Kosten.
  • \n
\n

Was ist sonst neu bei GPT-5.6?

\n

Dieses Update bringt außerdem neue Möglichkeiten, das Reasoning hochzudrehen, plus breite Fähigkeitsgewinne in einigen spezifischen Domänen.

\n

Zwei neue Wege, das Modell stärker zu fordern

\n

GPT-5.6 führt zwei neue Steuerelemente ein:

\n
    \n
  • \n

    max-Reasoning-Aufwand: Eine neue Einstellung, die Sol mehr Zeit zum Nachdenken über ein Problem gibt.

    \n
  • \n
  • \n

    ultra-Modus: Das ist noch interessanter. Statt dass ein einzelner Agent die Aufgabe bearbeitet, nutzt ultra Subagenten.

    \n
  • \n
\n

In den Benchmarks unten taucht ultra als eigene Zeile auf (\"GPT-5.6 Sol Ultra\") und erzielt die Top-Wertung.

\n

Stärker im Coding

\n

GPT-5.6 Sol setzt einen neuen State of the Art auf Terminal-Bench 2.1, das vor rund sechs Wochen erschien. Die neueste Version von Terminal-Bench testet Kommandozeilen-Workflows, die Iteration und Tool-Koordination brauchen. Die konkreten Zahlen kommen im Benchmark-Abschnitt.

\n

Stärker in Biologie

\n

Ein weniger bekannter Benchmark: GeneBench v1. Er bewertet Langzeit-Analysen in Genomik und quantitativer Biologie. Laut Veröffentlichung erzielt GPT-5.6 Sol stärkere Ergebnisse als GPT-5.5 – bei geringerem Tokenverbrauch. 

\n

Stärkere (und vorsichtiger gehandhabte) Cybersicherheit

\n

OpenAI nennt GPT-5.6 Sol sein bislang fähigstes Modell für Cybersicherheit und widmet dem Thema viel Raum in der Veröffentlichung. Sol verschiebt die Effizienzfront bei Langzeit-Sicherheitsaufgaben, etwa bei der Schwachstellenforschung und -ausnutzung. Zudem berichtet OpenAI über weitere Erfolge auf weniger bekannten Benchmarks: 

\n
    \n
  • Auf ExploitBench ist GPT-5.6 Sol laut OpenAI mit dem (nicht veröffentlichten) Mythos Preview-Modell konkurrenzfähig und nutzt dabei nur etwa ein Drittel der Ausgabe-Tokens.
  • \n
  • Auf ExploitGym, einem Benchmark von UC-Berkeley-Forschenden, zeigen alle drei Modelle deutliche Cyber-Verbesserungen, wenn das Reasoning hochgefahren wird.
  • \n
\n

\n

\n\n

GPT-5.6: Benchmark-Ergebnisse

\n

Die Schlagzeile liefert das Ergebnis auf Terminal-Bench 2.1, das ich oben erwähnt habe. So schneiden die Modelle ab – absteigend sortiert:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ModellTerminal-Bench 2.1
GPT-5.6 Sol Ultra91,9%
GPT-5.6 Sol88,8%
GPT-5.588,0%
GPT-5.6 Luna84,3%
Claude Mythos 584,3%
Claude Fable 583,4%
GPT-5.6 Terra82,5%
Claude Opus 4.878,9%
Gemini 3.1 Pro Preview70,7%
\n
\n

Ein paar Punkte stechen heraus:

\n
    \n
  • \n

    Der ultra-Modus macht einen Unterschied. GPT-5.6 Sol Ultra (91,9%) liegt klar über dem normalen Sol (88,8%) – der deutlichste Beleg, dass der Subagenten-Ansatz hier funktioniert.

    \n
  • \n
  • \n

    Die Reihenfolge der Stufen spiegelt diesen einen Benchmark nicht perfekt wider. Beachte, dass GPT-5.6 Luna tatsächlich über GPT-5.6 Terra liegt, obwohl Terra als höhere Stufe positioniert ist. Und Terra landet in diesem Test unter GPT-5.5 (88,0%), obwohl OpenAI Terra insgesamt als \"konkurrenzfähig zu GPT-5.5\" beschreibt. Die Erkenntnis: Stufen beschreiben das Verhältnis aus Intelligenz/Geschwindigkeit/Kosten über viele Aufgaben im Durchschnitt – keine Garantie für einen einzelnen Benchmark.

    \n
  • \n
\n

Der Sicherheits-Stack und die eingeschränkte Vorschau

\n

Hier weicht GPT-5.6 am stärksten von einem normalen Modell-Launch ab. Statt das Modell selbst zu testen (warum das noch nicht geht, gleich mehr), ist am Nachrichtenwert vor allem interessant, wie es ausgeliefert wird.

\n

Ein gestapeltes Schutzsystem

\n

OpenAIs Argument: Kein einzelner Schutz hält entschlossenem oder adaptivem Missbrauch stand, also werden mehrere Ebenen kombiniert. In der GPT-5.6-Vorschau umfassen die Ebenen:

\n
    \n
  • Training auf Modellebene, um verbotene Cyber-Hilfe abzulehnen – auch bei getarnten Absichten oder Jailbreak-Versuchen.
  • \n
  • Echtzeit-Klassifizierer für Cyber- und Biologie-Missbrauch, die Ausgaben während der Generierung bewerten. In höher riskanten Fällen kann die Generierung pausieren, während ein größeres Reasoning-Modell die gesamte Unterhaltung prüft – und die Ausgabe kann zurückgehalten werden, bevor sie dich erreicht.
  • \n
  • Accountweite Prüfung, die Unterhaltungen und Risikosignale eines Nutzers betrachtet, um anhaltend böswilliges Verhalten von legitimer Dual-Use-Sicherheitsarbeit zu unterscheiden.
  • \n
  • Differenzierter Zugriff, Monitoring, Durchsetzung und laufende Tests.
  • \n
\n

OpenAI kommuniziert offen, dass in der Vorschau einige Anfragen blockiert oder abgelehnt werden können und andere länger dauern, weil die Generierung zur Überprüfung pausiert. Man räumt auch ein, dass Schutzmechanismen gelegentlich legitime Dual-Use-Arbeit ausbremsen können, bei der Defensive und Offensive zunächst ähnlich aussehen. 

\n

Red-Teaming im großen Stil

\n

Zur Härtung hat OpenAI ungewöhnlich viel Rechenleistung in die Sicherheit gesteckt: über 700.000 A100-äquivalente GPU-Stunden automatisiertes Red-Teaming, gezielt auf universelle Jailbreaks – also Angriffe, die über viele Prompts und Kontexte generalisieren statt nur in einer engen Einstellung zu funktionieren. Ergänzt wurde das durch externes Red-Teaming mit Fachexperten, das während der Preview weiterläuft, plus einen Schnellreaktionsprozess, um neue Jailbreaks zu reproduzieren, zu patchen und in künftige Tests einfließen zu lassen.

\n

Warum der Rollout so vorsichtig ist

\n

OpenAI hat die Pläne und Fähigkeiten von GPT-5.6 vorab der US-Regierung vorgestellt und startet auf deren Bitte mit einer limitierten Vorschau für eine kleine Gruppe vertrauenswürdiger Partner.

\n

Damit ist es bereits das zweite Mal in einem Monat, dass die US-Regierung in den Launch eines Frontier-Modells eingreift: Vor zwei Wochen zwang eine US-Exportkontrollrichtlinie Anthropic dazu, Claude Fable 5 und Mythos 5 weltweit für alle Kundinnen und Kunden offline zu nehmen.

\n

Meine Einschätzung: OpenAI hat beobachtet, was bei Anthropic passiert ist, und sich entschieden, lieber vorab die Schlüssel zu übergeben, als ein Modell im Nachhinein zurückziehen zu müssen. 

\n

Hinweis zum Testen

\n

In unseren üblichen Modell-Reviews würden wir das neue Modell jetzt hands-on prüfen – auf Reasoning, Websuche und ein, zwei High-Stakes-Prompts. Das geht hier noch nicht. GPT-5.6 befindet sich in einer limitierten Vorschau für einen kleinen Kreis vertrauenswürdiger Partner und ist nicht allgemein testbar.

\n

Wie kann ich auf GPT-5.6 zugreifen?

\n

Während der Preview sind GPT-5.6-Modelle über die API und Codex für eine ausgewählte Gruppe vertrauenswürdiger Partner und Organisationen verfügbar. OpenAI plant, sie bald breiter in ChatGPT, Codex und der API verfügbar zu machen. 

\n

Preise

\n

GPT-5.6 wird über drei Stufen pro 1 Mio. Tokens abgerechnet:

\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ModellInput (pro 1 Mio. Tokens)Output (pro 1 Mio. Tokens)
GPT-5.6 Sol$5.00$30.00
GPT-5.6 Terra$2.50$15.00
GPT-5.6 Luna$1.00$6.00
\n
\n

Ein paar wissenswerte Preisdetails:

\n
    \n
  • Berechenbareres Prompt-Caching, inklusive Unterstützung für explizite Cache-Breakpoints und mindestens 30 Minuten Cache-Lebensdauer.
  • \n
  • Für GPT-5.6 und spätere Modelle werden Cache-Writes mit dem 1,25-Fachen der ungecachten Input-Rate des Modells berechnet, während Cache-Reads den 90%-Rabatt auf gecachte Inputs behalten.
  • \n
\n

Speed über Cerebras

\n

OpenAI startet GPT-5.6 Sol außerdem auf Cerebras mit bis zu 750 Tokens pro Sekunde im Juli – zunächst für ausgewählte Kundinnen und Kunden, während die Kapazität ausgebaut wird. Das zielt direkt auf latenzkritische Arbeit, bei der das Warten auf ein Frontier-Modell der Engpass ist.

\n

Fazit

\n

GPT-5.6 bringt einige Pluspunkte: eine klarere Drei-Stufen-Familie, zwei neue Wege, das Reasoning zu pushen (max und ultra) sowie Fortschritte in Coding, Biologie und Cybersicherheit.

\n

Trotzdem: Das Modell ist derzeit nur in einer geschlossenen Vorschau verfügbar, unabhängige Verifizierung ist also noch nicht möglich. Die Geschichte, die OpenAI erzählt – GPT-5.6 sei \"so fähig, dass wir uns mit der Regierung abstimmen mussten\" – klingt nach der vorteilhaftesten möglichen Vermarktung. Das macht sie aber nicht automatisch falsch, und Vorsicht bei Cybersicherheit ist grundsätzlich zu begrüßen. 

\n

Für den Moment gilt: Die Zahlen sehen stark aus, der Zugang ist eng, und der echte Test kommt, wenn die Modelle breit verfügbar werden. Abonniere unseren Newsletter, dann halten wir dich auf dem Laufenden. 

\n


Josef Waples's photo
Author
Josef Waples

FAQs

Was ist GPT-5.6?

GPT-5.6 ist OpenAIs neueste Modellgeneration. Statt eines einzelnen Modells kommt es als Familie aus drei Modellen: Sol (das Flaggschiff), Terra (ein ausgewogenes Alltagsmodell) und Luna (ein schnelles, kostengünstiges Modell).

Worin unterscheiden sich Sol, Terra und Luna?

Das sind Fähigkeitsstufen. Sol ist das stärkste und fähigste Modell. Terra ist die Mid-Tier-Stufe, insgesamt konkurrenzfähig zu GPT-5.5 und etwa doppelt so günstig. Luna ist die Budget-Stufe und liefert starke Fähigkeiten zu den niedrigsten Kosten. Im neuen Namenssystem steht die Zahl (5.6) für die Generation und der Name (Sol/Terra/Luna) für die dauerhafte Stufe, sodass jede Stufe sich in ihrem eigenen Tempo weiterentwickeln kann.

Kann ich GPT-5.6 schon nutzen?

Noch nicht allgemein. Zum Start ist GPT-5.6 in einer limitierten Vorschau über die API und Codex für einen kleinen Kreis vertrauenswürdiger Partner und Organisationen verfügbar. OpenAI plant, die Modelle bald breiter in ChatGPT, Codex und der API bereitzustellen.

Warum ist der GPT-5.6-Rollout so begrenzt?

OpenAI hat die Pläne und Fähigkeiten der Modelle vorab der US-Regierung vorgestellt und startet auf deren Bitte mit einer limitierten Vorschau für Partner, deren Teilnahme mit der Regierung geteilt wurde. OpenAI betont, dass dieses Zugriffsverfahren nicht zur langfristigen Norm werden sollte, sondern als kurzfristiger Schritt zu breiterer Verfügbarkeit dient, während man mit der Administration an einem Rahmen für eine Cyber-Executive-Order arbeitet.

Was kostet GPT-5.6?

Pro 1 Mio. Tokens: Sol kostet $5 Input / $30 Output, Terra $2.50 Input / $15 Output und Luna $1 Input / $6 Output. GPT-5.6 bringt außerdem berechenbareres Prompt-Caching: Cache-Writes kosten das 1,25-Fache der ungecachten Input-Rate, Cache-Reads behalten den 90%-Rabatt auf gecachte Inputs.

Was sind die Modi max und ultra?

Das sind zwei neue Wege, das Modell stärker zu fordern. max ist eine neue Einstellung für den Reasoning-Aufwand, die Sol maximale Zeit für tiefes Nachdenken gibt. ultra geht weiter und setzt Subagenten ein, um komplexe Arbeit über die Möglichkeiten eines Einzelagenten hinaus zu beschleunigen. In der Veröffentlichung erzielt \"GPT-5.6 Sol Ultra\" die beste Terminal-Bench-Wertung.

Wie schneidet GPT-5.6 in Benchmarks ab?

Auf Terminal-Bench 2.1 (Kommandozeile/Coding-Workflows) führt GPT-5.6 Sol Ultra mit 91,9%, gefolgt von Sol mit 88,8%, vor GPT-5.5 (88,0%) und Wettbewerbern wie Claude Mythos 5 (84,3%), Claude Fable 5 (83,4%), Claude Opus 4.8 (78,9%) und Gemini 3.1 Pro Preview (70,7%). OpenAI meldet außerdem Zugewinne in Biologie (GeneBench v1) und Cybersicherheit (ExploitBench, ExploitGym); eine umfassendere Evaluation soll zum breiten Release folgen.

Worin unterscheidet sich GPT-5.6 von GPT-5.5?

GPT-5.6 ist eine neue Generation mit einer Drei-Stufen-Familie und neuen max/ultra-Reasoning-Controls sowie Fortschritten in Coding, Biologie und Cybersicherheit. Außerdem kommt es mit einem stärkeren Sicherheits-Stack und einem vorsichtigeren, mit der Regierung abgestimmten Rollout. Im Vergleich dazu war GPT-5.5 ein breit verfügbares Default-Update mit Fokus auf Gesprächsqualität, weniger Halluzinationen und Personalisierung.

Wann kommt GPT-5.6 zu ChatGPT?

OpenAI hat kein fixes Datum genannt und sagt lediglich, dass die Modelle \"bald\" in ChatGPT, Codex und die API kommen und die Verfügbarkeit \"in den kommenden Wochen\" ausgebaut wird. Eine auf Cerebras gehostete Version von Sol (bis zu 750 Tokens/Sek.) ist ebenfalls für Juli geplant, zunächst für ausgewählte Kundinnen und Kunden.

Themen
Künstliche Intelligenz
ChatGPT

Lerne mit DataCamp

Kurs

Arbeiten mit der OpenAI Responses API

3 Std.
2.7K
Mit der OpenAI Responses API und GPT-5 kannst du jetzt einfacher als je zuvor intelligente, interaktive und zuverlässige KI-Anwendungen entwickeln.
Details anzeigenRight Arrow
Kurs Starten
Mehr anzeigenRight Arrow
Verwandt

Blog

Die 36 wichtigsten Fragen und Antworten zum Thema generative KI für 2026

Dieser Blog hat eine ganze Reihe von Fragen und Antworten zu generativer KI, von den Grundlagen bis hin zu fortgeschrittenen Themen.
Hesam Sheikh Hassani's photo

Hesam Sheikh Hassani

15 Min.

Blog

Arten von KI-Agenten: Ihre Rollen, Strukturen und Anwendungen verstehen

Lerne die wichtigsten Arten von KI-Agenten kennen, wie sie mit ihrer Umgebung interagieren und wie sie in verschiedenen Branchen eingesetzt werden. Verstehe einfache reflexive, modellbasierte, zielbasierte, nutzenbasierte, lernende Agenten und mehr.

Blog

Top 50+ AWS-Interviewfragen und Antworten für 2026

Ein kompletter Guide mit grundlegenden, fortgeschrittenen und szenariobasierten AWS-Interviewfragen – mit Beispielen aus der Praxis.
Zoumana Keita 's photo

Zoumana Keita

15 Min.

Blog

Lehrer/innen und Schüler/innen erhalten das Premium DataCamp kostenlos für ihre gesamte akademische Laufbahn

Keine Hacks, keine Tricks. Schüler/innen und Lehrer/innen, lest weiter, um zu erfahren, wie ihr die Datenerziehung, die euch zusteht, kostenlos bekommen könnt.
Nathaniel Taylor-Leach's photo

Nathaniel Taylor-Leach

4 Min.

Tutorial

OLS-Regression: Die wichtigsten Ideen erklärt

Gewinne Vertrauen in die OLS-Regression, indem du ihre theoretischen Grundlagen beherrschst. Erforsche, wie du einfache Implementierungen in Excel, R und Python durchführst.
Josef Waples's photo

Josef Waples

8 Min.

Tutorial

Python Switch Case Statement: Ein Leitfaden für Anfänger

Erforsche Pythons match-case: eine Anleitung zu seiner Syntax, Anwendungen in Data Science und ML sowie eine vergleichende Analyse mit dem traditionellen switch-case.
Matt Crabtree's photo

Matt Crabtree

5 Min.

Mehr AnzeigenMehr Anzeigen