Eine Revolution in drei Stufen
Am 9. Juli 2026 veröffentlichte OpenAI die mit Spannung erwartete Modellfamilie GPT-5.6 — bestehend aus drei Stufen: Sol, Terra und Luna, benannt nach Sonne, Erde und Mond. Die Veröffentlichung markiert einen strategischen Wandel von einem einzelnen monolithischen Modell hin zu einer gestaffelten Architektur, bei der jede Variante für unterschiedliche Workloads, Preispunkte und Leistungsanforderungen optimiert ist.
Sol ist das Flaggschiff — OpenAIs leistungsstärkstes Modell aller Zeiten, konzipiert für komplexe Programmieraufgaben, wissenschaftliche Forschung, Biologie-Workflows und Cybersicherheit. Terra bietet eine mit GPT-5.5 vergleichbare Leistung zu halben Kosten und positioniert sich als das tägliche Arbeitstier. Luna ist der Budget-Champion mit starker Leistung zum niedrigsten Preis.
Maßstäbe setzende Fähigkeiten
GPT-5.6 Sol erzielt Spitzenwerte bei Terminal-Bench 2.1, einem Benchmark für reale Kommandozeilen-Workflows, die Planung, Iteration und Multi-Tool-Koordination erfordern. Es erreicht auch Höchstwerte bei GeneBench v1 für langfristige Genomanalysen und wettbewerbsfähige Ergebnisse bei ExploitBench für Cybersicherheits-Schwachstellenforschung — mit etwa einem Drittel der Ausgabe-Tokens vergleichbarer Modelle.
Ein neuer "Max"-Modus für Denkanstrengungen gibt Sol zusätzliche Zeit für die schwierigsten Probleme, während ein "Ultra"-Modus Sub-Agenten einsetzt, die bei komplexen Aufgaben zusammenarbeiten.
Sicherheit geht vor
OpenAI investierte über 700.000 A100-äquivalente GPU-Stunden in automatisiertes Red-Teaming. Der Sicherheits-Stack umfasst modellseitiges Training zur Ablehnung verbotener Anfragen, Echtzeit-Output-Klassifikatoren, kontenbasiertes Verhalten-Tracking und differenzierte Zugriffskontrollen.
Preisgestaltung und Verfügbarkeit
GPT-5.6 kostet pro Million Tokens: Sol $5/$30 (Eingabe/Ausgabe), Terra $2.50/$15, Luna $1/$6. Die Modelle sind zunächst über API und Codex für ausgewählte Partner verfügbar, mit breiterem Zugang in den kommenden Wochen. Sol wird zudem auf Cerebras-Hardware mit bis zu 750 Tokens pro Sekunde laufen.




