GPT-5.6 ist da: Sol, Terra, Luna — Effizienz by default, Power on demand
OpenAI hat GPT-5.6 am 9. Juli 2026 für ChatGPT, Codex und die API freigegeben: Flagship Sol, ausgewogenes Terra und kostengünstiges Luna. Hier erfährst du, was veröffentlicht wurde, die drei Preisstufen und was das bedeutet, wenn du mit KI baust.
Am 9. Juli 2026 hat OpenAI die GPT-5.6-Familie für die allgemeine Verfügbarkeit in ChatGPT, Codex und der OpenAI API freigegeben. Nach einer begrenzten Preview ab dem 26. Juni läuft das vollständige Rollout: Sol als neues Flagship, Terra als ausgewogene Alltagsstufe und Luna als günstigste Option der Linie.
Nachdem Anthropic Fable veröffentlicht hatte, hat die US-Regierung den globalen Zugang zu KI-Diensten strenger geregelt — OpenAI musste GPT-5.6 deshalb zuerst einer kleinen Nutzergruppe öffnen und erst danach weltweit freigeben, als es unbedenklich wirkte. Die Erwartung war ziemlich hoch, ob es Fables Schlag aushält. Das Community-Feedback bisher: eher nicht — vor allem teurer, ohne klaren Effizienzsprung gegenüber 5.5.
Was OpenAI geliefert hat
Laut der offiziellen GPT-5.6-Ankündigung gingen ChatGPT, Codex und die API am 9. Juli gemeinsam live; die globale Verfügbarkeit füllte sich in den etwa 24 Stunden danach auf.
Das Naming ist Absicht:
| Stufe | Rolle | Offizieller Listenpreis (pro 1M Tokens) |
|---|---|---|
| Sol | Flagship-Intelligenz und Coding | $5 Input / $30 Output |
| Terra | Ausgewogene Alltagsarbeit; konkurrenzfähig zu GPT-5.5 bei niedrigeren Kosten — grob der frühere „mini“-Platz | $2.50 Input / $15 Output |
| Luna | Schnellste und günstigste Stufe der Familie — grob der frühere „nano“-Platz | $1 Input / $6 Output |
Die Zahl (5.6) markiert die Generation. Sol, Terra und Luna sind dauerhafte Fähigkeitsstufen, die im eigenen Takt voranschreiten können. In der API heißen die expliziten Model-IDs gpt-5.6-sol, gpt-5.6-terra und gpt-5.6-luna. Der Kurzname gpt-5.6 ist gleichbedeutend mit Sol — nutze die vollständige ID für Terra oder Luna.
Warum dieses Release anders ist
OpenAI rahmt GPT-5.6 als effizient by default, maximale Performance on demand. Das ist die offizielle Story:
| Bereich | Was OpenAI hervorhebt | Warum es zählt |
|---|---|---|
| Token-Effizienz | Stärkere Ergebnisse mit weniger Tokens und niedrigeren geschätzten Kosten | Kosten pro fertiger Aufgabe können besser aussehen als der Listenpreis allein |
| Coding-Agents | SOTA-Claims auf Artificial Analysis Coding Agent Index, Terminal-Bench 2.1, DeepSWE | Besser geeignet für mehrstufige Implementierung, CLI-Workflows und Long-Horizon-Engineering |
| Knowledge Work | Stärkeres BrowseComp und OSWorld 2.0; solidere Decks, Docs und Spreadsheets | Zuverlässigerer Weg von messigen Inputs zu Deliverables |
| Design + Computer Use | Gerenderte UI inspizieren und verfeinern, nicht nur Code ausspucken | Näher an einem Kollaborateur, der Arbeit zurückgeben kann |
| Programmatic Tool Calling | Modell kann leichte Programme schreiben und ausführen, die Tools koordinieren | Weniger Roundtrips und weniger Intermediate-Token-Bloat |
max / ultra | Längere Reasoning-Zeit (max); Multi-Agent-Parallel-Arbeit by default (ultra) | Mehr ausgeben nur, wenn die Aufgabe es wert ist |
Partner stimmten in dieselbe Melodie ein: bessere Qualität, oft weniger Tokens, niedrigere Latenz. Behandle dieses kommerzielle gegenseitige Lob als optional — probiere es selbst.
Verfügbarkeit und API-Details
In dieser Produktlinie ist GPT-5.6 das erste Mal, dass ChatGPT, Codex und die API am selben Tag live gingen (nach nur einer kurzen Trusted-Partner-Preview).
- ChatGPT / ChatGPT Work / Codex: Sol / Terra / Luna rollen je nach Plan aus; Free und Go sehen meist ein eingeschränkteres Set als Plus / Pro / Business / Enterprise. In Community-Chats berichten manche, dass sie 5.6 noch gar nicht sehen.
- API: Alle drei Stufen sind aufrufbar. Programmatic Tool Calling in der Responses API ist als Zero-Data-Retention-(ZDR)-kompatibel markiert; Multi-Agent startet in Beta für ultra-ähnliche Koordination.
- Prompt Caching: Für GPT-5.6 und später werden Cache-Writes mit 1,25× der Rate abgerechnet; Cache-Reads behalten 90 % Rabatt (Preis auf ein Zehntel). Prompt Caching braucht explizite Cache-Breakpoints und mindestens 30 Minuten Cache-Lebensdauer.
Vor Produktion verlass dich auf den Model Picker deines Accounts und die API-Pricing-Seite — hardcode keine Drittanbieter-Context-Längen. Viele Listen nennen ~1M Context für Sol/Terra; behandle das als Hinweis, bis dein Dashboard zustimmt.
Sicherheit, unangenehm
OpenAI sagt, GPT-5.6 starte mit den bislang robustesten Safeguards, nach einem längeren Evaluationszyklus: Red Teaming, großflächige automatisierte Tests und Partner-Pressure-Testing in der Preview. Je mehr du vom Modell erwartest, dass es Arbeit erledigt, desto wichtiger wird Kontrolle — besonders an Agents, die browsen, Code editieren oder Software bedienen.
Leider beschwerten sich heute schon Leute auf X, dass Codex ihr ganzes Home-Verzeichnis gelöscht habe…
Warum das für Builder zählt
GPT-5.6 schiebt die Branche weiter vom „smarten Chat“ hin zu Operatoren, die Arbeit zu Ende bringen. Die praktischen Fragen werden:
- Welche Stufe für welchen Job: Sol für schwere agentische Arbeit, Terra als täglicher Default, Luna für Volumen und Kosten?
- Bewertest du Kosten als „Preis eines fertigen Workflows“, nicht nur pro Token?
- Wann lohnt
ultragegenüber einem Single-Agent-max-Pass? - Wie hältst du Integration stabil, während sich Modellnamen und Stufen bewegen?
Genau dort verdient ein unified Gateway seinen Platz.
Was das für MuiRouter-Nutzer bedeutet
MuiRouters Ziel ist einfach: ein API-Key, eine Request-Form und Zugang zu den besten aktuellen Modellen. OpenAI hat offiziell geliefert — du kannst diese neuen Modelle also ebenfalls ausprobieren.
Fazit
GPT-5.6 lohnt Aufmerksamkeit, weil OpenAI explizit den Preis für eine fertige Aufgabe betont, nicht den Preis pro Token. Wenn du ChatGPT oder Codex nutzt, teste Sol zuerst bei langer agentischer und Coding-Arbeit; für Alltags-Copy ist Terra die sinnvolle erste Stufe. Luna — persönlich würde ich die unterste Stufe nicht empfehlen.
Laut frühem Community-Feedback ist der Sprung gegenüber 5.5 vielleicht nicht dramatisch, und Fable holt es auch nicht ein. Behandle es vorerst als routinemäßiges Knowledge-Base-Upgrade.
Referenzquellen
Hauptquelle veröffentlicht am 9. Juli 2026.
Bereiten Sie sich auf die nächste KI-Veränderung vor
Starten Sie mit einer API Key und einem klareren Weg, Modellzugang stabil zu halten, während sich Tools und Upstream-Verfügbarkeit ändern.