OpenAI hat weitreichende Updates für seine GPT-5.6-Modellfamilie angekündigt. Die Einsteigermodelle Luna und Terra werden deutlich günstiger, während das leistungsstärkste Modell Sol über einen neuen Fast Mode bis zu 2,5-mal schneller antwortet. Unternehmen können künftig mehr KI-Workloads wirtschaftlich betreiben – von Routineaufgaben bis hin zu komplexen Agenten-Workflows.
Preissenkungen bei Luna und Terra
Ab sofort sinken die Kosten für GPT-5.6 Luna um satte 80 Prozent. Das Unternehmen bezeichnet Luna als schnellstes und günstigstes Modell der Reihe, das nun auch für hochvolumige Anwendungen massiv an Attraktivität gewinnt. Gleichzeitig wird GPT-5.6 Terra, die ausgewogene Lösung für den täglichen Einsatz, um 20 Prozent preisgünstiger.
Die günstigeren Preise wirken sich auch auf die Nutzung in Codex und ChatGPT Work aus. Dort verbrauchen Luna und Terra ab sofort weniger Credits aus dem Abonnement. Luna unterstützt Werkzeugnutzung und mehrstufige Workflows, wodurch eine breitere Palette an KI-Anwendungen im großen Maßstab praktikabel wird.
Fast Mode beschleunigt GPT-5.6 Sol
Für das leistungsstärkste Modell der Familie, GPT-5.6 Sol, führt OpenAI den Fast Mode in der API ein. Dieser ersetzt das bisherige Priority Processing und bietet bis zu 2,5-mal schnellere Verarbeitung im Vergleich zum Standardmodus – zum doppelten Preis, aber ohne Verlust an Intelligenz. Bestehende API-Anfragen, die mit dem Priority-Tag versehen sind, funktionieren dank Abwärtskompatibilität automatisch im neuen Fast Mode.
Kundenstimmen: Mehr Leistung für weniger Budget
Zahlreiche Unternehmen bestätigen in eigenen Evaluierungen die überzeugende Balance aus Kosten, Geschwindigkeit und Qualität. Michele Catasta, President und Head of AI bei Replit, hebt hervor: GPT-5.6 Luna kommt der Vision von Intelligenz, die zu günstig zum Messen ist, am nächsten. Ich habe noch nie ein so preiswertes Modell gesehen, das gleichzeitig so leistungsstark ist.
Bei Notion überzeugt Terra im persönlichen Agenten, insbesondere bei Workspace-Q&A und zeitkritischen Aufgaben. Hoda Noorian von Notion erklärt, dass Terra vergleichbare Qualität wie GPT-5.5 bei halben Kosten und 60 Prozent weniger Latenz liefere.
Auch Blitzy meldet signifikante Effizienzgewinne. Sid Pardeshi, CTO und Co-Founder, berichtet von einem Wechsel zu vollständigen Tool-Calling-Agent-Loops, einer Erhöhung der Prompt-Cache-Wiederverwendung von 24 auf 90 Prozent sowie 8,5-mal weniger Output-Tokens – bei 87 Prozent niedrigeren Kosten gegenüber GPT-5.4 mini.
Intelligenz passgenau zum Ergebnis
Die GPT-5.6-Familie ermöglicht es Unternehmen, für jeden Arbeitsschritt das passende Verhältnis aus Intelligenz, Geschwindigkeit und Kosten zu wählen. Luna liefert laut OpenAI Leistung vergleichbar mit Modellen, die vor einem Jahr noch als Spitzenklasse galten – zu etwa sechs Prozent der damaligen Kosten pro Aufgabe und fast neunmal so schnell.
Im Praxistest übertrifft Luna bei professioneller Arbeit, gemessen am Benchmark Agents‘ Last Exam, das Modell Fable 5 bei geschätzt 99 Prozent niedrigeren Kosten pro Aufgabe. So lässt sich beispielsweise ein Coding-Workflow mit Sol starten, um Unsicherheiten zu klären, während Luna spezifizierte Änderungen, Tests und Evaluierungen übernimmt.
Technik im Hintergrund: So funktioniert die Effizienz
Die Preisvorteile resultieren aus Verbesserungen auf mehreren Ebenen. Optimierte Routenführung hält die Hardware produktiver, effizientere Produktionssoftware generiert Tokens schneller, und intelligentes Kontextmanagement verhindert wiederholte Arbeitsschritte bei Agenten. Zusammen ermöglichen diese Fortschritte mehr nutzbringende Arbeit mit gleicher Rechenleistung.
Besonders bemerkenswert ist, dass GPT-5.6 Sol selbständig zur Effizienzsteigerung beigetragen hat. Innerhalb eines menschlich überwachten Prozesses optimierte Sol Produktionskernel automatisch, entwickelte hunderte Experimente zur Verbesserung der Token-Generierung und überwachte das Training. Das Kernel-Update senkte die End-to-End-Kosten um 20 Prozent, die Experimente steigerten die Effizienz um über 15 Prozent.
Verfügbarkeit und neue Preise
GPT-5.6 Terra und Luna sind weiterhin in ChatGPT Work, Codex und der OpenAI API verfügbar. In ChatGPT Work und Codex haben Free- und Go-Nutzer Zugang zu Terra, während Plus-, Pro-, Business- und Enterprise-Nutzer zwischen Terra und Luna wählen können.
Die neuen API-Preise gelten ab dem 30. Juli: Terra kostet 2 US-Dollar pro Million Input-Tokens und 12 US-Dollar pro Million Output-Tokens. Luna ist mit 0,20 US-Dollar pro Million Input-Tokens und 1,20 US-Dollar pro Million Output-Tokens deutlich günstiger. Die Preise für Sol bleiben unverändert. Abonnement-Preise und Budgets in ChatGPT und Codex bleiben ebenfalls bestehen, während Terra- und Luna-Nutzung weniger Credits beansprucht. Die neuen Preise werden zunächst bei AWS ausgerollt.
Quelle: OpenAI Blog