OpenAI hat die API-Preise für zwei seiner GPT-5.6-Modelle gesenkt: Luna wird um 80 Prozent günstiger, Terra um 20 Prozent.
Seit dem 30. Juli kostet GPT-5.6 Luna, das kleinste und schnellste Modell der GPT-5.6-Familie, noch 0,20 US-Dollar pro Million Eingabe-Tokens und 1,20 US-Dollar pro Million Ausgabe-Tokens, zuvor waren es 1 beziehungsweise 6 US-Dollar. Terra, das mittlere Modell der Reihe, sank von 2,50 auf 2 US-Dollar pro Million Eingabe-Tokens sowie von 15 auf 12 US-Dollar pro Million Ausgabe-Tokens. Das Spitzenmodell Sol bleibt bei unveränderten 5 US-Dollar pro Million Eingabe- und 30 US-Dollar pro Million Ausgabe-Tokens. Nach Angaben von OpenAI gehen die Einsparungen auf verbesserte GPU-Kernel in der Produktionsumgebung sowie eine um mehr als 15 Prozent gesteigerte Effizienz bei der Token-Generierung zurück, unter anderem weil OpenAI das Modell Sol selbst zur Optimierung der eigenen Laufzeiteffizienz eingesetzt habe.
Die neuen Preise wirken sich laut OpenAI auch auf die Kontingentberechnung in Codex und ChatGPT Work aus: Aufgaben, die künftig Luna oder Terra nutzen, verbrauchen dadurch einen kleineren Anteil des jeweiligen Nutzungskontingents, während sich die Abonnementpreise selbst nicht ändern. Zusätzlich stellt OpenAI die automatische Codeprüfung Auto-review in der ChatGPT-App und der Codex-Kommandozeile von GPT-5.4 auf GPT-5.6 Luna um, was die Kosten für diese Funktion nach eigenen Angaben um etwa das Zehnfache senken soll.
Schnellerer, aber teurerer Modus für GPT-5.6 Sol
Für das Spitzenmodell GPT-5.6 Sol führte OpenAI zusätzlich einen sogenannten Fast-Modus für API-Kunden ein, der die Verarbeitung um bis zu das 2,5-Fache beschleunigt, ohne die Modellintelligenz zu verändern. Die zusätzliche Geschwindigkeit kostet doppelt so viel wie die Standardverarbeitung und richtet sich damit vor allem an zeitkritische Programmier-, Recherche- und Agentenaufgaben. Für die meisten anderen Anwendungsfälle sei der Fast-Modus laut OpenAI nicht notwendig.
Die Preissenkung fällt in eine Phase verstärkten Preiswettbewerbs unter den führenden KI-Anbietern: Erst wenige Tage zuvor hatte Anthropic sein Modell Claude Opus 5 zum gleichen Preis wie den Vorgänger Opus 4.8 veröffentlicht, während Google mit Gemini 3.6 Flash und Gemini 3.5 Flash-Lite ebenfalls neue, auf niedrigere Kosten ausgelegte Modelle vorstellte.
(red)