OpenAI macht Modelle bis zu 80% günstiger
Die KI Modelle Luna und Terra kosten nur noch einen Bruchteil. Das Spitzenmodell Sol wird erheblich schneller.

OpenAI macht seine Modelle GPT-5.6 Luna und Terra deutlich günstiger. Luna kostet künftig 80 Prozent weniger, während Entwickler das Spitzenmodell Sol über einen neuen Modus um das Zweieinhalbfache beschleunigen können.
Geringere Kosten für Entwickler und Nutzer
Nutzer von ChatGPT Work und Codex profitieren direkt von den Anpassungen. Die Modelle verbrauchen dort nun weniger Credits.
Für Entwickler, die über die API auf die Modelle zugreifen, sinken die Kosten spürbar. Eine Million Input-Token bei Terra kosten nun 2 US-Dollar, für Output-Token fallen 12 Dollar an. Der Preis für das auf hohe Volumina ausgelegte Modell Luna sinkt auf 0,20 Dollar für Input- und 1,20 Dollar für Output-Token.
Quelle: OpenAI
Luna erzielt damit ein Preis/Leistungsverhältnis, wo kein anderes Modell mehr mithalten kann. Auch die gesamte chinesische Konkurrenz nicht.
Modelle wie Gemini 3.1 Pro, das aktuelle Top Modell von Google, ist deutlich teurer und schlechter. GLM 5.2 ist auf einem ähnlichen Leistungsniveau, aber ebenso deutlich teurer. Selbst mit Claude Opus 5 auf der Low Einstellung kann es Luna Max aufnehmen.
Für viele Aufgaben dürfte damit die Wahl aktuell auf Luna fallen.
Quelle: OpenAI
Künstliche Intelligenz optimiert eigenen Code
Die Preissenkungen sind das Resultat grundlegender Effizienzsteigerungen bei der Hardwareauslastung und der Token-Generierung. Das Modell GPT-5.6 Sol hat bei dieser Optimierung aktiv mitgeholfen.
In einem von Menschen geführten Prozess schrieb Sol Teile der Produktionskernel selbst neu. Diese Code-Anpassungen senkten die Kosten für den Betrieb des Modells um 20 Prozent. Weitere Experimente verbesserten die Effizienz bei der Token-Generierung um über 15 Prozent.
Anzeige
Neuer Fast Mode für zeitkritische Aufgaben
Für Sol bleibt der Preis unverändert, Entwickler können aber einen neuen »Fast mode« aktivieren. Dieser ersetzt das bisherige Priority Processing in der API.
Kunden erhalten damit Antworten bis zu 2,5-mal schneller als bei der Standardverarbeitung. Die Intelligenz des Modells bleibt bei dieser Einstellung unverändert. Für den Geschwindigkeitsvorteil berechnet OpenAI den doppelten Preis der regulären Sol-Nutzung.

