OpenAI schiebt GPT-6.1 Sol zwischen sein Spitzenmodell Astra und das günstige Luna. Das neue KI-Modell kostet nur ein Fünftel von Astra, kommt ihm bei Programmierung, Computerbedienung und professioneller Wissensarbeit aber nahe. Damit wird Sol zum Modell für anspruchsvolle Aufgaben, bei denen Astra bisher zu teuer war.
EDIT: Artificial Intelligence Benchmarks hinzugefügt.
Besser und günstiger
Der Sprung von GPT-5.6 Sol zu GPT-6 Sol war ja quasi nicht vorhanden. GPT-6.1 Sol ist deutlich besser und fast auf einem Niveau mit GPT Astra, das fünfmal so teuer ist. Überraschenderweise hat sich Sol diesen Sprung nicht mit zusätzlichen Token erkauft, im Gegenteil, es ist sogar noch mal günstiger geworden.
Aktuell sind damit vier KI-Modelle interessant. Am günstigsten ist Luna, etwas teurer, aber auch ein gutes Stück besser ist MiMi V2.6 Pro, dann folgt schon GPT-6.1 Sol. Es ist quasi das Modell im Mittefeld. Besser und günstiger als Muse Spark, GLM 5.3, Grok 4.7 oder auch Gemini 3.8 Flash.
Darüber folgen nur noch die Claude-Modelle, die jedoch zu einem ganz anderen Preis erhältlich sind.
Quelle: Artificial Intelligence
Viel Leistung pro Dollar
Bei DeepSWE 1.1 löst GPT-6.1 Sol Aufgaben in echten Codebasen auf dem Niveau von GPT-6 Astra. Gegenüber GPT-6 Sol steigt der beste Wert um sechs Prozentpunkte, obwohl der erfolgreiche Lauf weniger Reasoning und damit weniger Geld benötigt. Astra kostet pro Aufgabe ungefähr fünfmal so viel.
Quelle: OpenAI
Auch bei der Arbeit mit komplexen PDF-Dokumenten hält das neue Modell mit der teureren Konkurrenz mit. In GDP.pdf übertrifft es sogar Opus 5.5 über die getesteten Reasoning-Stufen hinweg und benötigt dafür weniger als die Hälfte der Kosten. Astra erzielt noch etwas bessere Resultate, ist pro Aufgabe jedoch ebenfalls rund fünfmal teurer.
Quelle: OpenAI
AutomationBench prüft mehrstufige Geschäftsabläufe mit 47 Tools aus Bereichen wie Vertrieb, Support, Finanzen und Personal. Bei mittlerem Reasoning liegt GPT-6.1 Sol zwei Prozentpunkte vor Opus 5.5 und fünf Punkte vor GPT-6 Sol. Der Vorsprung trifft damit einen Bereich, in dem Agenten nicht nur antworten, sondern mehrere Schritte korrekt ausführen müssen.
Quelle: OpenAI
Bei wissenschaftlichen Aufgaben fällt der Sprung besonders groß aus. Im Terminal-Bench Science 0.1 erreicht GPT-6.1 Sol mit maximalem Reasoning 57 Prozent und kostet durchschnittlich 5,47 Dollar pro Aufgabe. GPT-6 Sol kommt nur auf 28 Prozent, während Astra mit 68 Prozent gewinnt und dafür durchschnittlich 23,80 Dollar verbraucht.
Quelle: OpenAI
Weniger Fehler und weniger Regelverstöße
Bei schwierigen Fragen sinkt der Anteil der Antworten mit mindestens einem Sachfehler bei niedrigem Reasoning von elf auf acht Prozent. In den Sicherheitstests verschweigt GPT-6.1 Sol ein defektes Suchtool in rund zwei Prozent der Fälle, GPT-6 Sol in fünf Prozent.
Quelle: OpenAI
Deutlicher ist der Unterschied bei Versuchen, Warnungen zu umgehen. Die Quote fällt von 64 auf 24 Prozent. Beim automatisierten Sicherheitsprüfer verzeichnete OpenAI wie bei Astra und dem bisherigen Sol keinen Umgehungsversuch.
Quelle: OpenAI
Preise und Verfügbarkeit
GPT-6.1 Sol ist in ChatGPT Work und Codex für Plus, Pro, Business, Enterprise und Edu verfügbar, aber noch nicht im normalen Chat. Über die API heißt das Modell »gpt-6.1-sol«.
Eine Million Eingabetoken kostet 2 Dollar, eine Million Ausgabetoken 10 Dollar. Für wiederverwendete Eingaben berechnet OpenAI 0,10 Dollar pro Million Token, halb so viel wie beim bisherigen Sol. In den kommenden Tagen folgt zudem GPT-6.1 Sol Ultrafast und erzeugt in Codex bis zu achtmal schneller Text.









