Die Schlagzahl bei den großen KI-Modellen zieht wieder an. Für die kommende Woche verdichten sich Hinweise auf mehrere Spitzenmodelle von OpenAI, Anthropic und Google. Vor allem Gemini 4 Pro könnte einen deutlich größeren Schritt machen, als es die bisherigen Flash-Updates vermuten ließen.
Noch handelt es sich nicht um bestätigte Veröffentlichungen. Alle drei Modelle sind jedoch bereits in Testausgaben auf X und in der Arena sichtbar gewesen.
GPT-6 Sol und Opus 5.2 stehen bereit
GPT-6 Sol soll intern getestet worden und zeitweise in der OpenAI-API aufgetaucht sein. Geteilte Ausgaben zeigen aufwendige SVG- und 3D-Projekte. Das Modell gilt als schneller und günstiger als GPT-6 Astra, soll bei der Qualität aber nahe am Spitzenmodell liegen.
Bei Anthropic berichten Tester davon, dass Anfragen an Claude Opus 5 bereits an Opus 5.2 weitergeleitet werden. Die neue Fassung arbeite schneller, denke seltener unnötig lange nach und liefere bei visuellen sowie dreidimensionalen Aufgaben sichtbar bessere Ergebnisse. Ähnliche Hinweise gibt es für Sonnet 5.2 und Fable 5.2.
Anzeige
Gemini 4 Pro liefert die stärksten Lebenszeichen
Am auffälligsten sind die mutmaßlichen Tests von Gemini 4 Pro auf Arena.ai. In einem achtminütigen Lauf entstand eine begehbare Voxel-Pagode mit erstaunlich vielen Details.
Twitter Beitrag - Cookies links unten aktivieren.
Gemini 4 Pro in https://t.co/ScMwTKhW8r it's being tested under the name (gemini-3.8-flash)..
— Bee (@thtbee_) September 17, 2026
This output of Voxal Pagoda is so much better than the last checkpoint's output a few days ago!
It worked for 8 minutes.. seems like google cooked this time! pic.twitter.com/NHVtpAH8hK
Ein weiterer Test zeigte einen mechanischen Schmetterling in Three.js. Flügel, Zahnräder und die gesamte Präsentation wirkten aus einem Guss. Der Kandidat verschwand danach offenbar wieder aus der Arena.
Twitter Beitrag - Cookies links unten aktivieren.
Gemini 4 Pro surprises again!
— Bee (@thtbee_) September 19, 2026
The prompt was to it to create a beautiful mechanical butterfly in three.js and needless to say the output is indeed beautiful!
Earlier it was being tested under the placeholder "gemini-3.7-flash" but it seems to be have been removed from arena… pic.twitter.com/W46JGD2j8h
Einzelne Vorführungen ersetzen keinen Benchmark. Nach Einschätzung der Tester rückt Gemini 4 Pro aber womöglich bis knapp hinter GPT-6 Astra und Claude Fable. Auch Grok 4.7 und Kimi K3.1 könnten diese Woche kommen. Damit steht die dichteste Modellwoche seit Langem bevor.
