Anthropic hebt beim neuen Claude Opus 5.5 eine Verbesserung hervor, die bei stärkeren KI-Modellen selbstverständlich wirken müsste. Die Texte sollen verständlicher werden. Antworten sollen schneller zum Punkt kommen, weniger Fachjargon enthalten und Schreibregeln zuverlässiger befolgen. Das Unternehmen reagiert damit auf Kritik an Opus 5, dessen Ausführungen vielen Nutzern zu dicht und schwer lesbar waren.
Warum ein klügeres Modell umständlicher schreibt
An der Überarbeitung war Anthropic-Mitarbeiter Jackson Kernion beteiligt. Opus 5.5 ist das erste Modell des Unternehmens, bei dem gezielt die Satzklarheit verbessert und überladene Informationsblöcke reduziert wurden. Mit dem Schreiben des Modells war er zuletzt bei Opus 4.6 ähnlich zufrieden.
Twitter Beitrag - Cookies links unten aktivieren.
I worked on this, and Opus 5.5 is our first model model release with targeted improvements on sentence clarity and overly-dense info dumps.
— Jackson Kernion (@JacksonKernion) September 22, 2026
It's a hard problem to solve, and we'll continue to make improvements. But I haven't been as happy about a model's writing since Opus 4.6. https://t.co/W5jVOWMnYj
Kernion führt den Rückschritt auf das Training zurück. Da die Fokussierung auf Programmierung und technische Erklärungen stärker belohnt wurde, fiel die sprachliche Ausgabe aus menschlicher Sicht entsprechend schlechter aus. Bei Opus 5.5 hat man nun auch einfache und gut klingende Erklärungen gezielt stärker belohnt.
Anzeige
Ist Opus 4.6 noch der Goldstandard?
Ein Blick auf die Arena für kreatives Schreiben gibt Opus 4.6 weiterhin Rückenwind. In der Rangliste vom 13. September erreicht die Variante mit hoher Thinking-Stufe 1500 Punkte. Knapp davor liegt Claude Fable 5 mit 1504 Punkten. Googles Gemini 3.8 Flash folgt mit 1496 Punkten.
Auffällig ist der Abstand zu neueren Modellen desselben Anbieters. Opus 5 mit hoher Thinking-Stufe erreicht dort 1474 Punkte. OpenAIs GPT-5.6 Sol erreicht bei sehr hoher Thinking-Stufe 1473 Punkte. Das sieht zwar nicht nach viel aus, aber in Foren sieht man am Ende den Frust, der zeigt, dass der Unterschied größer ist, als er punktemäßig erscheint.
Auch OpenAI arbeitet am Ton seiner Modelle. Bei den am 22. September ebenfalls vorgestellten Modellen GPT-6 Sol und Luna verspricht das Unternehmen klarere, kürzere Antworten mit weniger Fachjargon, insbesondere in technischen Gesprächen.
Ob OpenAI und Anthropic hier Verbesserungen erzielt haben, wird sich in den kommenden Tagen zeigen. In der Arena sind beide Modelle noch nicht aufgetaucht.
