Ein Wasserschwein beim Schreiben

Darum verlieren bessere KI-Modelle die Fähigkeit zu schreiben

Andreas Becker GPT-Images-2.0
Ein Wasserschwein beim Schreiben

Anthropic hebt beim neuen Claude Opus 5.5 eine Verbesserung hervor, die bei stärkeren KI-Modellen selbstverständlich wirken müsste. Die Texte sollen verständlicher werden. Antworten sollen schneller zum Punkt kommen, weniger Fachjargon enthalten und Schreibregeln zuverlässiger befolgen. Das Unternehmen reagiert damit auf Kritik an Opus 5, dessen Ausführungen vielen Nutzern zu dicht und schwer lesbar waren.

Warum ein klügeres Modell umständlicher schreibt

An der Überarbeitung war Anthropic-Mitarbeiter Jackson Kernion beteiligt. Opus 5.5 ist das erste Modell des Unternehmens, bei dem gezielt die Satzklarheit verbessert und überladene Informationsblöcke reduziert wurden. Mit dem Schreiben des Modells war er zuletzt bei Opus 4.6 ähnlich zufrieden.

Twitter Beitrag - Cookies links unten aktivieren.

Kernion führt den Rückschritt auf das Training zurück. Da die Fokussierung auf Programmierung und technische Erklärungen stärker belohnt wurde, fiel die sprachliche Ausgabe aus menschlicher Sicht entsprechend schlechter aus. Bei Opus 5.5 hat man nun auch einfache und gut klingende Erklärungen gezielt stärker belohnt.

Anzeige

Ist Opus 4.6 noch der Goldstandard?

Ein Blick auf die Arena für kreatives Schreiben gibt Opus 4.6 weiterhin Rückenwind. In der Rangliste vom 13. September erreicht die Variante mit hoher Thinking-Stufe 1500 Punkte. Knapp davor liegt Claude Fable 5 mit 1504 Punkten. Googles Gemini 3.8 Flash folgt mit 1496 Punkten.

Auffällig ist der Abstand zu neueren Modellen desselben Anbieters. Opus 5 mit hoher Thinking-Stufe erreicht dort 1474 Punkte. OpenAIs GPT-5.6 Sol erreicht bei sehr hoher Thinking-Stufe 1473 Punkte. Das sieht zwar nicht nach viel aus, aber in Foren sieht man am Ende den Frust, der zeigt, dass der Unterschied größer ist, als er punktemäßig erscheint.

Auch OpenAI arbeitet am Ton seiner Modelle. Bei den am 22. September ebenfalls vorgestellten Modellen GPT-6 Sol und Luna verspricht das Unternehmen klarere, kürzere Antworten mit weniger Fachjargon, insbesondere in technischen Gesprächen.

Ob OpenAI und Anthropic hier Verbesserungen erzielt haben, wird sich in den kommenden Tagen zeigen. In der Arena sind beide Modelle noch nicht aufgetaucht.

Von Menschen für Menschen

Jeder Artikel entsteht durch menschliche Ideen und sorgfältige Prüfung. KI unterstützt uns vor allem bei Recherche und Feinschliff. Wir freuen uns über jede Unterstützung.

Jeder Beitrag zählt – auch das Teilen.