Ein Wasserschwein ist zweigeteilt

Claude Sonnet 5.5 besser als Fable und Astra, aber mit einem Haken

Andreas Becker GPT-Images-2.0
Ein Wasserschwein ist zweigeteilt

Anthropic hebt sein Mittelklassemodell in die Spitzengruppe. Claude Sonnet 5.5 schlägt im unabhängigen Intelligence Index sogar Claude Fable 5.1 und GPT-6 Astra, obwohl eine Million Output-Token nur 10 Dollar kostet. Bei hohem Rechenaufwand kann das vermeintlich günstige Modell jedoch teurer als Opus 5.5 werden.

Sonnet 5.5 zieht an Fable und Astra vorbei

Artificial Analysis gibt Sonnet 5.5 mit maximalem Aufwand 56 Punkte. Fable 5.1 und GPT-6 Astra erreichen jeweils 53 Punkte. Nur Opus 5.5 liegt mit 58 Punkten noch davor, kommt mit der Stufe »xhigh« aber ebenfalls auf 56 Punkte.

Quelle: Artificial Intelligence

Im GDPval-AA v2.1 erzielt Sonnet 5.5 bei Wissensarbeit 1844 Elo, Opus 5.5 kommt auf 1846. Der preislich direkte Konkurrent GPT-6 Sol landet nur bei 1487. Im AA-Briefcase beträgt der Abstand zwischen Sonnet und Opus elf Elo-Punkte, während Sol 328 Punkte hinter Sonnet liegt.

Quelle: Artificial Intelligence

Auch beim Programmieren fallen die Werte stark aus. Sonnet 5.5 erreicht im Terminal-Bench 4.0 rund 71 Prozent und übertrifft Opus 5.5 mit 66 Prozent. Für GPT-6 Sol gibt es dort keinen veröffentlichten Wert.

Im FrontierCode erzielt Sonnet auf »xhigh« 52 Prozent, Sol schafft 49 Prozent und Opus 54 Prozent. Bei der visuellen Diagrammerkennung schlägt Sonnet Sol mit 62 zu 54 Prozent.

Anzeige

Der Haken steckt im Tokenverbrauch

Die niedrigen API-Preise erzählen nur einen Teil der Geschichte. Eingaben kosten 2 Dollar und Ausgaben 10 Dollar pro Million Token. Opus 5.5 verlangt mit 4 und 20 Dollar jeweils das Doppelte. Cache Reads kosten bei beiden Modellen 0,20 Dollar.

Trotzdem wird Sonnet 5.5 bei hohen Thinking-Stufen teilweise teurer. Im FrontierCode kostet ein Durchlauf auf »max« rund 20 Dollar, bei Opus 5.5 sind es etwa 6 Dollar. Dabei fällt Sonnet sogar von 52 auf 46 Prozent zurück.

Quelle: Artificial Intelligence

Im AA-Briefcase kostet die höchste Stufe knapp 30 Dollar und damit mehr als Opus mit gut 20 Dollar. Selbst im Terminal-Bench liegt Sonnet auf »max« knapp über Opus.

Quelle: Artificial Intelligence

Der Grund ist der Tokenverbrauch. Auf »max« arbeitet Sonnet länger, ruft beim FrontierCode häufiger die Code-Review-Funktion mit mehreren Subagenten auf und produziert mitunter zusätzliche Änderungen. Zwei untersuchte Läufe endeten deshalb mit einem Timeout oder zusätzlichen Änderungen außerhalb des Auftrags. Der günstige Tokenpreis wird von der Menge aufgefressen.

Das Ganze sieht man auch sehr deutlich im Token Verbrauch bei Artificial Intelligence:

Quelle: Artificial Intelligence

Preis und Verfügbarkeit

Für alltägliche Aufgaben bleibt Sonnet 5.5 attraktiv. Auf niedrigen und mittleren Thinking-Stufen liefert es einen großen Teil der Spitzenleistung zu deutlich geringeren Kosten. Anthropic setzt deshalb in Claude und Claude Code »medium« als Standard, während die Claude Platform mit »high« startet.

Claude Sonnet 5.5 ist in Claude, Claude Code und über die API als `claude-sonnet-5-5` verfügbar. Amazon Web Services, Google Cloud und Microsoft Azure bieten das proprietäre Modell ebenfalls an.

Haiku 5.5 soll übrigens in den kommenden Wochen folgen und wird dann hoffentlich preislich ein sehr attraktives Modell. Im GPT-6 Luna Bereich hat Anthropic aktuell gar nichts.

Von Menschen für Menschen

Jeder Artikel entsteht durch menschliche Ideen und sorgfältige Prüfung. KI unterstützt uns vor allem bei Recherche und Feinschliff. Wir freuen uns über jede Unterstützung.

Jeder Beitrag zählt – auch das Teilen.