Alibaba hat mit Qwen3.8-Max-0902 ein Update seines KI-Modells veröffentlicht. In der Auswertung von Arena.ai setzt es sich direkt an die Spitze des WebDev-Leaderboards und verdrängt Claude Opus 5 auf den zweiten Platz.
Starke Ergebnisse beim Programmieren
Die Entwickler haben das Modell nach eigenen Angaben gezielt für Programmieraufgaben und berufliche Arbeitsabläufe nachtrainiert. In der sogenannten Code Arena erreicht die neue Version dafür 1691 Punkte.
Quelle: arena ai
Damit liegt Qwen3.8-Max-0902 knapp vor Claude Opus 5 und 22 Punkte über seinem direkten Vorgänger. Während es bei der Datenanalyse und Endkundenprodukten den ersten Platz belegt, reicht es bei Markenkommunikation, Gaming und Simulationen für Platz zwei.
Qwen3.8-Max-0902 punktet zudem bei komplexen Agentenaufgaben. Im CoWorkBench, wo es um langfristige Büroarbeiten geht, gibt es 76.1 Punkte. Mehr als Fable 5 und GPT 5.6 Sol.
Bei den Coding Benchmarks liegt man beim TerminalBench 3.0 mit 29 Punkten noch deutlich hinter Opus 5 mit 42.7 Punkten, aber hat trotzdem gegenüber den 11.3% vom direkten Vorgänger einen gewaltigen Sprung gemacht.
Bei den restlichen Benchmarks liegt man wieder deutlich dichter an den Top Modellen der Konkurrenz dran.
Quelle: Alibaba
Parameter und Preise
Mit 2,4 Billionen Parametern und einem Kontextfenster von einer Million Token zielt Alibaba auf lange Workflows und Forschungsaufgaben ab, bei denen extrem viele Daten am Stück verarbeitet werden müssen.
Nutzer können über die QwenCloud-Schnittstelle auf die neue Version zugreifen. Die Kosten liegen bei zwei US-Dollar für eine Million Eingabe-Token und sechs US-Dollar für die Ausgabe. Wenn Anfragen aus dem Zwischenspeicher bedient werden können, sinkt der Preis für die Eingabe auf 17 US-Cent.
Die Plattform Arena.ai berechnet daraus einen Mischpreis von rund fünf US-Dollar pro Million Token. Qwen liefert damit aktuell das beste Verhältnis aus Kosten und Leistung in der Spitzengruppe.


