Eine Spinne im Weltraum

Grok 4.7 ist der beste günstige Programmierer

Andreas Becker GPT-Images-2.0
Eine Spinne im Weltraum

SpaceXAI bringt mit Grok 4.7 ein neues Spitzenmodell für Programmierung und Wissensarbeit auf den Markt. Es verfolgt schwierige Aufgaben länger, prüft die eigene Arbeit gründlicher und verwaltet längere Kontexte besser. Trotz eines größeren Basismodells bleiben die API-Preise auf dem Niveau von Grok 4.6.

Für das Training setzte das Unternehmen auf eine längere Reinforcement-Learning-Phase mit schwierigeren Aufgaben, deren Bearbeitung sich über viele Stunden erstrecken kann. Grok 4.7 versteht außerdem die Arbeitsumgebung von Grok Bot von Haus aus. Davon profitieren längere Projekte ebenso wie Dialoge und allgemeine Wissensarbeit.

Anzeige

Großer Sprung bei längeren Aufgaben

Im CursorBench 4.0 erreicht Grok 4.7 mit der Thinking-Stufe xHigh einen Wert von 46 Prozent. Der Vorgänger kommt auf 40 Prozent, GPT-5.6 Sol auf 42 Prozent. Fable 5.1 bleibt einzig mit knapp 52 Prozent noch vorn.

Quelle: spacex

Die von SpaceXAI veröffentlichte Kostenkurve bescheinigt Grok 4.7 dabei ein günstigeres Verhältnis zwischen Ergebnis und Rechenkosten als den aufgeführten Konkurrenten.

Quelle: spacex

Noch deutlicher fällt der Fortschritt im Terminal-Bench 4.0 aus. Dort steigt das Ergebnis von 20 auf 38 Prozent. Bei DeepSWE v1.1 legt Grok von 65 auf 71 Prozent zu und liegt damit knapp hinter GPT-5.6 Sol mit 73 Prozent.

Auch bei umfangreicher Büroarbeit schließt das Modell zur Spitze auf. Im AA Briefcase v1.1 erreicht es 1.657 Punkte, gegenüber 1.546 Punkten beim Vorgänger. Fable 5.1 liegt mit 1.678 Punkten nur knapp darüber, GPT-5.6 Sol mit 1.487 Punkten dahinter. Im Elektrotechnik-Test EEBench führt Grok 4.7 den Vergleich mit 64 Prozent sogar an.

Anzeige

Gleicher Preis und neue Schutzmechanismen

Eine Million Eingabe-Token kostet zwei Dollar, eine Million Ausgabe-Token sechs Dollar. Damit bleibt Grok 4.7 so teuer wie sein Vorgänger und kostet bei der Ausgabe weniger als ein Drittel von GPT-5.6 Sol. Eine schnellere Variante verdoppelt Ausgabegeschwindigkeit, aber auch Preis.

SpaceXAI hat zudem die Schutzmechanismen neu aufgebaut. Im HackerBench v0.3 ließ das Modell 3 Prozent der riskanten Anfragen passieren, während legitime Sicherheitsaufgaben nur selten blockiert wurden. Im Biosicherheits-Benchmark von LatchBio erreichte es 62 Prozent.

Grok 4.7 ist über Cursor, Grok Build und die Grok API verfügbar. Hinzu kommen externe Coding-Umgebungen, Modellrouter und Cloud-Plattformen. Einen gesonderten Start für den Grok-Chat auf X oder grok.com nennt SpaceXAI nicht.

Von Menschen für Menschen

Jeder Artikel entsteht durch menschliche Ideen und sorgfältige Prüfung. KI unterstützt uns vor allem bei Recherche und Feinschliff. Wir freuen uns über jede Unterstützung.

Jeder Beitrag zählt – auch das Teilen.