SpaceXAI hat Grok 4.7 veröffentlicht, und unabhängige Bewertungen sehen es auf Platz vier unter den führenden KI-Laboren.
Artificial Analysis, ein unabhängiges Benchmark-Unternehmen, gibt dem Modell 46 Punkte auf dem Intelligence Index, zwei Punkte mehr als Grok 4.6. Claude Fable 5.1, GPT-6 Astra und Claude Opus 5 liegen weiterhin vor Grok 4.7.
Grok 4.7 bringt SpaceXAI unter die Top Vier der KI-Labore
Elon Musk sagte vor der Veröffentlichung , dass das Modell auf einer Basis mit 2,1 Billionen Parametern läuft und alle bisherigen Modelle übertreffen soll. Er sagte zudem, dass beim Training des Modells auch Daten von SpaceX verwendet wurden.
Folgen Sie uns auf X , um aktuelle Nachrichten in Echtzeit zu erhalten
Doch wie gut ist Grok 4.7 wirklich? Beim AA-Briefcase, einem Benchmark von Artificial Analysis für realistische berufliche Aufgaben, erreichte Grok 4.7 einen Wert von 1657 Elo. Das sind 111 Punkte mehr als Grok 4.6 und nahe am Niveau von Claude Opus 5.
Beim GDPval-AA-Test kam das Modell auf 1695 Elo. Das sind 90 Punkte mehr als die Vorgängerversion. Auch die Programmierergebnisse verbesserten sich.
Kombiniert mit Grok Build, dem eigenen Coding-Agenten, erreichte Grok 4.7 einen Wert von 56 auf dem Coding Agent Index. Das sind neun Punkte mehr als Grok 4.6.
Das Modell überholte GPT-5.6 Sol und liegt nun direkt hinter Anthropics Claude Fable 5.1, GPT-6 Astra und Opus 5.
„Grok 4.7 erreicht 46 Punkte auf dem Artificial Analysis Intelligence Index und bringt SpaceXAI unter die Top-Vier-KI-Labore. Die Werte auf dem Coding Agent Index sind ebenfalls gestiegen und überholen nun GPT-5.6 Sol“, heißt es im Beitrag.
An anderen Stellen zeigte das Modell kaum Verbesserungen. Auf Terminal-Bench 4.0 legte es um 4,5 % zu, bei GDP.pdf waren es drei Punkte mehr. Die Werte auf den AA-LCR- und AutomationBench-AA-Tests fielen hingegen. Grok 4.5 war im Juli auf dem AutomationBench vorn, was Musks Aussage unterstützte, es erreiche etwa das Niveau von Claude Opus.
Die Verbesserungen haben ihren Preis in Token
Die Preisliste hat sich nicht geändert. Grok 4.7 kostet weiterhin 2 USD pro Million Eingabe-Token und 6 USD pro Million Ausgabe-Token. Treffer im Cache bleiben bei 0,50 USD, und das Kontextfenster mit 500.000 Token wurde von Grok 4.6 übernommen.
Das Modell erledigt allerdings bei jeder Antwort deutlich mehr Arbeit. Artificial Analysis hat festgestellt, dass pro Index-Aufgabe rund 81.000 Ausgabe-Token erzeugt werden, bei Grok 4.6 waren es noch 36.000 und bei GPT-6 Astra 27.000. Daher führt der gleichbleibende Preis pro Token so zu einer höheren Rechnung pro Aufgabe.
Dieser hohe Token-Verbrauch betrifft eine Abteilung, die bereits einen Verlust von 1,26 Milliarden USD gemeldet hat. Elon Musk sagte am 14. September, dass das Training von Grok 4.8 innerhalb einer Woche abgeschlossen werde.
Er erwartet zudem, dass Grok 5 das Modell ist, das künstliche allgemeine Intelligenz erreicht. Die nächste Version wird zeigen, ob SpaceXAI seine Platzierung verbessern kann, ohne dafür deutlich mehr Rechenleistung zu benötigen.
Abonnieren Sie unseren YouTube-Kanal , um Expertenmeinungen von Führungskräften und Journalisten zu sehen









