Passend zum ThemaCouncil für Zukunftstechnologien & KI

Elon Musk sagt, Grok 4.7 soll jedes andere Modell übertreffen: Hält das KI-Modell sein Versprechen?

  • Grok 4.7 erreicht einen Wert von 46 im Intelligence Index von Artificial Analysis, jetzt unter den Top vier
  • Das Modell übertrifft GPT-5.6 Sol beim Programmieren, die höheren Leistungen haben jedoch ihren Preis.
  • Musk: Grok 4.8 schließt das Training ab, Grok 5 steht kurz vor AGI
Promo

SpaceXAI hat Grok 4.7 veröffentlicht, und unabhängige Bewertungen sehen es auf Platz vier unter den führenden KI-Laboren.

Artificial Analysis, ein unabhängiges Benchmark-Unternehmen, gibt dem Modell 46 Punkte auf dem Intelligence Index, zwei Punkte mehr als Grok 4.6. Claude Fable 5.1, GPT-6 Astra und Claude Opus 5 liegen weiterhin vor Grok 4.7.

Gesponsert
Gesponsert

Grok 4.7 bringt SpaceXAI unter die Top Vier der KI-Labore

Elon Musk sagte vor der Veröffentlichung , dass das Modell auf einer Basis mit 2,1 Billionen Parametern läuft und alle bisherigen Modelle übertreffen soll. Er sagte zudem, dass beim Training des Modells auch Daten von SpaceX verwendet wurden.

Folgen Sie uns auf X , um aktuelle Nachrichten in Echtzeit zu erhalten

Doch wie gut ist Grok 4.7 wirklich? Beim AA-Briefcase, einem Benchmark von Artificial Analysis für realistische berufliche Aufgaben, erreichte Grok 4.7 einen Wert von 1657 Elo. Das sind 111 Punkte mehr als Grok 4.6 und nahe am Niveau von Claude Opus 5.

Beim GDPval-AA-Test kam das Modell auf 1695 Elo. Das sind 90 Punkte mehr als die Vorgängerversion. Auch die Programmierergebnisse verbesserten sich.

Kombiniert mit Grok Build, dem eigenen Coding-Agenten, erreichte Grok 4.7 einen Wert von 56 auf dem Coding Agent Index. Das sind neun Punkte mehr als Grok 4.6.

Das Modell überholte GPT-5.6 Sol und liegt nun direkt hinter Anthropics Claude Fable 5.1, GPT-6 Astra und Opus 5.

Gesponsert
Gesponsert

„Grok 4.7 erreicht 46 Punkte auf dem Artificial Analysis Intelligence Index und bringt SpaceXAI unter die Top-Vier-KI-Labore. Die Werte auf dem Coding Agent Index sind ebenfalls gestiegen und überholen nun GPT-5.6 Sol“, heißt es im Beitrag.

Wie Grok 4.7 abschneidet.
Wie Grok 4.7 abschneidet. Quelle: X/Artificial Analysis

An anderen Stellen zeigte das Modell kaum Verbesserungen. Auf Terminal-Bench 4.0 legte es um 4,5 % zu, bei GDP.pdf waren es drei Punkte mehr. Die Werte auf den AA-LCR- und AutomationBench-AA-Tests fielen hingegen. Grok 4.5 war im Juli auf dem AutomationBench vorn, was Musks Aussage unterstützte, es erreiche etwa das Niveau von Claude Opus.

Die Verbesserungen haben ihren Preis in Token

Die Preisliste hat sich nicht geändert. Grok 4.7 kostet weiterhin 2 USD pro Million Eingabe-Token und 6 USD pro Million Ausgabe-Token. Treffer im Cache bleiben bei 0,50 USD, und das Kontextfenster mit 500.000 Token wurde von Grok 4.6 übernommen.

Das Modell erledigt allerdings bei jeder Antwort deutlich mehr Arbeit. Artificial Analysis hat festgestellt, dass pro Index-Aufgabe rund 81.000 Ausgabe-Token erzeugt werden, bei Grok 4.6 waren es noch 36.000 und bei GPT-6 Astra 27.000. Daher führt der gleichbleibende Preis pro Token so zu einer höheren Rechnung pro Aufgabe.

Dieser hohe Token-Verbrauch betrifft eine Abteilung, die bereits einen Verlust von 1,26 Milliarden USD gemeldet hat. Elon Musk sagte am 14. September, dass das Training von Grok 4.8 innerhalb einer Woche abgeschlossen werde.

Er erwartet zudem, dass Grok 5 das Modell ist, das künstliche allgemeine Intelligenz erreicht. Die nächste Version wird zeigen, ob SpaceXAI seine Platzierung verbessern kann, ohne dafür deutlich mehr Rechenleistung zu benötigen.

Abonnieren Sie unseren YouTube-Kanal , um Expertenmeinungen von Führungskräften und Journalisten zu sehen

https://youtu.be/IcgIaeIE7LI

Haftungsausschluss

BeInCrypto hat sich einer unvoreingenommenen, transparenten Berichterstattung verpflichtet. Dieser Nachrichtenartikel soll genaue und aktuelle Informationen liefern. Den Lesern wird jedoch empfohlen, die Fakten unabhängig zu überprüfen und eine Fachperson zu konsultieren, bevor sie auf Grundlage dieser Inhalte Entscheidungen treffen. Bitte beachten Sie, dass unsere Allgemeinen Geschäftsbedingungen, unsere Datenschutzrichtlinie und unsere Haftungsausschlüsse aktualisiert wurden.

Gesponsert
Gesponsert