Fenster schliessen
 | RSSImpressum | Datenschutzerklärung | Login logo
logo

SpaceXAI veröffentlicht Grok 4.6 für Agenten und Coding


SpaceXAI hat Grok 4.6 veröffentlicht und positioniert das KI-Modell für mehrstufige Agenten-Aufgaben, Softwareentwicklung und Wissensarbeit auf dem Niveau führender Konkurrenzmodelle; die Leistungs- und Preisvergleiche beruhen teils auf Angaben des Unternehmens und auf Drittanbieter-Benchmarks.

Nach Angaben von SpaceXAI richtet sich Grok 4.6 an lang laufende Agenten, Softwareentwicklung, Wissensarbeit und visuelle Projekte. Das Modell soll mehrschrittige Aufgaben zuverlässiger verfolgen, sich in unbekannten Codebasen orientieren und Ergebnisse häufiger selbst prüfen, bevor es weiterarbeitet.

Als Grundlage nennt SpaceXAI eine längere zusätzliche Trainingsphase, umfangreichere Daten aus der Softwareentwicklung und mehr Reinforcement Learning für Coding- und Wissensaufgaben. Der Anbieter meldet gegenüber Grok 4.5 Fortschritte in allen von ihm aufgeführten Tests, darunter CursorBench, FrontierCode, APEX-Agents und Terminal-Bench. Diese Angaben sind Herstellerangaben.

Der Artificial Analysis Intelligence Index führt Grok 4.6 mit 61 Punkten. Damit liegt das Modell laut den vorliegenden Angaben gleichauf mit GPT-5.6 Sol bei dessen höchster Reasoning-Stufe und einen Punkt hinter Claude Fable 5. Der Index bündelt mehrere Benchmarks zu einem Wert und ist deshalb ein Anhaltspunkt, aber keine vollständige Aussage über die Eignung für jeden einzelnen Einsatz.

The Decoder verweist zudem auf GDPval-AA v2, einen Test für Wissensarbeit am Computer. Dort soll Grok 4.6 mit einem Elo-Wert von 1.753 den zweiten Rang belegen, hinter Claude Opus 5. Der Bericht nennt für komplexe Aufgaben im Schnitt etwa 53 Schritte. Claude Opus 5 benötige dort rund 103 Schritte. Solche Benchmark-Ergebnisse hängen jedoch von den jeweiligen Aufgaben und der Testmethodik ab.

Die API-Preise beginnen bei 2 US-Dollar pro Million Eingabe-Tokens und 6 US-Dollar pro Million Ausgabe-Tokens. Eine schnellere Variante kostet laut SpaceXAI das Doppelte. Im Vergleich mit den im Bericht genannten Preisen von Claude Opus 5 und GPT-5.6 Sol wäre Grok 4.6 damit deutlich günstiger. Die Vergleichbarkeit hängt allerdings auch von Modellvariante, Geschwindigkeit und konkretem Einsatz ab.

Grok 4.6 ist über die SpaceXAI-API, Cursor, Grok Build sowie OpenRouter, Vercel und Cloudflare verfügbar. Für die erste Woche kündigte SpaceXAI in Cursor und Grok Build die doppelte enthaltene Nutzung an. Die Veröffentlichung folgt auf die im Juni gemeldete Übernahme von Cursor durch SpaceXAI und auf die Vorstellung des Grok Bot als Agenten für iPhone, Mac und weitere Plattformen.