Grok 4.6 vorgestellt
Heute veröffentlichen wir gemeinsam mit SpaceXAI Grok 4.6.
Grok 4.6 baut auf Grok 4.5 auf und konzentriert sich besonders auf lang laufende Agenten sowie anspruchsvollere interaktive und visuelle Aufgaben. Es bewältigt komplexe Aufgaben über viele Schritte hinweg – sei es bei der Recherche zu einem Thema, der Analyse von Informationen, der Arbeit in einer Codebasis oder der Umsetzung einer Idee in eine ausgereifte Anwendung oder ein fertiges Arbeitsergebnis.
Grok 4.6 erreicht Spitzen-KI in mehreren Benchmarks für agentenbasiertes Programmieren und Wissensarbeit. Beim Artificial Analysis Intelligence Index, der ein zusammengesetzter Score aus neun Benchmarks ist, erreicht es das Niveau von GPT-5.6 Sol.

Grok 4.6 ist ab heute in Cursor und Grok Build verfügbar. In der ersten Woche bieten wir in Cursor und Grok Build die doppelte enthaltene Nutzung.
Training von Grok 4.6
Grok 4.6 durchlief einen längeren zusätzlichen Trainingslauf als Grok 4.5 – mit kuratierten, vom Modell generierten Daten für Reasoning und fortgeschrittene technische Konzepte, hochwertigen Daten aus der Softwareentwicklung sowie einem verbesserten Optimierer und Trainingsrezept. Dadurch entstand eine stärkere Grundlage für die nachfolgenden SFT- und RL-Stufen.
Anschließend nutzten wir Grok 4.5, um die SFT-Trajektorien für verschiedene Reasoning-Aufwände, Agent-Harnesses und Bereiche wie MINT, Softwareentwicklung und Wissensarbeit neu zu generieren. Problematische Traces filterten wir mithilfe modellbasierter Prüfungen heraus. Der resultierende SFT-Checkpoint zeigt eine starke Leistung und ein verbessertes Verhalten.
Grok 4.6 wird auf einer breiten Palette agentenbasierter RL-Aufgaben trainiert, einschließlich Wissensarbeit, allgemeiner Programmierung und domänenspezifischer Umgebungen für Kernel-Optimierung, Webentwicklung, computergestütztes Design und mehr.
Aus ambitionierten Ideen werden funktionierende Projekte
Wir haben Grok 4.6 mit Projekten getestet, die seine Grenzen ausloten und seine Fähigkeit prüfen sollten, über viele Schritte hinweg kontinuierlich zu arbeiten. Dabei zeigte sich, dass das Modell besonders gut darin ist, eine umfassende Produktidee in eine funktionierende erste Version zu verwandeln. Es kann sich in unbekannte Fachgebiete einarbeiten, die Anwendung strukturieren, die zentralen Interaktionen implementieren und das Ergebnis über mehrere Feedbackrunden hinweg weiter verfeinern.
Bei längeren Abläufen beobachteten wir außerdem verstärkt Selbsttests und Verifizierung: Das Modell prüfte seine eigene Arbeit, bevor es weitermachte.
Grok 4.6 erstellt für visuelle und interaktive Projekte bessere erste Entwürfe, als wir dies typischerweise bei Grok 4.5 gesehen haben. Ausgehend von einer konkreten Produktidee kann es in einem Durchgang die Struktur und visuelle Sprache einer Anwendung festlegen. Das macht es besonders nützlich für Projekte, bei denen der schnellste Weg zu einem guten Ergebnis darin bestand, mit einer soliden Grundlage zu beginnen und sie dann iterativ weiterzuentwickeln.
Sicherheit und Fähigkeiten
Die Schutzmechanismen von Grok 4.6 wurden verbessert und auf die Fähigkeiten des Modells abgestimmt.
Unser Sicherheits-Stack ist darauf ausgelegt, Nutzen und Sicherheit in legitimen Anwendungsfällen zu maximieren, damit Grok 4.6 in Bereichen wie dem Schließen von Sicherheitslücken, der Beschleunigung des Entwicklungszyklus und der Unterstützung der KI-Forschung hilfreich und sicher eingesetzt werden kann.
Unsere Bewertung der Schutzmechanismen trägt den erweiterten Fähigkeiten von Grok 4.6 Rechnung – mit unserer bislang umfangreichsten Test-Suite vor der Bereitstellung zur Bewertung von Fähigkeiten und zur Kalibrierung von Schutzmechanismen sowie umfassenden Tests durch Dritte nach der Bereitstellung.
Erste Schritte mit Grok 4.6
Grok 4.6 ist ab heute in Cursor und Grok Build verfügbar. Außerdem ist es über die SpaceXAI API sowie bei Partnern einschließlich OpenRouter, Vercel und Cloudflare verfügbar.
Die Preise beginnen bei 6 pro Million Output-Token. Zusätzlich gibt es eine schnelle Variante zum doppelten Preis.
In der ersten Woche bieten wir in Cursor und Grok Build die doppelte Nutzung.