Presentamos Grok 4.6
Hoy lanzamos Grok 4.6 junto con SpaceXAI.
Grok 4.6 se basa en Grok 4.5 y se centra especialmente en agentes de larga duración y trabajos interactivos y visuales más ambiciosos. Aborda tareas complejas que requieren muchos pasos, ya sea para investigar un tema, analizar información, trabajar en una base de código o convertir una idea en una aplicación pulida o un producto de trabajo.
Grok 4.6 alcanza una IA de vanguardia en varios benchmarks de programación con agentes y trabajo intelectual. Iguala a GPT-5.6 Sol en el Artificial Analysis Intelligence Index, que es una puntuación compuesta de nueve benchmarks.

Grok 4.6 está disponible hoy en Cursor y Grok Build. Ofrecemos el doble de uso incluido en Cursor y Grok Build durante la primera semana.
Entrenamiento de Grok 4.6
Grok 4.6 recibió un ciclo de entrenamiento adicional más largo que Grok 4.5, con datos seleccionados generados por modelos para razonamiento y conceptos técnicos avanzados, datos de ingeniería de alta calidad y un optimizador y una receta de entrenamiento mejorados. Esto proporcionó una base más sólida para las posteriores etapas de SFT y RL.
Después, usamos Grok 4.5 para regenerar las trayectorias de SFT con distintos niveles de esfuerzo de razonamiento, marcos de agentes y dominios como STEM, ingeniería de software y trabajo intelectual. Filtramos las trazas problemáticas mediante comprobaciones basadas en modelos. El checkpoint de SFT resultante muestra un rendimiento sólido y un comportamiento mejorado.
Grok 4.6 se entrena con una amplia variedad de tareas de RL con agentes, entre ellas trabajo intelectual, programación general y entornos específicos de dominio para la optimización de kernels, el desarrollo web, el diseño asistido por computadora y mucho más.
Convertir ideas ambiciosas en proyectos funcionales
Probamos Grok 4.6 en proyectos diseñados para poner a prueba su alcance y su capacidad de mantener el trabajo a lo largo de muchos pasos. Descubrimos que el modelo destaca especialmente a la hora de convertir una idea general de producto en una primera versión funcional. Puede investigar dominios desconocidos, estructurar la aplicación, implementar las interacciones principales y seguir perfeccionando el resultado mediante varias rondas de comentarios.
En trayectorias más largas, también empezamos a observar más pruebas y verificaciones autónomas: el modelo comprueba su propio trabajo antes de continuar.
Grok 4.6 produce resultados iniciales más sólidos en proyectos visuales e interactivos que los que normalmente observábamos con Grok 4.5. Dada una idea de producto concreta, es capaz de establecer la estructura y el lenguaje visual de una aplicación en una sola pasada. Esto lo ha hecho especialmente útil para proyectos en los que la forma más rápida de lograr un buen resultado era empezar con algo sustancial e iterar a partir de ahí.
Seguridad y capacidades
Las salvaguardas de Grok 4.6 se han mejorado y calibrado de acuerdo con las capacidades del modelo.
Nuestra infraestructura de seguridad está diseñada para maximizar la utilidad y la seguridad en casos de uso legítimos, lo que permite que Grok 4.6 sea útil y seguro en ámbitos como la corrección de vulnerabilidades, la aceleración del ciclo de diseño de ingeniería y el impulso a la investigación en IA.
Nuestro trabajo de evaluación de salvaguardas refleja las capacidades ampliadas de Grok 4.6, con nuestra batería más amplia hasta la fecha de pruebas previas al despliegue de capacidades y calibración de salvaguardas, así como exhaustivas pruebas posteriores al despliegue realizadas por terceros.
Empieza a usar Grok 4.6
Grok 4.6 ya está disponible en Cursor y Grok Build. También está disponible a través de la API de SpaceXAI y de socios como OpenRouter, Vercel y Cloudflare.
Los precios parten de 6 por millón de tokens de salida. Hay disponible una variante rápida al doble de precio.
Incluimos el doble de uso en Cursor y Grok Build durante la primera semana.