# Grok 4.6: especificaciones, benchmarks y precio real (2026)

> Grok 4.6 es el modelo para agentes de xAI (12 ago 2026). Ficha técnica, benchmarks, el precio que se duplica a los 200K y su efecto en la búsqueda con IA.

- Published: 2026-08-13
- Author: Samy BEN SADOK
- Canonical: https://geotoolbox.ai/es/blog/grok-4-6

---

Grok 4.6 es el modelo más reciente de xAI, y el día después de su lanzamiento hicimos una prueba rápida: preguntamos a dos asistentes de IA de primera línea, con la búsqueda web desactivada, qué era Grok 4.6. Uno, entrenado con datos que terminan a principios de 2024, solo conocía Grok hasta la versión 1.5. El otro, con datos actualizados hasta finales de 2025, se quedaba en Grok 4.1. Ninguno sabía que 4.6 existía. Solo un asistente capaz de consultar la web en vivo puede verlo, y esa diferencia es un pequeño anticipo de por qué este lanzamiento importa mucho más allá de las tablas de benchmarks.

Esta es la versión clara y actual de qué es Grok 4.6: qué lanzó xAI el 12 de agosto de 2026, cuánto cuesta de verdad cuando lees más allá del precio anunciado, qué muestra la tabla de benchmarks cuando empiezas por las derrotas, y qué significa un modelo construido para agentes de cara a si la IA puede encontrar tu sitio. Las cifras salen del propio anuncio y de la ficha del modelo de xAI, contrastadas con Artificial Analysis.

<figure className="not-prose my-8">
  ![Tres tipos de asistente de IA y el Grok más reciente que conoce cada uno: un modelo de la familia GPT con corte a principios de 2024 solo conoce hasta Grok 1.5, uno de la familia Claude con corte a finales de 2025 se queda en Grok 4.1, y solo la recuperación web en vivo ve Grok 4.6, lanzado el 12 de agosto de 2026.](/blog/grok-4-6/grok-4-6-que-sabe-cada-motor.png)
  <figcaption className="mt-3 text-center text-sm text-gray-500">Comprobado el día después del lanzamiento: solo un motor que recupera la web en vivo puede ver un modelo lanzado ayer.</figcaption>
</figure>

## Lo que debes saber

- **Grok 4.6 es el modelo frontera de xAI, lanzado el 12 de agosto de 2026**, construido para agentes de larga duración, programación y trabajo de conocimiento.
- Puntúa **61 en el Artificial Analysis Intelligence Index**, cinco puntos por encima del 56 de Grok 4.5, empatado con GPT-5.6 Sol Max y por debajo de Claude Opus 5 y Fable 5.
- El precio de portada es barato, **2 $ de entrada y 6 $ de salida por millón de tokens**, pero se duplica a 4 $ y 12 $ en cuanto el prompt supera los 200.000 tokens, y afecta a toda la petición.
- Al lanzarse es un producto para desarrolladores (API, Cursor, Grok Build, complementos de Microsoft Office), todavía no un chatbot de consumo. La ventana de contexto sigue siendo de 500.000 tokens, la misma que en 4.5.
- A diferencia de Grok 4.5, no se ha informado de un bloqueo de Grok 4.6 en la Unión Europea (verificado el 13 de agosto de 2026); un desarrollador en España o Latinoamérica puede acceder al modelo vía API y pasarelas globales.

## ¿Qué es Grok 4.6?

**Grok 4.6 es el modelo frontera de xAI, lanzado el 12 de agosto de 2026 y construido para agentes de larga duración, programación y trabajo de conocimiento.** Es la versión más reciente de [Grok](https://geotoolbox.ai/blog/what-is-grok), el asistente basado en un [gran modelo de lenguaje](https://geotoolbox.ai/glossary/large-language-model) que fabrica xAI, la empresa que Elon Musk fundó en 2023 y que hoy opera como SpaceXAI tras la fusión con SpaceX de 2026. Si sigues los números de versión, 4.6 llega alrededor de un mes después de [Grok 4.5](https://geotoolbox.ai/blog/grok-4-5) y se coloca como el buque insignia actual.

Grok 4.6 no es un modelo más grande que 4.5. xAI describe una ronda de entrenamiento más larga sobre la base de 4.5, no una base mayor, y las fuentes secundarias interpretan que el tamaño del modelo subyacente no ha cambiado. Eso importa porque cambia cómo debes leer los números de benchmark de más abajo. El modelo apunta a quien construye software y ejecuta agentes, no a quien le pide trivialidades a un chatbot, y en el lanzamiento estuvo disponible para desarrolladores e integrado en aplicaciones, no en el propio chatbot de consumo de xAI.

Grok 4.6 lee texto e imágenes, escribe texto, tiene una ventana de contexto de 500.000 tokens y añade un nuevo nivel de razonamiento, «xhigh», por encima de los que ofrecía 4.5. Su fecha de corte de conocimiento es el 1 de febrero de 2026 (la ficha del modelo indica un corte de preentrenamiento en enero de 2026): cualquier cosa posterior a esa fecha, incluido su propio lanzamiento, solo la conoce mediante herramientas de búsqueda en vivo, no de memoria.

## ¿Ya salió Grok 4.6? Qué lanzó xAI en realidad

Sí. Grok 4.6 se puso en marcha el 12 de agosto de 2026, anunciado por SpaceXAI (el nombre con el que xAI opera ahora). Musk había insinuado en público un lanzamiento «alrededor del 7 de agosto», pero se retrasó unos días. Finalmente, el modelo llegó con una tabla de evaluación completa, una ficha del modelo y acceso en vivo a la API, no como un adelanto.

Lo que cambió de verdad es más acotado de lo que sugiere un número de versión nuevo, y xAI es bastante transparente al respecto. Según el [anuncio de xAI](https://x.ai/news/grok-4-6), Grok 4.6 salió de una ronda de entrenamiento suplementario más larga que la de 4.5, con datos de ajuste fino regenerados y aprendizaje por refuerzo en entornos agénticos. xAI no afirma tener un modelo base mayor; la lectura de una «misma base de escala de 1,5 billones de parámetros, mantenida constante» proviene de la cobertura secundaria. En cualquier caso, el esfuerzo se concentró en las capas de entrenamiento, no en el tamaño bruto del modelo.

Hay algunas cosas genuinamente nuevas. La primera es el enfoque en agentes: xAI dice que el modelo se mantiene en una tarea a lo largo de muchos pasos sin desviarse, y que en ejecuciones largas empezó a revisar su propio trabajo antes de continuar. Eso es una observación del propio fabricante, no un resultado medido de forma independiente, por lo que conviene que lo pruebes contra tu propia carga de trabajo. La segunda es el nuevo nivel de esfuerzo de razonamiento **xhigh**, que se sitúa por encima de los niveles low, medium y high con los que salió 4.5. La tercera es el ajuste para programación: Grok 4.6 se desarrolló junto a Cursor y recibió entrenamiento suplementario con datos anonimizados de sus flujos de trabajo, ampliando la colaboración que ya existía tras 4.5.

Dos afirmaciones que conviene fijar, porque la cobertura las mezcla. Algunos artículos describieron la relación con Cursor como una adquisición o inversión de xAI en Cursor; los materiales de la propia xAI la llaman una colaboración de entrenamiento; descarta por ahora la versión de la adquisición, salvo que una fuente primaria la confirme. Y no hay una publicación de pesos abiertos: Grok 4.6 es un modelo cerrado y alojado, sin vía para alojarlo tú mismo.

## Especificaciones de Grok 4.6 de un vistazo

Aquí está la ficha técnica, según la [documentación para desarrolladores y la ficha del modelo de xAI](https://docs.x.ai/developers/grok-4-6).

<table>
<thead>
<tr><th>Propiedad</th><th>Grok 4.6</th></tr>
</thead>
<tbody>
<tr><td><strong>ID del modelo</strong></td><td>grok-4.6</td></tr>
<tr><td><strong>Lanzamiento</strong></td><td>12 de agosto de 2026</td></tr>
<tr><td><strong>Ventana de contexto</strong></td><td>500.000 tokens (sin cambios frente a Grok 4.5)</td></tr>
<tr><td><strong>Corte de conocimiento</strong></td><td>1 de febrero de 2026</td></tr>
<tr><td><strong>Modalidades</strong></td><td>Entrada de texto e imagen; salida solo de texto</td></tr>
<tr><td><strong>Niveles de razonamiento</strong></td><td>Low, medium, high (por defecto), xhigh (nuevo)</td></tr>
<tr><td><strong>Herramientas</strong></td><td>Llamadas a funciones, búsqueda web, búsqueda en X, ejecución de código</td></tr>
<tr><td><strong>Precio</strong></td><td>2 $ / 0,50 $ / 6 $ por millón de tokens (entrada / en caché / salida) por debajo de 200K tokens de prompt; se duplica por encima</td></tr>
<tr><td><strong>Disponibilidad</strong></td><td>API de xAI, Grok Build (por defecto), Cursor (todos los planes), complementos de Microsoft Office; OpenRouter, Vercel, Cloudflare y otras pasarelas</td></tr>
<tr><td><strong>Pesos abiertos</strong></td><td>No; sin autoalojamiento</td></tr>
</tbody>
</table>

Dos detalles de esa tabla se le pasan a la mayoría de artículos. La ventana de contexto **no** creció: ya era de 500K en Grok 4.5; cualquiera que insinúe un aumento se equivoca. Y el precio tiene una segunda mitad que solo aparece cuando el prompt de una petición pasa la marca de 200K, algo que desglosamos a continuación porque cae justo sobre las cargas de agentes para las que se vende este modelo.

## Benchmarks de Grok 4.6: lee primero las derrotas

Grok 4.6 puntúa **61 en el Artificial Analysis Intelligence Index**, un compuesto de nueve benchmarks, cinco puntos por encima del 56 de Grok 4.5 y a la altura de GPT-5.6 Sol Max. Esa cifra es de un tercero: [Artificial Analysis](https://artificialanalysis.ai/models/grok-4-6) mantiene el índice. [VentureBeat](https://venturebeat.com/technology/spacexai-debuts-grok-4-6-overtaking-kimi-k3s-performance-and-matching-gpt-5-6-sol-for-worlds-third-best-on-artificial-analysis) lo llamó el tercer mejor modelo del mundo, por detrás de Claude Opus 5 y Fable 5 de Anthropic. Léelo con cuidado: en la propia página de Artificial Analysis la variante Grok 4.6 (high) ocupa el sexto puesto de las 184 variantes de modelo que rastrea a mediados de agosto de 2026, porque «tercer mejor» cuenta modelos buque insignia y los dos que van por delante son ambos de Anthropic.

El ejercicio más útil es leer la propia tabla de evaluación de xAI. Esta es la tabla completa que publicó xAI, con la mejor puntuación de cada fila en negrita.

<table>
<thead>
<tr><th>Benchmark</th><th>Grok 4.6 (High)</th><th>Grok 4.5 (High)</th><th>GPT-5.6 Sol Max</th><th>Fable 5 Max</th></tr>
</thead>
<tbody>
<tr><td>AA Intelligence Index</td><td>61</td><td>56</td><td>61</td><td><strong>62</strong></td></tr>
<tr><td>GDPVal-AA v2</td><td><strong>1753</strong></td><td>1526</td><td>1728</td><td>1741</td></tr>
<tr><td>CursorBench v3.2</td><td>69,9 %</td><td>66,7 %</td><td>67,2 %</td><td><strong>70,5 %</strong></td></tr>
<tr><td>DeepSWE v1.1</td><td>65,9 %</td><td>54 %</td><td><strong>73 %</strong></td><td>70 %</td></tr>
<tr><td>FrontierCode v1.1 (Extended)</td><td>61,3 %</td><td>56,6 %</td><td>60,6 %</td><td><strong>63,6 %</strong></td></tr>
<tr><td>APEX-Agents</td><td>57,5 %</td><td>47,1 %</td><td>56,7 %</td><td><strong>59,2 %</strong></td></tr>
<tr><td>Terminal-Bench v3.0</td><td>26 %</td><td>15,7 %</td><td><strong>34,6 %</strong></td><td>34,1 %</td></tr>
<tr><td>APEX-SWE</td><td>56,4 %</td><td>53,6 %</td><td>n/d</td><td><strong>58,8 %</strong></td></tr>
<tr><td>AA-Briefcase</td><td><strong>1577</strong></td><td>1313</td><td>1502</td><td>1574</td></tr>
<tr><td>Harvey LAB</td><td><strong>15,8 %</strong></td><td>12,9 %</td><td>2,5 %</td><td>11,3 %</td></tr>
</tbody>
</table>

Lee hacia abajo la columna en negrita: **Fable 5 Max gana más filas que nadie, cinco de las diez.** GPT-5.6 se lleva dos, DeepSWE y Terminal-Bench. Grok 4.6 marca la mejor puntuación bruta en tres: GDPVal-AA v2, AA-Briefcase y Harvey LAB. Dos de esas llevan asterisco. Sus márgenes sobre Fable en GDPVal y AA-Briefcase son solo un puñado de puntos Elo (1753 frente a 1741, y 1577 frente a 1574), que MarkTechPost lee como dentro del ruido, y ambas son victorias solo porque esta tabla de cuatro modelos deja fuera a Claude Opus 5, que encabeza el índice general y, según la propia ficha del modelo de xAI, lidera esas dos evaluaciones. Eso deja Harvey LAB como la única victoria clara de Grok, y también merece una advertencia: GPT-5.6 saca apenas un 2,5 % ahí frente al 15,8 % de Grok, una diferencia lo bastante amplia como para parecer un artefacto de la puntuación o del sistema de pruebas hasta que alguien la reproduzca.

Cara a cara con GPT-5.6, las filas de programación se reparten a partes iguales: Grok 4.6 supera por poco en CursorBench y FrontierCode, GPT-5.6 lidera en DeepSWE y Terminal-Bench.

Una cosa más que conviene leer con cuidado: esta es la tabla de xAI, no una neutral. xAI eligió qué benchmarks aparecen, y la columna de cada rival es el mejor resultado autorreportado o público de ese rival, no un enfrentamiento controlado. Los benchmarks en sí son suites de terceros, no pruebas caseras de xAI: Artificial Analysis (el Intelligence Index, GDPVal-AA v2 y AA-Briefcase), Vals AI (Harvey LAB), Cursor (CursorBench), Mercor (las evaluaciones APEX), Cognition (FrontierCode), Datacurve (DeepSWE) y el equipo Harbor de Stanford con el Laude Institute (Terminal-Bench). La ficha del modelo acredita que Artificial Analysis, Mercor y Datacurve ejecutaron ellos mismos los resultados de GDPVal, APEX-SWE y DeepSWE; el resto, al parecer, lo ejecutó xAI con esas suites externas. Donde se nota la mano del fabricante es en la selección: Claude Opus 5 no tiene columna, y CursorBench se puntúa en el propio sistema de Cursor, el mismo socio cuyos datos anonimizados de flujo de trabajo entraron en el entrenamiento de este modelo. Así que léelo como una hoja de puntuación curada por el fabricante y no como un enfrentamiento controlado: Grok 4.6 es un salto claro respecto a 4.5, a la altura de GPT-5.6 en el índice independiente amplio, y por detrás de los mejores modelos de Claude.

## Cuánto cuesta Grok 4.6 en realidad

La cifra del titular es barata: **2 $ por millón de tokens de entrada y 6 $ de salida**, lo mismo que Grok 4.5 y, según el propio encuadre de xAI, alrededor de la mitad de lo que cobran los modelos buque insignia de Claude y GPT. Es la cifra con la que abre cada resumen. También es solo la mitad de la historia. Para ver cómo se alinean las tarifas entre las versiones de Grok, consulta nuestra [guía de precios de Grok](https://geotoolbox.ai/blog/grok-pricing).

Envía una petición cuyo prompt supere los **200.000 tokens y la tarifa se duplica a 4 $ de entrada, 12 $ de salida y 1 $ de entrada en caché, aplicada a cada token de esa petición**, no solo a los que pasan de la línea. Por debajo de esa línea, la entrada en caché cuesta 0,50 $ por millón, pero esa tarifa no es automática: la documentación de xAI te dice que fijes una `prompt_cache_key` (o la cabecera `x-grok-conv-id` en Chat Completions), o tus peticiones se dispersan entre servidores y pagas la tarifa completa de 2 $ de entrada en una que llegue con la caché fría. Lo incómodo es dónde cae el escalón: 200K es exactamente el contexto que un agente de larga duración que trabaja sobre una base de código grande o un corpus de 500K tokens va a rebasar, que es justo la carga de trabajo para la que xAI comercializa este modelo. La ventana de 500K es real, pero su segunda mitad se factura al doble. Para bucles de agentes largos, xAI apunta a la compactación de contexto como la forma de mantenerse por debajo de la línea.

El precio por token es solo una parte del costo, y el panorama completo tiene dos caras. A favor, las propias ejecuciones de Artificial Analysis muestran que Grok 4.6 termina su carga de AA-Briefcase en unos 53 turnos y unos 500 millones de tokens de entrada, frente a unos 103 turnos y 2.000 millones de tokens de Claude Opus 5 Max, una gran ventaja de eficiencia por tarea (la advertencia de VentureBeat: falta comprobar si eso se traslada de esas ejecuciones controladas a producción). En contra, su costo por tarea completada queda a media tabla en el mismo sitio, unos 0,84 $ por tarea, menos económico que varios modelos más baratos y que el propio Grok 4.5, con una velocidad de generación cercana a la mediana. En conjunto: barato por token, a menudo con menos turnos por tarea, pero a media tabla una vez que pones precio a todo el flujo, y al doble por encima de 200K.

También hay una variante «fast» al doble del precio estándar. xAI no ha publicado un ID de modelo, una cifra de latencia ni una especificación de rendimiento aparte para ella; al lanzarse tienes el precio sin la especificación. Durante la primera semana, Grok Build y Cursor incluyen el doble de uso, es decir, el doble de la cuota habitual mientras lo pruebas, lo que no cambia las tarifas de fondo.

## Grok 4.6 frente a Grok 4.5, GPT-5.6 y Claude

Si estás decidiendo entre modelos, la versión corta es que Grok 4.6 es la mejora agéntica sobre 4.5 y una alternativa de precio medio a los líderes de frontera, no el mejor modelo del índice independiente.

<table>
<thead>
<tr><th>Pregunta</th><th>La respuesta corta</th></tr>
</thead>
<tbody>
<tr><td><strong>¿Vale la pena frente a Grok 4.5?</strong></td><td>Sí para trabajo agéntico de varios pasos y programación (+5 en el índice de inteligencia, saltos grandes en los benchmarks de agentes). Para prompts acotados, validados y con mucha caché, 4.5 sigue bastando; cuesta lo mismo, y el motivo para quedarte es la simplicidad, no una tarifa más baja.</td></tr>
<tr><td><strong>¿Frente a GPT-5.6 Sol Max?</strong></td><td>Empate en el índice compuesto (61 cada uno). Cara a cara, las filas de programación se reparten dos a dos: Grok supera en CursorBench y FrontierCode, GPT-5.6 lidera en DeepSWE y Terminal-Bench. Prácticamente un empate, que deciden el precio y tu stack.</td></tr>
<tr><td><strong>¿Frente a Claude Opus 5 / Fable 5?</strong></td><td>Ambos modelos de Claude quedan por encima de Grok 4.6 en el índice: Fable 5 gana más filas que nadie en la propia tabla de xAI, y Opus 5 encabeza el índice general. El argumento de Grok es el costo, no la capacidad bruta. Consulta nuestro análisis <a href="https://geotoolbox.ai/blog/grok-vs-claude">Grok frente a Claude</a>.</td></tr>
<tr><td><strong>¿Frente a Kimi K3?</strong></td><td>Grok 4.6 supera a Kimi K3 en el índice de inteligencia. La propuesta de Kimi son los pesos abiertos; la de Grok, una API gestionada y rica en herramientas.</td></tr>
</tbody>
</table>

Diga lo que diga la clasificación del momento, estas posiciones cambian cada pocas semanas. Un ranking que es cierto en agosto puede darse la vuelta en octubre, así que ponle fecha a cualquier afirmación de «mejor modelo» en la que te apoyes. Para ver cómo se comparan en la práctica los dos rivales más habituales, consulta [Grok frente a ChatGPT](https://geotoolbox.ai/blog/grok-vs-chatgpt).

## Cómo acceder a Grok 4.6

Al lanzarse, Grok 4.6 es sobre todo un producto para desarrolladores. Según la ficha del modelo de xAI, está disponible a través de la API de xAI (como `grok-4.6`), como modelo por defecto en Grok Build, en todos los planes de Cursor y, algo llamativo, como modelo por defecto en los complementos de Microsoft Word, PowerPoint y Excel, un movimiento directo hacia el terreno de Copilot. También se puede enrutar a través de OpenRouter, Vercel, Cloudflare y otras pasarelas.

Lo que **no** es, todavía, es un chatbot de consumo. La ficha del modelo dice que xAI planea incorporar Grok 4.6 a sus productos de consumo (la app web, las apps móviles y Grok en X) «más adelante»; si te preguntas si Grok 4.6 es el modelo que te responde hoy en grok.com o en la app de X, la respuesta es que probablemente todavía no.

¿Es gratis? La página de lanzamiento de xAI anuncia una opción de «pruébalo gratis en Grok Build», mientras que la cobertura de prensa sitúa Grok Build dentro del plan SuperGrok de 30 $/mes, por lo que conviene revisar x.ai/build antes de dar por hecho el acceso gratuito. El uso de la API se paga a las tarifas de arriba. El elemento gratuito más claro es la promoción de doble uso de la primera semana en Cursor y Grok Build. Ten en cuenta que tanto el plan SuperGrok de 30 $/mes como el gasto de API se cotizan sin impuestos: en España se les suma un 21 % de IVA (el gasto de API suele ser deducible para una empresa), y en otros países se añaden los impuestos locales. La tarifa de tabla no es el costo final.

Si estás en la Unión Europea o en España, vale la pena mirar la disponibilidad antes de planificar en torno a ella, aunque aquí hay una buena noticia. Grok 4.5 estuvo bloqueado en los 27 países de la UE hasta mediados de julio tras su lanzamiento, mientras xAI completaba las evaluaciones del Reglamento de IA de la UE. Con Grok 4.6, a fecha del 13 de agosto de 2026, no se ha informado de un bloqueo equivalente: las notas de versión de xAI incluyen un aviso para la UE en 4.5, pero ninguno para grok-4.6, y la página del modelo tampoco muestra una restricción regional. En la práctica, un desarrollador en España o Latinoamérica puede acceder al modelo a través de la API y de pasarelas globales como OpenRouter, Vercel o Cloudflare, aunque el procesamiento puede seguir realizándose en una región de EE. UU. y conviene confirmar la disponibilidad en la app de consumo antes de contar con ella.

## Grok 4.6, agentes y si la IA puede encontrarte

Esta parte importa aunque nunca llames a la API. La función estrella de Grok 4.6 son los agentes: modelos que se ejecutan durante muchos pasos, usan herramientas y van recuperando información sobre la marcha. Dos de sus cuatro herramientas integradas son la búsqueda web y la búsqueda en X, y su propio conocimiento se detiene el 1 de febrero de 2026. Esa combinación significa que el modelo no «sabe» la web actual; la recupera, en vivo, cada vez que una pregunta va más allá de su fecha de corte. No podría hablarte de su propio lanzamiento sin buscarlo.

Ese es todo el argumento a favor de la [visibilidad en IA](https://geotoolbox.ai/blog/what-is-ai-visibility) en un solo modelo. Cuando un agente responde una pregunta sobre tu empresa, tu producto o tu mercado, está leyendo lo que sea que pueda recuperar y procesar en ese momento. Si tus páginas son lentas, están bloqueadas para su rastreador o están estructuradas de forma que los datos importantes queden enterrados en scripts e imágenes, el agente trabaja con lo que encuentre en su lugar, que a menudo es un competidor o un hilo de foro. Que el modelo mejore en trabajo agéntico sube lo que está en juego a la hora de ser recuperable, porque cada vez más de lo que la gente aprende sobre ti pasa ahora por una máquina que lee tu sitio en su nombre.

Este es precisamente nuestro terreno. Grok, como los demás motores, llega a tu contenido a través de un bot, y la primera pregunta es si ese bot puede siquiera cargar tus páginas. Puedes comprobar qué rastreadores de IA llegan a tu sitio, y si se les sirve el contenido o se les bloquea, con nuestro [AI Crawler Checker](https://geotoolbox.ai/tools/ai-crawler-checker), y obtener una lectura más amplia de si tus páginas están estructuradas para sobrevivir a una pasada agéntica con la comprobación de [AI Readiness](https://geotoolbox.ai/tools/ai-readiness). Una versión nueva de un modelo es un buen momento para confirmar lo básico: la forma más rápida de mejorar tus resultados no depende del modelo, sino de asegurarte de que recupere tus páginas. Para la mecánica de cómo rastrean y procesan estos bots, consulta nuestra guía de [rastreadores de IA](https://geotoolbox.ai/blog/ai-crawlers).

## ¿Deberías usar Grok 4.6? El veredicto

Grok 4.6 es un salto real respecto a 4.5 y un modelo de frontera creíble a precio medio, aunque no el mejor modelo del índice independiente. Si es el adecuado para ti se reduce a unas pocas preguntas concretas.

Úsalo si haces trabajo agéntico de varios pasos o programación, quieres acceso a una API rica en herramientas sin gestionar pesos, y tus peticiones se mantienen por debajo de los 200K tokens de prompt, donde el precio es competitivo. Piénsatelo dos veces si tu carga de trabajo cruza de forma habitual esa línea de 200K, ya que la tarifa duplicada borra la ventaja de costo justo en las ejecuciones de agentes de contexto largo para las que se vende el modelo. Quédate en Grok 4.5 para prompts acotados, validados y con mucha caché, donde la capacidad extra no se paga sola.

Dos factores más entran en la decisión. En gobernanza, la ficha del modelo de xAI documenta el comportamiento autónomo con detalle pero incluye poca evaluación formal del riesgo de autonomía, algo que conviene sopesar en un despliegue regulado o de empresa; y el panorama más amplio también cuenta, ya que X y la anterior organización de xAI enfrentan investigaciones abiertas en el Reino Unido y la UE (Ofcom, la ICO y un procedimiento formal de la UE bajo la DSA) que tienen que ver con el historial de la plataforma, no con ninguna resolución adversa contra la API de Grok 4.6. En cuanto a los tiempos, Musk ha señalado en X que un Grok 4.7 de mayor escala está a «semanas» de distancia, al parecer un salto real de escala y no otra ronda de posentrenamiento, y sus fechas ya se han retrasado antes, así que tómalo como un objetivo y no como un plan. Para lo que se sabe de los próximos saltos, consulta [lo que sabemos de Grok 5](https://geotoolbox.ai/blog/grok-5).

## Preguntas frecuentes

### ¿Grok 4.6 es gratis?

Todavía no como chatbot de consumo. Al lanzarse funcionaba en superficies para desarrolladores (la API, Cursor, Grok Build y los complementos de Office), y la ficha del modelo de xAI dice que el acceso de consumo en la web, el móvil y X llegará «más adelante». La página de lanzamiento de xAI anuncia una prueba gratuita de Grok Build, aunque otras fuentes la sitúan dentro del plan SuperGrok de 30 $/mes; conviene revisar x.ai/build antes de dar por hecho el acceso gratuito. El uso de la API se paga.

### ¿Cuánto cuesta Grok 4.6?

2 $ por millón de tokens de entrada y 6 $ de salida, con la entrada en caché a 0,50 $, por debajo de los 200K tokens de prompt. Por encima de ese umbral, cada token de la petición se factura al doble: 4 $ de entrada, 12 $ de salida, 1 $ en caché. Una variante «fast» aparte cuesta el doble de la tarifa estándar.

### ¿Cuál es la ventana de contexto de Grok 4.6?

500.000 tokens, la misma que Grok 4.5. No aumentó. Ten en cuenta que el precio duplicado entra a los 200K tokens de prompt, mucho antes de que la ventana esté llena.

### ¿Grok 4.6 es mejor que Grok 4.5?

En los benchmarks, sí: puntúa 61 en el Artificial Analysis Intelligence Index frente a 56 de 4.5, con mejoras notables en las pruebas de agentes y programación. En la práctica es la mejor opción para trabajo agéntico de varios pasos, mientras que 4.5 sigue siendo razonable para prompts enfocados y con mucha caché. Los dos cuestan lo mismo, de modo que el motivo para quedarte en 4.5 es la simplicidad, no el precio.

### ¿Grok 4.6 es mejor que GPT-5.6 o Claude?

Empata con GPT-5.6 Sol Max en 61 en el índice compuesto, y frente a GPT-5.6 los benchmarks de programación se reparten a partes iguales. Claude Opus 5 y Fable 5 de Anthropic quedan ambos por encima de Grok 4.6 en el índice. La ventaja de Grok es el precio, no la capacidad de gama alta.

### ¿Cuántos parámetros tiene Grok 4.6?

xAI no ha publicado un recuento exacto de parámetros. La ficha del modelo lo describe como parte de una familia «de escala de 1,5 billones»; lee «1,5 billones» como una etiqueta de familia y no como una especificación confirmada. Las cifras que circulan por algunos medios («2 billones de parámetros») no las respalda ninguna fuente primaria.

### ¿Cuándo llegan Grok 4.7 o Grok 5?

Musk ha dicho en X que Grok 4.7 está a «semanas» de distancia, a mayor escala; sus fechas se han retrasado antes, por lo que sus plazos son objetivos, no compromisos. Ninguna fuente primaria da una fecha para Grok 5: trata cualquier plazo concreto para él como especulación.

## Fuentes

- Introducing Grok 4.6 - xAI (SpaceXAI), 12 ago 2026 - `x.ai/news/grok-4-6`
- Grok 4.6 model overview and specifications - xAI Docs - `docs.x.ai/developers/grok-4-6`
- Grok 4.6 Intelligence Index, cost and speed - Artificial Analysis - `artificialanalysis.ai/models/grok-4-6`
- SpaceXAI debuts Grok 4.6 - VentureBeat, 12 ago 2026 - `venturebeat.com/technology/spacexai-debuts-grok-4-6-overtaking-kimi-k3s-performance-and-matching-gpt-5-6-sol-for-worlds-third-best-on-artificial-analysis`
- SpaceXAI Releases Grok 4.6 - MarkTechPost, 12 ago 2026 - `marktechpost.com/2026/08/12/spacexai-releases-grok-4-6`
- xAI's Grok 4.6 Holds the Base Model Constant - FourWeekMBA, 12 ago 2026 - `fourweekmba.com/ai-xai-grok-4-6-post-training-turn`
