TL;DR:
- Grok 4.6 marcó 61 puntos en el Índice de Inteligencia de Artificial Analysis, cinco más que Grok 4.5 y el mismo nivel que GPT-5.6 Sol en su modo de razonamiento máximo.
- La tarifa de lista no cambió, 2 dólares por millón de tokens de entrada y 6 de salida, pero el token servido desde caché pasó de 0.30 a 0.50 dólares.
- Claude Opus 5 y Claude Fable 5 siguen arriba en ese índice, con 63 y 62 puntos.
SpaceXAI lanzó este miércoles Grok 4.6, el modelo con el que apunta a agentes de larga duración, programación y trabajo de conocimiento, poco más de un mes después de Grok 4.5. La firma independiente Artificial Analysis lo midió en 61 puntos de su Índice de Inteligencia, cinco arriba de la versión anterior y en línea con GPT-5.6 Sol en su modo de razonamiento máximo, aunque por debajo de Claude Opus 5, que marca 63, y de Claude Fable 5, con 62. El argumento de venta es el precio, 2 dólares por millón de tokens de entrada y 6 por millón de salida, la misma tarifa que ya cobraba Grok 4.5 y menos de la mitad de lo que cuestan los dos modelos que quedaron arriba. La tabla oficial de xAI, sin embargo, sí registra un aumento.
El modelo corre desde hoy en la API de xAI, en Cursor con todos los planes y en Grok Build, donde es el modelo por defecto del agente de programación, además de los gateways de OpenRouter, Vercel y Cloudflare. Conserva la ventana de contexto de 500,000 tokens de Grok 4.5, acepta texto e imagen de entrada, no fija límite de salida y ofrece cuatro niveles de razonamiento: bajo, medio, alto por defecto y xhigh. Su corte de conocimiento es el 1 de febrero de 2026.
SpaceXAI atribuye la mejora a una tanda de entrenamiento suplementario más larga, a datos de ingeniería de mayor calidad y a más aprendizaje por refuerzo aplicado a programación y trabajo de conocimiento. Según el anuncio que reseñó 9to5Mac, el modelo sostiene tareas de muchos pasos, se orienta en bases de código que no conoce y prueba con más frecuencia su propio resultado antes de seguir adelante. En su cuenta oficial, la compañía lo presentó como una mejora significativa sobre Grok 4.5 al mismo precio.
Los dos renglones que sí cambiaron en la tabla de precios
La tarifa pública de entrada y salida es idéntica a la de Grok 4.5. El movimiento está en el token servido desde caché, el que abarata las conversaciones largas porque reutiliza contexto ya procesado. Así quedan las dos versiones en la tabla de precios de xAI, donde el contexto largo empieza en 200,000 tokens:
| Dólares por millón de tokens | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Entrada, contexto corto | 2.00 | 2.00 |
| Caché, contexto corto | 0.30 | 0.50 |
| Salida, contexto corto | 6.00 | 6.00 |
| Entrada, contexto largo | 4.00 | 4.00 |
| Caché, contexto largo | 0.60 | 1.00 |
| Salida, contexto largo | 12.00 | 12.00 |
Los renglones que subieron son justo los que más pesan en un agente que trabaja horas sobre el mismo repositorio. El descuento tampoco es automático: la documentación de xAI recomienda fijar una llave de caché para que las peticiones de una misma conversación lleguen al mismo servidor y advierte que, sin ella, es frecuente terminar pagando el precio completo de entrada.
Hay otras dos condiciones en la letra chica. Cuando una petición supera los 200,000 tokens, la tarifa de contexto largo se aplica a todos los tokens de esa petición y no solo a los que exceden el umbral. Y la versión de respuesta prioritaria, pensada para menor latencia, se cobra al doble de la tarifa estándar en todos los tipos de token, con el descuento de caché aplicado antes del multiplicador.
Artificial Analysis lo deja en la frontera, detrás de dos modelos de Anthropic
La casa de análisis resume el salto como un regreso a la frontera: cinco puntos sobre Grok 4.5 y 23 sobre Grok 4.3, con SpaceXAI de vuelta junto a OpenAI y solo por detrás de Anthropic. El titular que eligió la compañía, el empate con GPT-5.6 Sol, es cierto y también es la comparación que mejor le sienta, porque en ese mismo índice Claude Opus 5 y Claude Fable 5 conservan la delantera.
Donde el modelo destaca es en tareas de agente. En GDPval-AA v2, la medida de trabajo de conocimiento real de esa firma, marcó un Elo de 1753, solo detrás de Claude Opus 5 y sin diferencia estadística frente a Claude Fable 5 y Qwen3.8 Max por el traslape de los intervalos de confianza. En τ³-Banking, que evalúa atención al cliente en varios turnos con uso de herramientas, obtuvo 50.7%, el segundo mejor resultado detrás del 51.3% de Qwen3.8 Max. En Terminal-Bench v2.1 llegó a 88.4%, al nivel de los punteros.

La eficiencia es el otro dato de esa comparación. Artificial Analysis midió que Grok 4.6 resuelve las tareas de AA-Briefcase, su banco privado de trabajo de conocimiento de largo aliento, en unos 53 turnos y 500 millones de tokens de entrada en promedio, frente a los 103 turnos y 2,000 millones de Claude Opus 5 en su modo máximo. En ese banco el modelo debuta con un Elo de 1577, al nivel de Claude Fable 5 y por debajo de la familia Claude Opus 5, y su costo medido por tarea fue de 0.84 dólares, el mismo que Kimi K3.
La acción de SpaceX pasó del mínimo histórico a superar su precio de salida
El lanzamiento movió el mercado. CoinGape reportó, con datos de TradingView, que SPCX subía más de 6% el miércoles hasta rondar los 142 dólares, con un alza superior a 24% en cinco sesiones que la dejó por encima de los 135 dólares a los que la compañía salió al Nasdaq en junio. Hace una semana el cuadro era el contrario: la acción cerró el 5 de agosto en 108.27 dólares, su mínimo histórico, después de que el primer reporte trimestral revelara 18,400 millones de dólares de gasto de capital en tres meses.

La relación entre un modelo y la cotización es directa. En ese mismo trimestre el negocio de inteligencia artificial de la compañía creció 247% hasta 2,600 millones de dólares y absorbió 15,800 millones del gasto de capital, con una pérdida operativa de 1,300 millones. Morgan Stanley planteó esta semana un escenario alcista de 600 dólares por acción apoyado justamente en ese negocio, según CoinGape, que también apunta que en el mercado de predicciones Polymarket los apostadores le dan 5% de probabilidad a que SpaceXAI tenga el mejor modelo de IA al cierre del año.
Queda por confirmar dónde se puede usar. La documentación de xAI advierte que el acceso a los modelos varía según la ubicación geográfica y remite a la consola de cada equipo para saber qué está habilitado. No es un detalle menor para el lector en España: cuando Grok 4.5 se estrenó en julio, Engadget y heise reportaron que salió sin disponibilidad en la Unión Europea. El siguiente modelo, Grok 4.7, llegaría en semanas, según lo que Musk adelantó y recogió CoinGape.
El saldo para quien paga por token cabe en dos cifras: el índice sube cinco puntos con la tarifa de lista intacta, y el caché cuesta 0.50 dólares por millón en lugar de 0.30. En un agente que reutiliza el mismo contexto durante horas, ese renglón es el que se nota en la factura.