Saltar al contenido
IA

SpaceXAI lanza Grok 4.7 con mejor autoverificación y tarifas de 2 y 6 dólares por millón

El nuevo modelo de SpaceXAI mejora frente a Grok 4.6 en tareas prolongadas, pero su precio de 2 y 6 dólares cambia cuando la solicitud supera 200,000 tokens.

por Gerardo Pavez
A man using a computer with a large screen in a dark room, focused on technology.
Foto de Alberlan Barros en Pexels

SpaceXAI lanzó el 21 de septiembre de 2026 Grok 4.7, su nuevo modelo de inteligencia artificial para programación, tareas con agentes y trabajo de conocimiento, con una ventana de contexto de 500,000 tokens y tarifas base de 2 dólares por millón de tokens de entrada y 6 por millón de salida. La compañía afirma que trabaja durante más tiempo en problemas difíciles, verifica mejor sus resultados y administra contextos extensos con mayor eficacia que Grok 4.6. Está disponible desde hoy en Cursor, Grok Build y la API de SpaceXAI. El precio anunciado tiene una condición importante: las solicitudes que superan 200,000 tokens se facturan con tarifas de contexto largo más altas.

Un modelo entrenado para tareas que duran horas

El cambio busca mejorar el desempeño en trabajos de varios pasos, no solo responder preguntas aisladas. SpaceXAI dice que Grok 4.7 usa una base más grande que Grok 4.6 y que recibió una sesión más larga de aprendizaje por refuerzo con tareas diseñadas para durar horas. El objetivo declarado es que el modelo revise su propio trabajo, continúe con problemas difíciles y se equivoque menos al operar sobre contextos extensos.

La compañía también lo entrenó para entender de forma nativa el entorno de Grok Bot, su sistema para tareas conversacionales y trabajo general. La ficha técnica de la API confirma que acepta texto e imágenes, admite cuatro niveles de razonamiento, desde low hasta xhigh, y tiene un contexto máximo de 500,000 tokens.

El precio de 2 y 6 dólares solo aplica al contexto corto

La tarifa base repite la de Grok 4.6, cuya estructura de costos quedó expuesta en agosto, pero la documentación técnica introduce una diferencia que puede cambiar la factura de los agentes que trabajan durante horas:

  • Por debajo de 200,000 tokens de contexto, la entrada cuesta 2 dólares por millón y la salida 6 dólares. Los tokens de entrada reutilizados desde caché cuestan 0.50 dólares por millón.
  • Cuando la solicitud supera 200,000 tokens, se aplican las tarifas de contexto largo a todos los tokens de esa petición: 4 dólares por millón de entrada, 1 dólar por millón de entrada en caché y 12 dólares por millón de salida.
  • Grok 4.7 Fast duplica la velocidad de salida, pero también duplica las tarifas. Esta variante solo está disponible en Cursor y Grok Build, no en la API pública de SpaceXAI.

En la comparación publicada por la propia compañía, Grok 4.7 aparece con una tarifa de 2 dólares de entrada y 6 de salida, frente a 4 y 20 dólares para GPT-5.6 Sol y 10 y 50 dólares para Fable 5.1. La ventaja de precio es clara, aunque la frase de que cuesta la mitad depende del rival y no describe por igual las dos partidas.

Los benchmarks mejoran, pero no ponen a Grok 4.7 primero en todo

La tabla oficial de SpaceXAI muestra mejoras frente a Grok 4.6, aunque también deja claro que el nuevo modelo no domina todas las pruebas. En la comparación, Grok 4.7 aparece con esfuerzo xhigh, Grok 4.6 con high y los modelos rivales con max, así que los resultados no corresponden a una configuración idéntica.

  • En CursorBench 4.0, centrado en tareas prolongadas de programación, Grok 4.7 obtuvo 46.3%, frente a 40.4% de Grok 4.6, 41.7% de GPT-5.6 Sol y 51.8% de Fable 5.1.
  • En AA Briefcase v1.1, que mide trabajo de oficina de varias horas, marcó 1,657 puntos, por encima de los 1,546 de Grok 4.6 y los 1,487 de GPT-5.6 Sol, pero por debajo de los 1,678 de Fable 5.1.
  • En Terminal-Bench 4.0, dedicado al trabajo prolongado en terminal, subió a 38.0%, desde 20.3% en Grok 4.6. Quedó apenas por encima de GPT-5.6 Sol, con 37.3%, y lejos de Fable 5.1, con 57.9%.
  • En HealthBench Professional, Grok 4.7 alcanzó 56.7%, mientras GPT-5.6 Sol llegó a 60.5% y Fable 5.1 a 62.1%.

Estas cifras proceden de la tabla que publicó SpaceXAI junto con el lanzamiento. Sirven para identificar dónde la compañía ve sus avances, pero todavía deben contrastarse con evaluaciones independientes y con tareas reales de los usuarios.

Disponibilidad y variantes

Grok 4.7 puede utilizarse desde el 21 de septiembre en Cursor, donde está disponible en todos los planes según la documentación del modelo, y en Grok Build, donde aparece como modelo predeterminado del agente de programación. También se ofrece mediante la API con el identificador grok-4.7 y a través de los gateways de OpenRouter, Vercel y Cloudflare.

El anuncio promociona una variante rápida con el doble de velocidad de salida. La documentación aclara que no es un modelo distinto, sino el mismo Grok 4.7 servido sobre infraestructura más rápida y con un precio doble. Por eso, el reclamo de velocidad no debe confundirse con una medición que demuestre que la versión base es dos veces más rápida que todos sus competidores.

Para quienes construyen agentes de programación o automatizan trabajo de conocimiento, la propuesta queda definida por dos cifras y una condición: 2 y 6 dólares por millón de tokens en la tarifa corta, pero 4 y 12 cuando el contexto supera 200,000 tokens. La capacidad de revisar su propio trabajo y el desempeño final tendrán que medirse junto con ese costo real.

Fuentes: 1, 2, 3

Gerardo Pavez imagen de perfil
por Gerardo Pavez

Redactor y creador de contenido especializado en deportes y tecnología. Apasionado por todo lo que ocurre dentro y fuera de la cancha.

Leer más de Tecnología y Ciencia