OpenAI amplió su generación GPT-6 con dos modelos más rápidos y baratos, GPT-6 Sol y GPT-6 Luna, que acompañan al modelo insignia Astra estrenado a inicios de septiembre. La empresa recortó a la mitad el precio de acceso por API frente a la serie GPT-5.6 y asegura que sus modelos cometen menos errores: según su evaluación interna de factualidad, GPT-6 Sol se equivoca alrededor de la mitad que su antecesor y GPT-6 Luna, en sus niveles de esfuerzo más altos, iguala la fiabilidad de GPT-5.6 Sol por cerca del 1% de su costo. Son cifras propias de OpenAI, y su anuncio quedó desfasado a las pocas horas: Anthropic había abaratado su modelo Opus 5.5 unos 90 minutos antes.
Los precios de API bajan a la mitad
El principal anuncio es de precio. En la API, GPT-6 Sol cuesta la mitad que GPT-5.6 Sol y GPT-6 Luna la mitad que GPT-5.6 Luna, un recorte que OpenAI atribuye a mejoras en el almacenamiento en caché y en la inferencia. La empresa aclara que las tarifas de la serie 5.6 eran promocionales y que estos nuevos precios son los de referencia, según explicó un portavoz a The New Stack.
Estos son los precios por millón de tokens, de entrada y de salida, frente a la generación anterior:
| Modelo | GPT-5.6 | GPT-6 |
|---|---|---|
| Sol | $4 / $20 | $2 / $10 |
| Luna | $0.20 / $1.20 | $0.10 / $0.50 |
Junto con la rebaja, OpenAI ofrece límites de uso más altos. Por ahora no existe una versión GPT-6 de Terra, el modelo intermedio de la familia, según The New Stack.
OpenAI dice que sus modelos fallan menos
La compañía sostiene que sus nuevos modelos aciertan más. En una evaluación interna de factualidad, construida con conversaciones reales anonimizadas en las que los usuarios habían marcado un error, GPT-6 Sol comete alrededor de la mitad de fallos que su antecesor y se acerca, dice OpenAI, a la fiabilidad de Astra a un costo mucho menor. GPT-6 Luna también mejora: en sus niveles de esfuerzo más altos, la empresa afirma que iguala la precisión factual de GPT-5.6 Sol por aproximadamente la centésima parte de su costo.
La propia OpenAI advierte que esa evaluación parte de conversaciones diseñadas para provocar errores y no refleja el uso típico, donde los fallos son más raros. Y The New Stack apunta que, a diferencia de lanzamientos anteriores, la empresa no entregó un juego completo de resultados de referencia antes del anuncio.
En seguridad, OpenAI reporta un avance y también un punto flojo. Su prueba interna de "engaño en código" para Sol bajó a 1.3% desde 10.4%, pero cuando los investigadores le pidieron respetar una advertencia explícita de "acceso denegado", Sol siguió intentando saltarse la restricción en 64.4% de los intentos, apenas por debajo del 68.2% de la versión previa; Luna mejoró más, a 42.4% desde 78.5%. OpenAI precisa que esas pruebas cubren situaciones de bajo riesgo y corren sin las salvaguardas de sus productos.
El anuncio nació desfasado frente a Anthropic
Como suele ocurrir con OpenAI, buena parte del anuncio compara sus modelos con los de Anthropic, y el foco está en el costo por tarea más que en el precio por token. En la prueba AutomationBench, de flujos de trabajo empresariales, OpenAI dice que GPT-6 Sol con esfuerzo alto supera a Claude Opus 5 en su máximo por apenas 9% de su costo por tarea; en la de ingeniería de software DeepSWE, sitúa a Sol a 1.1 puntos del mejor resultado de Claude Fable 5, con un costo por tarea cerca de 80% menor.
El problema es que esas comparaciones envejecieron el mismo día. Anthropic lanzó una nueva versión de Opus 5.5 unos 90 minutos antes, según TechCrunch, y bajó su precio por token a 4 y 20 dólares (desde 5 y 25). Eso deja a Opus 5.5 al doble del precio de GPT-6 Sol, pero Anthropic sostiene que su modelo usa menos tokens por tarea, lo que según la empresa se traduce en costos 40% menores que Opus 5 en cargas habituales. Nadie ha medido aún Sol y Opus 5.5 frente a frente, y como es casi imposible saber cuántos tokens gastará un agente en completar una tarea, ninguna de estas rebajas facilita presupuestar.
Disponibles hoy en Codex y ChatGPT Work
GPT-6 Sol y GPT-6 Luna llegan hoy a ChatGPT Work y a Codex para los usuarios Plus, Pro, Business, Enterprise y Edu. Las cuentas gratuitas y las del plan Go pueden probar Luna en la app de escritorio. Todavía no están en el modo Chat. En la API se identifican como gpt-6-sol y gpt-6-luna. OpenAI dijo que los distribuirá de forma gradual a lo largo del día para no saturar el servicio, así que pueden tardar en aparecer.
Para quien programa, el cambio inmediato no es un salto de capacidad sino tokens más baratos y más margen para iterar. En un mercado donde dos laboratorios recortaron precios con minutos de diferencia, la disputa se juega cada vez más en el costo por tarea que en la tabla de benchmarks.