Saltar al contenido

Ultrafast corre GPT-5.6 Sol hasta 14 veces más rápido y OpenAI ya tiene 4.22% de Cerebras

OpenAI abrió la vista previa de Ultrafast, que corre GPT-5.6 Sol hasta 14 veces más rápido sobre hardware de Cerebras. Las pruebas de tarea completa que publicó Cerebras dan entre 5.6 y 7 veces, y no hay precio. El reporte trimestral suma otro dato.

por Dilis Salazar
Detailed view of electronic circuit board components showcasing microchips and technology intricacies.
Foto de Jakub Pabis en Pexels

TL;DR:

  • OpenAI abrió una vista previa limitada de Ultrafast, un nivel de servicio de su API que corre GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento Standard, con hasta 750 tokens de salida por segundo sobre hardware de Cerebras.
  • Las mediciones de tarea completa que publicó la propia Cerebras dan 5.6 veces en GDP-Val y casi 7 en Humanity's Last Exam. El 14 veces se refiere a la generación de tokens, no al reloj de una tarea entera.
  • Ninguna de las dos empresas publicó precio ni fecha de apertura general. El reporte trimestral que Cerebras presentó el 12 de agosto muestra que OpenAI ejerció en julio warrants por 10,033,508 acciones, el 4.22% de la compañía.

OpenAI abrió el jueves 13 de agosto una vista previa limitada de Ultrafast, un nivel de servicio de su API que corre GPT-5.6 Sol, su modelo más capaz, hasta 14 veces más rápido que el procesamiento Standard y con hasta 750 tokens de salida por segundo. El hardware lo pone Cerebras, que anunció lo mismo por su cuenta con un comunicado y una entrada de blog. Ninguna de las dos empresas publicó precio ni fecha de apertura general, y el acceso arranca con un grupo reducido de clientes más una lista de espera. Un dato que no aparece en ninguno de los anuncios sí está en el reporte trimestral que Cerebras presentó un día antes ante la SEC. Ahí consta que OpenAI ejerció warrants en julio por 10,033,508 acciones, el 4.22% de la empresa que le vende el cómputo.

Ultrafast no es un modelo nuevo. Es el mismo GPT-5.6 Sol que OpenAI presentó el 26 de junio en acceso limitado y liberó al público el 9 de julio, corriendo sobre otra máquina. Cerebras sostiene que la versión Ultrafast conserva la misma inteligencia que la Standard y que no hay concesión de calidad. El movimiento llega en la misma semana en que Grok 4.6 empató con Sol en el índice de Artificial Analysis sin subir su precio por token, como contamos. La respuesta de OpenAI no pasa por la inteligencia del modelo, sino por el tiempo que tarda en entregarla.

Grok 4.6: mismo precio de lista, caché más caro
Grok 4.6 marca 61 en el índice de Artificial Analysis y conserva la tarifa de 2 y 6 dólares, pero el caché sube de 0.30 a 0.50.

El 14 veces mide tokens por segundo, no el reloj de una tarea completa

El multiplicador cuadra con lo que mide un tercero. Si Ultrafast llega a 750 tokens de salida por segundo y eso son 14 veces el Standard, la base implícita queda en unos 54 tokens por segundo. Artificial Analysis, el evaluador independiente que la propia Cerebras cita en su comunicado, mide entre 55 y 62 tokens por segundo en GPT-5.6 Sol servido por OpenAI, según la configuración de esfuerzo y la carga de entrada. En todas ellas lo clasifica como más lento que el promedio de su categoría, cerca de 68.

Cada cifra mide una cosa distinta. Los 750 tokens por segundo describen la velocidad a la que el modelo escribe una vez que arranca. Ninguna de las mediciones de extremo a extremo que Cerebras publicó ese mismo día se acerca a las 14 veces. Esta tabla reúne las cuatro cifras que la empresa difundió y qué compara cada una.

Prueba Resultado Cómo se midió
Tokens de salida por segundo Hasta 14 veces, hasta 750 por segundo Ultrafast contra el nivel Standard de GPT-5.6 Sol
Humanity's Last Exam, 2,500 preguntas Casi 7 veces, 11 h 11 min contra 78 h 27 min Ultrafast en Codex el 10 de julio; Claude Fable 5 en Claude Code del 13 al 15 de julio
GDP-Val, trabajo de conocimiento 5.6 veces de extremo a extremo GPT-5.6 Sol y su versión Ultrafast, los dos en Codex, el 31 de julio
Tablero financiero a partir de un prompt 6.7 veces, 1 min 50 s contra 12 min 20 s Mismo prompt en Ultrafast y en Standard, según la demostración de Cerebras recogida por TestingCatalog

Las cuatro cifras son de Cerebras. Las tres que miden una tarea de principio a fin quedan entre 5.6 y 7 veces, que es el rango que un cliente vería en el reloj.

La prueba contra Claude corrió en dos programas y en semanas distintas

Humanity's Last Exam es un banco de 2,500 preguntas de nivel doctoral en áreas como química, economía y literatura. Cerebras dice que Ultrafast respondió las 2,500 en 11 horas y 11 minutos, contra 78 horas y 27 minutos de Claude Fable 5, con precisión comparable. La empresa no publicó los puntajes de precisión de ninguno de los dos.

La letra chica del blog añade lo que el comunicado a los medios no incluye. Ultrafast se corrió con Codex en razonamiento xhigh el 10 de julio; Claude Fable 5 se corrió con Claude Code, también en xhigh, entre el 13 y el 15 de julio. Son dos programas distintos, en semanas distintas. La prueba de GDP-Val, la que dio 5.6 veces, se hizo el 31 de julio con razonamiento medium en los dos casos. Quien lea solo el comunicado que salió por el cable no ve ninguna de esas condiciones.

Las comparaciones con Anthropic tienen la misma mezcla de orígenes. Cerebras afirma que Ultrafast corre 5 veces más rápido que Claude Opus 4.8 en modo Fast y 11 veces más rápido que Claude Fable 5, y aclara que los números del lado de Anthropic salen de las velocidades de salida que reporta Artificial Analysis, no de sus propias corridas.

El precio y la fecha de apertura siguen en blanco

Lo que cuesta hoy GPT-5.6 Sol está publicado: 5 dólares por millón de tokens de entrada y 30 por millón de salida en la API de OpenAI, según el desglose de proveedores de Artificial Analysis. Lo que costará correrlo en Ultrafast, no. TestingCatalog lo señaló el mismo jueves, y ni la entrada de OpenAI ni el comunicado de Cerebras ni el blog técnico traen una tarifa o un calendario de disponibilidad general.

Dark-themed laptop setup with a red glowing keyboard and code on screen, ideal for tech enthusiasts.
Imagen ilustrativa: Ultrafast solo está disponible por invitación y a través de la API de OpenAI. · Foto de Rahul Pandit en Pexels

Para un desarrollador en México, España o el resto de América Latina eso deja poco que hacer hoy. El formulario de espera pide carga de trabajo, requisitos de latencia y uso previsto, un perfil de cliente empresarial. El otro anuncio del jueves fue de Google, que puso Gemini 3.7 Flash en disponibilidad general en más de 160 países y con tarifa publicada. Ultrafast sigue detrás de una invitación.

El reporte trimestral muestra que OpenAI ya tiene el 4.22% de Cerebras

El dato no salió de ningún comunicado. Está en la nota 17 del reporte trimestral que Cerebras presentó ante la SEC el 12 de agosto, después del cierre del mercado, y lo reportó RuntimeWire el mismo jueves. Bajo hechos posteriores, la empresa consigna que en julio OpenAI ejerció parcialmente su warrant y compró 10,033,508 acciones Clase N. El precio de ejercicio es de 0.00001 dólares por acción, así que el desembolso en efectivo fue de unos 100 dólares.

Esas acciones equivalen al 4.22% de los 237,564,041 títulos en circulación al 5 de agosto. Las Clase N no dan voto y se convierten una a una en Clase A cuando se transfieren, con los mismos derechos de dividendo y liquidación. OpenAI se quedó con exposición económica y sin voto en las decisiones de la compañía.

El precio simbólico no significa que Cerebras haya regalado el paquete. El warrant nació con el acuerdo marco de diciembre de 2025 y funciona como incentivo comercial. Cerebras lo valoró en 82.02 dólares por acción al momento de otorgarlo y registró 822.9 millones de dólares en activos por warrants de cliente en el primer semestre de 2026, una cifra que amortiza como reducción de sus propios ingresos hasta octubre de 2031.

El acuerdo que lo sostiene también está en el reporte. OpenAI se comprometió a comprar 750 MW de capacidad de inferencia por un plazo de tres o cuatro años extensible a cinco, financió en enero un préstamo garantizado de capital de trabajo de unos 1,000 millones de dólares con un interés declarado de 6% anual y tiene opción sobre 1.25 GW adicionales para desplegar antes de que termine 2030. Al 30 de junio, Cerebras contabilizaba 25,400 millones de dólares en obligaciones de desempeño pendientes, con una parte importante atribuible a ese contrato.

Quedan 23,411,518 acciones del warrant sin consolidar, atadas a más entregas de capacidad, umbrales de capitalización o pagos del cliente. Si todas llegaran a consolidarse y ejercerse sobre la base actual de títulos, la participación de OpenAI rondaría el 12.8%, y ejercerlas costaría unos 234 dólares.

Ultrafast, por ahora, no cambia nada para quien no reciba la invitación. Lo que sí cambió, y consta en un documento presentado ante la SEC, es la relación entre el cliente y su proveedor: OpenAI compra cómputo a una empresa de la que ya posee una porción, y el resto de ese paquete accionario se consolida solo si compra más.

Fuentes: 1, 2, 3, 4

Dilis Salazar imagen de perfil
por Dilis Salazar

Suscríbete GRATIS

Recibe las noticias más importantes de política, tecnología, negocios, deportes, entretenimiento y cultura directamente en tu correo.

¡Listo! Revisa tu correo

Para completar la suscripción, haz clic en el enlace de confirmación que enviamos a tu correo. Si no llega en 3 minutos, revisa tu carpeta de spam.

Ok, gracias

Leer más de Tecnología y Ciencia