Alibaba planea entrenar un modelo de inteligencia artificial de entre 5 y 10 billones de parámetros, es decir, entre 5 y 10 millones de millones. Por recuento total, sería aproximadamente de dos a cuatro veces más grande que Qwen3.8-Max, su actual modelo insignia de 2.4 billones. Eddie Wu, CEO de Alibaba, anunció el objetivo el 22 de septiembre durante la conferencia Apsara en Hangzhou, donde también presentó el chip Zhenwu V900 y una meta de superar los 20 gigavatios de capacidad global de centros de datos para 2032. Alibaba no describió un modelo terminado ni fijó una fecha de lanzamiento: presentó una escala de desarrollo que conecta el siguiente salto de Qwen con la infraestructura necesaria para entrenarlo y ofrecerlo.
El tamaño crece, pero no garantiza por sí solo mejor rendimiento
Los parámetros son las variables que un modelo ajusta durante el entrenamiento y funcionan como una medida aproximada de su tamaño. Un recuento mayor suele exigir más datos, memoria, interconexión y tiempo de cómputo, pero no convierte por sí solo a un modelo en mejor. Reuters reportó que Alibaba todavía trabaja en la arquitectura y la optimización de datos del sistema.
El objetivo de Qwen es resolver tareas más complejas y de mayor horizonte temporal, con la mira puesta en la superinteligencia artificial, según explicó Wu. El equipo también ha reportado avances en mejora recursiva: modelos que detectan limitaciones, diseñan experimentos y sintetizan datos para alimentar nuevos ciclos de entrenamiento. Esa descripción pertenece a Alibaba y no constituye una demostración pública de que el sistema ya pueda auto-mejorarse de forma general.
El punto de comparación inmediato es Qwen3.8-Max, presentado por Alibaba en agosto con 2.4 billones de parámetros. Nuestra cobertura del modelo de 2.4T detalló que, incluso con cuantización agresiva, esa escala puede requerir cientos de gigabytes de memoria.
El nuevo chip busca sostener el salto de Qwen
En paralelo, Alibaba presentó Zhenwu V900, un chip de IA diseñado por su unidad de semiconductores T-Head. Wu lo describió como el chip de IA más potente de China y dijo que ofrece tres veces el rendimiento del M890. Un clúster construido con el V900 puede admitir hasta 500,000 tarjetas para entrenar y ejecutar modelos de frontera, de acuerdo con la información reportada por Reuters.
El supernodo de IA basado en el M890 ya puede hacer inferencia con modelos de más de 2 billones de parámetros, según Wu, quien dijo que esa capacidad está en manos de un puñado de compañías a escala global. Alibaba Cloud prevé comenzar a poner sus supernodos de IA en operación comercial a escala durante el trimestre actual.
La apuesta también se inserta en la carrera china por fabricar alternativas domésticas a los procesadores de Nvidia, en un momento marcado por las restricciones estadounidenses a la exportación de chips avanzados. Alibaba está intentando cubrir con hardware propio una parte mayor de la cadena que necesita para entrenar y ejecutar sus modelos.
La escala del modelo exige centros de datos
Wu fijó el objetivo de que la capacidad global de centros de datos de Alibaba Cloud supere los 20 gigavatios para 2032 y describió la demanda de infraestructura de IA como excepcionalmente fuerte. Reuters también reportó que las limitaciones de suministro en la cadena de centros de datos están frenando la velocidad a la que la empresa puede ampliar esa capacidad.
El objetivo de 20 gigavatios mide capacidad de centros de datos, no el rendimiento del modelo. Su importancia está en mostrar que Alibaba no está anunciando solo una arquitectura más grande: el plan combina entrenamiento, inferencia, chips, redes, memoria, almacenamiento y electricidad a una escala que requiere infraestructura propia y expansión global.
La información publicada mantiene el proyecto en el nivel de objetivo. Todavía no hay una fecha anunciada para un modelo terminado ni resultados públicos que permitan evaluar si el salto de parámetros se traducirá en mejores capacidades.
Alibaba tendrá que convertir la cifra en un sistema entrenado y medible, mientras el V900 y la expansión de centros de datos convierten la promesa de escala en capacidad operativa. Por ahora, lo anunciado es el tamaño de la apuesta, no el resultado final.