TL;DR:
- Alibaba lanzó Qwen3.8-Max, su modelo de inteligencia artificial más grande hasta ahora.
- Arena AI lo coloca por delante de Kimi K3 en texto, aunque Kimi conserva la ventaja en código web.
- Qwen publicará los pesos de Qwen3.8-Max y Qwen3.8-27B durante la semana del 10 de agosto.
Alibaba lanzó el 3 de agosto Qwen3.8-Max, su modelo de inteligencia artificial más grande hasta ahora, con 2.4 billones de parámetros y una ventana de contexto de hasta 1 millón de tokens. El sistema acepta texto, imágenes y video, y ya aparece en los rankings públicos de Arena AI, donde queda por delante de Moonshot AI en la clasificación general de texto. El siguiente paso llegará la próxima semana, cuando Qwen publique los pesos de Qwen3.8-Max y del nuevo Qwen3.8-27B, aunque todavía no existe una fecha exacta ni una licencia confirmada.
Qwen3.8-Max es un modelo multimodal basado en una arquitectura Mixture of Experts (MoE). Aunque reúne 2.4 billones de parámetros, Alibaba afirma que utiliza aproximadamente 95,000 millones de parámetros por consulta, en lugar de activar el modelo completo cada vez.
Eso reduce el cómputo necesario para responder, pero la cifra total sigue mostrando un sistema diseñado para tareas de gran escala. Sus capacidades anunciadas incluyen:
- Puede recibir texto, imágenes y video, y responder en texto.
- Procesa hasta 1 millón de tokens en una sola ventana de contexto.
- Está orientado a programación autónoma, investigación prolongada y flujos de trabajo con múltiples pasos.
- Alibaba también lo presentó como un modelo capaz de trabajar con documentos extensos, código y tareas de oficina.
Qwen queda arriba de Kimi en texto, pero no en código web
La afirmación de Alibaba de que Qwen3.8-Max supera a Kimi K3 en algunas pruebas tiene respaldo en los rankings públicos, aunque la ventaja depende de la tarea.
En la clasificación general de texto de Arena AI, consultada el 3 de agosto de 2026, Qwen3.8-Max aparecía en el quinto lugar con 1,496 puntos, frente a los 1,485 puntos de Kimi K3, que ocupaba el puesto 13. Arena marca ambos resultados como preliminares.
La tabla de programación web cuenta una historia distinta:
- En Code Arena, Kimi K3 ocupaba el segundo lugar con 1,676 puntos.
- Qwen3.8-Max aparecía en cuarto lugar con 1,668 puntos.
- En Vision Arena, Qwen3.8-Max alcanzaba el segundo puesto global con 1,305 puntos, detrás de Claude Fable 5, que registraba 1,318.
Los resultados muestran por qué el anuncio habla de superar a Kimi K3 en algunas evaluaciones, no de una victoria general. Qwen obtiene una ventaja visible en texto, mientras Kimi mantiene una diferencia pequeña en programación web. Además, las puntuaciones de Qwen todavía son preliminares y pueden cambiar a medida que aumente el número de votos.
Alibaba presume una prueba autónoma de 16 días
El equipo de Qwen acompañó el lanzamiento con una demostración de programación de largo plazo. En su publicación oficial afirma que, después de aproximadamente 16 días de operación autónoma, el repositorio utilizado para la prueba había acumulado 265 commits y 127 pull requests al 30 de julio.
Reuters también reportó que Alibaba presentó un proyecto de ingeniería de software completado en 16 días. La demostración busca mostrar que Qwen3.8-Max puede mantener una tarea durante periodos mucho más largos que una conversación común, con múltiples cambios, revisiones y decisiones intermedias.
Estas cifras proceden de una prueba presentada por Alibaba, no de una auditoría independiente. Su valor está en mostrar el tipo de trabajo que la compañía quiere asociar con su nuevo modelo: programación con agentes, investigación extensa y procesos que no terminan en una sola respuesta.
Los pesos llegarán junto al Qwen3.8-27B
Qwen anunció que publicará la próxima semana los pesos de Qwen3.8-Max y de Qwen3.8-27B. Como el anuncio ocurrió el 3 de agosto, la referencia apunta a la semana que comienza el 10 de agosto, pero la compañía todavía no ha dado un día concreto.
El término open weights significa que los parámetros entrenados estarán disponibles para descarga y adaptación. Eso permite que laboratorios, empresas y desarrolladores con la infraestructura necesaria prueben el modelo fuera de los servidores de Alibaba.
La expresión no equivale automáticamente a software de código abierto. La licencia determinará si será posible modificarlo, redistribuirlo o utilizarlo comercialmente. Qwen aún no ha publicado esas condiciones ni los requisitos de hardware para ejecutar Qwen3.8-Max.
El modelo de 2.4 billones de parámetros seguirá requiriendo una infraestructura considerable, incluso con sus 95,000 millones de parámetros activos por consulta. Por escala nominal, Qwen3.8-27B podría resultar más accesible para equipos con recursos propios, pero todavía faltan detalles sobre su arquitectura, memoria necesaria y licencia.
La apertura también permitirá comprobar las afirmaciones de Alibaba con los mismos pesos y bajo evaluaciones reproducibles. Hasta ahora, Qwen3.8-Max ya tiene un resultado favorable en texto y una posición competitiva en visión, pero su ventaja depende del benchmark.
Qwen3.8-Max deja una señal concreta en la carrera de modelos: China ya no compite únicamente con sistemas más baratos o de menor tamaño. Alibaba está intentando colocar un modelo de frontera en los rankings públicos y, al mismo tiempo, prepara la primera apertura de pesos de su familia Max.