TL;DR:
- HUMAIN, la empresa de IA del fondo soberano saudí PIF, presentó humain-m3 el 3 de septiembre de 2026 en LEAP, en Riad, y su propio comunicado dice que lo entregó la china MiniMax.
- Es un mixture-of-experts de 428,000 millones de parámetros con más de un billón de tokens en árabe encima; promedia 89.37% en siete pruebas públicas, según la evaluación de la propia HUMAIN.
- Los pesos saldrán bajo la licencia comunitaria de MiniMax, no bajo una saudí, y la empresa apunta a octubre de 2026 tras completar el entrenamiento de seguridad.
HUMAIN, la empresa de inteligencia artificial del fondo soberano saudí PIF, presentó humain-m3 el 3 de septiembre de 2026 en la conferencia LEAP, en Riad, y lo describió como un modelo de lenguaje árabe de frontera. Su propio comunicado lo dice desde el encabezado: HUMAIN encargó el modelo y la china MiniMax lo entregó. La base es la familia MiniMax-M3, un mixture-of-experts de 428,000 millones de parámetros que activa 23,000 millones por token, y sobre ella HUMAIN añadió más de un billón de tokens (un millón de millones) de contenido nativo en árabe. En siete pruebas públicas la empresa reporta 89.37% de promedio, por delante de GPT-5.6 SOL y de Opus 5, aunque esas cifras salen de su propia evaluación. El modelo quedó disponible ese mismo día en preview de investigación dentro de HUMAIN Node.
Los nueve puntos que HUMAIN le sumó al modelo base
La cifra que mide el trabajo saudí no es el 89.37%, sino la distancia con el modelo del que parte. En la tabla que la propia HUMAIN publica en la portada de Node, el checkpoint de referencia M3 promedia 80.34%. El posentrenamiento en árabe, dice la empresa, agrega nueve puntos.
El árabe lo hablan cientos de millones de personas y, según Tareq Amin, CEO de HUMAIN, "sigue significativamente subrepresentado en la frontera de la inteligencia artificial". Esa es la brecha que HUMAIN dice querer cerrar.
Así queda el comparativo que publicó HUMAIN, con las siete pruebas ponderadas por igual:
| Prueba | humain-m3 | GPT-5.6 SOL | Opus 5 | M3 de referencia |
|---|---|---|---|---|
| AlGhafa (comprensión básica) | 86.45% | 81.54% | 83.06% | 75.31% |
| ArabicMMLU (conocimiento nativo) | 90.70% | 88.82% | 88.77% | 81.80% |
| Arabic EXAMS (exámenes académicos) | 67.67% | 66.40% | 64.80% | 61.27% |
| MadinahQA (dominio del idioma) | 95.44% | 94.48% | 94.78% | 87.10% |
| AraTrust (veracidad y confianza) | 97.53% | 93.42% | 91.38% | 90.60% |
| ALRAGE (generación con recuperación) | 94.63% | 94.91% | 94.85% | 79.32% |
| MMLU traducido (conocimiento amplio) | 93.20% | 91.48% | 93.78% | 87.00% |
| Promedio de las siete | 89.37% | 87.30% | 87.34% | 80.34% |
humain-m3 gana cinco de las siete pruebas. Pierde en ALRAGE, la de generación aumentada por recuperación, donde GPT-5.6 SOL marca 94.91% contra 94.63%, y en el MMLU traducido, donde Opus 5 llega a 93.78% frente a 93.20%. Ninguna de esas mediciones viene de un tercero independiente: HUMAIN las presenta como su propia evaluación del checkpoint en preview.
El comunicado nombra a MiniMax; la portada del producto habla de un modelo de referencia
El encabezado del comunicado que HUMAIN distribuyó por PR Newswire es explícito y pone el crédito por delante: humain-m3 fue desarrollado por MiniMax. La portada de Node cuenta la misma historia con otro énfasis. Ahí el modelo aparece como el modelo árabe de frontera del mundo, publicado por HUMAIN, y la base china solo se identifica dentro de la tabla como "M3 reference", con el logotipo de MiniMax al costado. En el texto corrido, esa base es el modelo de referencia sobre el que se construye.
La licencia también apunta a Shanghái. HUMAIN espera liberar los pesos bajo la MiniMax Community License cuando termine el entrenamiento de seguridad y alineación, un paso que por ahora tiene como objetivo octubre de 2026.
Mientras tanto, el acceso viene en escalones. Un nivel de preview limitado sirve el modelo con una capa de alineación saudí aplicada, sin razonamiento ni streaming y con algo más de latencia. Un nivel de preview de investigación entrega el checkpoint completo, con razonamiento, streaming y menor latencia, y HUMAIN dice que ese periodo le sirve para evaluar capacidades, seguridad y alineación en los dialectos árabes antes de la disponibilidad general.
Riad compra en los dos tableros a la vez
Que el modelo insignia del reino salga de un laboratorio chino no es un accidente de proveedor. Como apuntó Al-Monitor, la operación confirma que Arabia Saudita profundiza sus vínculos de IA con China mientras persigue alianzas tecnológicas mayores con Estados Unidos, y deja al Golfo en el centro de la carrera entre Washington y Pekín.

La prueba de esa doble apuesta estaba en el mismo escenario. En LEAP 2026, HUMAIN también anunció una expansión de su colaboración con Microsoft, con una oferta empresarial de IA y una AI PC, y una alianza estratégica con Reflection AI, un laboratorio que construye modelos abiertos, según los comunicados que difundió esa misma semana. La empresa mantiene además su propia familia de modelos árabes, ALLAM, y dice tener ya en Node más de 100 modelos adicionales de proveedores de todo el mundo.
El calendario deja una prueba concreta. Si HUMAIN libera los pesos en octubre bajo la licencia de MiniMax, cualquiera podrá medir cuánto aportó cada lado. Hasta entonces, el único juez de esas cifras es la empresa que las publicó.