✨︎ Resumen (TL;DR):
- HUMAIN presentó humain-m3 el 3 de septiembre de 2026 en LEAP, en Riad; su comunicado atribuye el desarrollo a la china MiniMax.
- La empresa reporta un promedio de 89.37% en siete pruebas públicas de árabe, frente a 80.34% del M3 de referencia.
- HUMAIN apunta a liberar los pesos bajo la MiniMax Community License en octubre de 2026, después del entrenamiento de seguridad y alineación.
HUMAIN, la empresa de inteligencia artificial del fondo soberano saudí PIF, presentó humain-m3 el 3 de septiembre de 2026 en la conferencia LEAP, en Riad, como un modelo de lenguaje árabe de frontera. El modelo usa como base MiniMax-M3, un modelo chino de 428,000 millones de parámetros, y suma más de un billón de tokens nativos en árabe. HUMAIN reporta un promedio de 89.37% en siete pruebas públicas, nueve puntos por encima del M3 de referencia, aunque los resultados provienen de su propia evaluación. La empresa apunta a liberar los pesos bajo la MiniMax Community License en octubre de 2026, después del entrenamiento de seguridad y alineación.
humain-m3 es un modelo de lenguaje árabe que parte de MiniMax-M3 y recibe un posentrenamiento con más de un billón de tokens de contenido nativo en árabe. En la cifra usada por HUMAIN, un billón equivale a un millón de millones de tokens.
Mixture-of-experts es una arquitectura que activa 23,000 millones de parámetros por token dentro de un modelo con 428,000 millones. HUMAIN identifica esa estructura en la familia MiniMax-M3.
HUMAIN puso humain-m3 a disposición ese mismo día en un preview de investigación dentro de HUMAIN Node.

La ventaja árabe se mide contra el M3 de referencia
El 89.37% no cuenta toda la historia. En la tabla que HUMAIN publica en la portada de Node, el checkpoint M3 de referencia promedia 80.34%. La empresa atribuye al posentrenamiento en árabe la diferencia de nueve puntos.
El árabe lo hablan cientos de millones de personas. Tareq Amin, CEO de HUMAIN, dijo que el idioma “sigue significativamente subrepresentado en la frontera de la inteligencia artificial”.
HUMAIN ponderó por igual las siete pruebas públicas de árabe. Según su comparativo, humain-m3 promedia 89.37%, frente a 87.30% de GPT-5.6 SOL y 87.34% de Opus 5.
| Prueba | humain-m3 | GPT-5.6 SOL | Opus 5 | M3 de referencia |
|---|---|---|---|---|
| AlGhafa, comprensión básica | 86.45% | 81.54% | 83.06% | 75.31% |
| ArabicMMLU, conocimiento nativo | 90.70% | 88.82% | 88.77% | 81.80% |
| Arabic EXAMS, exámenes académicos | 67.67% | 66.40% | 64.80% | 61.27% |
| MadinahQA, dominio del idioma | 95.44% | 94.48% | 94.78% | 87.10% |
| AraTrust, veracidad y confianza | 97.53% | 93.42% | 91.38% | 90.60% |
| ALRAGE, generación con recuperación | 94.63% | 94.91% | 94.85% | 79.32% |
| MMLU traducido, conocimiento amplio | 93.20% | 91.48% | 93.78% | 87.00% |
| Promedio de las siete | 89.37% | 87.30% | 87.34% | 80.34% |
El modelo de HUMAIN gana cinco de las siete pruebas. Queda por debajo de GPT-5.6 SOL en ALRAGE, donde marca 94.63% frente a 94.91%, y de Opus 5 en MMLU traducido, con 93.20% frente a 93.78%.
Ningún tercero independiente hizo estas mediciones. HUMAIN presenta su propia evaluación del checkpoint disponible en preview.
MiniMax aparece en el origen y en la licencia
El encabezado del comunicado que HUMAIN distribuyó por PR Newswire presenta a humain-m3 como un modelo desarrollado por MiniMax. El documento coloca a HUMAIN como la empresa que lo encargó. La portada de Node pone el énfasis en HUMAIN: lo muestra como un modelo árabe de frontera publicado por la empresa y deja la base china en la tabla, con la etiqueta “M3 reference” junto al logotipo de MiniMax.
La licencia también apunta a Shanghái. HUMAIN espera liberar los pesos bajo la MiniMax Community License cuando termine el entrenamiento de seguridad y alineación. El objetivo actual es octubre de 2026.
Node ofrece dos niveles de preview. El limitado sirve el modelo con una capa de alineación saudí aplicada, sin razonamiento ni streaming y con algo más de latencia.
El preview de investigación entrega el checkpoint completo, con razonamiento, streaming y menor latencia. HUMAIN dice que este periodo le sirve para evaluar capacidades, seguridad y alineación en los dialectos árabes antes de la disponibilidad general.
Arabia Saudita mantiene alianzas en ambos frentes
El modelo insignia del reino sale de un laboratorio chino mientras Arabia Saudita profundiza sus vínculos de IA con China y busca alianzas tecnológicas mayores con Estados Unidos. Esa combinación coloca al Golfo en el centro de la competencia entre Washington y Pekín.
En LEAP 2026, HUMAIN anunció una expansión de su colaboración con Microsoft, una oferta empresarial de IA y una AI PC. En la misma semana, comunicó una alianza estratégica con Reflection AI, un laboratorio que construye modelos abiertos.
La empresa mantiene además su familia propia de modelos árabes, ALLAM, y dice que Node ya tiene más de 100 modelos adicionales de proveedores de todo el mundo.
El siguiente punto de control es octubre de 2026. Si HUMAIN libera los pesos bajo la licencia de MiniMax, cualquiera podrá medir cuánto aportó cada lado. Hasta entonces, la única evaluación de los nueve puntos y del promedio de 89.37% es la que publicó la propia empresa.
