LG AI Research publica K-EXAONE 2.0: 750.000 millones de parámetros, para LG el mayor modelo MoE coreano
El 31 de julio de 2026 LG AI Research publicó en Hugging Face K-EXAONE 2.0 y lo presentó, según el anuncio oficial, como el mayor modelo base desarrollado en Corea del Sur (anuncio oficial de LG AI Research). El modelo suma 750.000 millones de parámetros totales y usa una arquitectura Mixture‑of‑Experts (MoE) con 256 expertos en total, de los cuales se activan 8 en cada pasada, lo que da unos 37.000 millones de parámetros activos por token (model card oficial).
La model card detalla 78 capas en total: dos capas densas iniciales, 76 capas MoE dispersas y una capa MTP final. La atención alterna ventanas deslizantes con bloques globales, lo que permite una ventana de contexto declarada de 262.144 tokens (256 K) y un knowledge cutoff en el segundo trimestre de 2025 (model card). El modelo admite diez idiomas – coreano, inglés, español, alemán, japonés, vietnamita, francés, italiano, portugués y polaco –, según el anuncio y el informe técnico. La licencia es Apache 2.0, con una cláusula añadida que prohíbe usos maliciosos o resultados contrarios a los principios éticos de LG AI (model card).
LG AI Research declara una media de 70,1 en 24 pruebas, frente al 63,3 del modelo de la primera fase, de 236.000 millones de parámetros, y una mejora de en torno al 30 % en las pruebas de programación. Entre las puntuaciones citadas figuran 83,5 en MMLU‑Pro, 92,3 en AIME 2026, 68,2 en SWE‑Bench Verified, 94,4 en OpenAI‑MRCR para contexto largo, 89,6 en Ko‑LongBench, una media de 94,6 en KGC‑Safety y ROK‑Fortress, y 14,2 en Tau3‑Bench Banking (declaraciones del fabricante). De momento no hay comprobaciones independientes de estas métricas ni una lista completa de las 24 pruebas mencionadas, así que las cifras siguen sin confirmación de terceros.
El modelo forma parte de la segunda fase del Sovereign AI Foundation Model Project, puesto en marcha por el Ministerio de Ciencia y TIC en 2025 para reducir la dependencia de modelos estadounidenses y chinos. Con los pesos publicados bajo licencia Apache 2.0, K-EXAONE 2.0 se sitúa en la misma franja que los grandes MoE chinos open‑weight y abre la puerta a un ecosistema más diverso de modelos base.
Queda por ver si la cláusula ética añadida a la Apache 2.0 tiene efectos prácticos sobre el uso comercial. LG no ha hecho públicos ni el coste de entrenamiento ni la cantidad y procedencia de las GPU utilizadas.
Come Olya ha verificato questa notizia
- Verificato
- Abrí el anuncio oficial de LG AI Research y la model card oficial en Hugging Face: confirman parámetros totales y activos, la arquitectura MoE con atención híbrida, los 262.144 tokens de contexto, los diez idiomas y la licencia Apache 2.0. El informe técnico en arXiv (2608.04505, depositado el 5 de agosto de 2026 por LG AI Research) confirma 750B totales, ~37B activos, contexto de 256K y el paso de seis a diez idiomas. The Korea Times y Korea JoongAng Daily confirman de forma independiente la fecha del 31 de julio, el récord de mayor modelo coreano y su encaje en el programa gubernamental. Las cifras de las pruebas se recogen como declaraciones del fabricante, no como mediciones independientes.
- Incertezze
- No hay verificación independiente de las pruebas en tablas de clasificación de terceros. El informe técnico cita nueve pruebas de evaluación, mientras que el comunicado habla de una media sobre 24: los dos conjuntos no coinciden y la lista completa no puede reconstruirse solo con la nota de prensa. No se han hecho públicos ni el coste de entrenamiento ni la cantidad y procedencia de las GPU. Queda por ver si la cláusula ética de la model card, que se suma a la licencia Apache 2.0, tiene efectos prácticos sobre el uso comercial.
- Perché pubblicarla
- Es una publicación de pesos abiertos bajo licencia permisiva de un modelo de 750.000 millones de parámetros: la franja open‑weight de frontera, hasta ahora disputada casi solo entre laboratorios estadounidenses y chinos, gana un tercer actor estatal‑industrial. Interesa a los lectores italianos por dos motivos concretos: el italiano está entre los diez idiomas admitidos y la licencia Apache 2.0 permite usar el modelo en proyectos comerciales sin negociar contratos. Es el mismo debate de soberanía tecnológica que Europa mantiene con las AI Gigafactories, visto desde un país que ya ha entregado su modelo.