LG AI Research publica o K-EXAONE 2.0: 750 bilhões de parâmetros, para a LG o maior modelo MoE coreano
Em 31 de julho de 2026 a LG AI Research publicou no Hugging Face o K-EXAONE 2.0, apresentando‑o, segundo o anúncio oficial, como o maior modelo de base desenvolvido na Coreia do Sul (anúncio oficial da LG AI Research). O modelo soma 750 bilhões de parâmetros no total e usa uma arquitetura Mixture‑of‑Experts (MoE) com 256 especialistas ao todo, dos quais 8 são ativados a cada passagem, resultando em cerca de 37 bilhões de parâmetros ativos por token (model card oficial).
A model card indica 78 camadas no total: duas camadas densas iniciais, 76 camadas MoE esparsas e uma camada MTP final. A atenção alterna janelas deslizantes com blocos globais, o que permite uma janela de contexto declarada de 262.144 tokens (256 K) e um knowledge cutoff no segundo trimestre de 2025 (model card). O modelo suporta dez idiomas – coreano, inglês, espanhol, alemão, japonês, vietnamita, francês, italiano, português e polonês – conforme o anúncio e o relatório técnico. A licença é Apache 2.0, com uma cláusula adicional que proíbe usos maliciosos ou saídas contrárias aos princípios éticos da LG AI (model card).
A LG AI Research declara uma média de 70,1 em 24 benchmarks, contra 63,3 do modelo da primeira fase, de 236 bilhões de parâmetros, e uma melhoria de cerca de 30 % nos benchmarks de programação. Entre as pontuações informadas estão 83,5 no MMLU‑Pro, 92,3 no AIME 2026, 68,2 no SWE‑Bench Verified, 94,4 no OpenAI‑MRCR para contexto longo, 89,6 no Ko‑LongBench, uma média de 94,6 em KGC‑Safety e ROK‑Fortress, além de 14,2 no Tau3‑Bench Banking (declarações do fabricante). Por ora não há verificações independentes dessas métricas nem uma lista completa dos 24 benchmarks citados, de modo que os valores permanecem sem confirmação de terceiros.
O modelo faz parte da segunda fase do Sovereign AI Foundation Model Project, lançado pelo Ministério da Ciência e das TIC em 2025 para reduzir a dependência de modelos norte‑americanos e chineses. Com os pesos liberados sob licença Apache 2.0, o K-EXAONE 2.0 fica na mesma faixa dos grandes MoE chineses open‑weight, abrindo caminho para um ecossistema mais diverso de modelos de base.
Resta ver se a cláusula ética acrescentada à Apache 2.0 terá efeitos práticos sobre o uso comercial. A LG não divulgou nem o custo de treinamento nem a quantidade e a origem das GPUs utilizadas.
Come Olya ha verificato questa notizia
- Verificato
- Abri o anúncio oficial da LG AI Research e a model card oficial no Hugging Face: confirmam parâmetros totais e ativos, a arquitetura MoE com atenção híbrida, os 262.144 tokens de contexto, os dez idiomas e a licença Apache 2.0. O relatório técnico no arXiv (2608.04505, depositado em 5 de agosto de 2026 pela LG AI Research) confirma 750B totais, ~37B ativos, contexto de 256K e a passagem de seis para dez idiomas. The Korea Times e Korea JoongAng Daily confirmam de forma independente a data de 31 de julho, o posto de maior modelo coreano e o enquadramento no programa governamental. Os números dos benchmarks aparecem como declarações do fabricante, não como medições independentes.
- Incertezze
- Não há verificação independente dos benchmarks em rankings de terceiros. O relatório técnico cita nove benchmarks de avaliação, enquanto o comunicado fala de uma média sobre 24: os dois conjuntos não coincidem e a lista completa não pode ser reconstruída apenas com o comunicado. Não foram divulgados nem o custo de treinamento nem a quantidade e a origem das GPUs. Também está em aberto se a cláusula ética da model card, somada à licença Apache 2.0, terá efeitos práticos sobre o uso comercial.
- Perché pubblicarla
- É um lançamento de pesos abertos sob licença permissiva de um modelo de 750 bilhões de parâmetros: a faixa open‑weight de fronteira, até agora disputada quase só entre laboratórios norte‑americanos e chineses, ganha um terceiro ator estatal‑industrial. Interessa aos leitores italianos por dois motivos concretos: o italiano está entre os dez idiomas suportados e a licença Apache 2.0 torna o modelo utilizável em projetos comerciais sem negociar contratos. É o mesmo tema de soberania tecnológica que a Europa discute com as AI Gigafactories, visto por um país que já entregou o seu modelo.