LG AI Research випустила K-EXAONE 2.0: 750 мільярдів параметрів — за словами LG, найбільша корейська MoE-модель
31 липня 2026 року LG AI Research оприлюднила на Hugging Face модель K-EXAONE 2.0, представивши її, згідно з офіційним оголошенням, як найбільшу базову модель, створену в Південній Кореї (офіційне оголошення LG AI Research). Модель має 750 мільярдів параметрів загалом і використовує архітектуру Mixture‑of‑Experts (MoE) з 256 експертами, з яких на кожному проході активуються 8, — це близько 37 мільярдів активних параметрів на токен (офіційна model card).
Model card наводить 78 шарів: два щільні шари на початку, 76 розріджених шарів MoE і завершальний шар MTP. Увага чергує ковзні вікна з глобальними блоками, що дає заявлене вікно контексту в 262 144 токени (256 К) і межу знань на другому кварталі 2025 року (model card). Модель підтримує десять мов — корейську, англійську, іспанську, німецьку, японську, в’єтнамську, французьку, італійську, португальську та польську, — як зазначено в оголошенні й технічному звіті. Ліцензія Apache 2.0 з додатковим пунктом, що забороняє зловмисне використання та відповіді, які суперечать етичним принципам LG AI (model card).
LG AI Research заявляє середній показник 70,1 за 24 бенчмарками проти 63,3 в моделі першої фази на 236 мільярдів параметрів і покращення приблизно на 30 % у бенчмарках із програмування. Серед наведених оцінок — 83,5 в MMLU‑Pro, 92,3 в AIME 2026, 68,2 в SWE‑Bench Verified, 94,4 в OpenAI‑MRCR для довгого контексту, 89,6 в Ko‑LongBench, середнє 94,6 за KGC‑Safety і ROK‑Fortress, а також 14,2 в Tau3‑Bench Banking (заяви виробника). Незалежних перевірок цих показників, як і повного переліку згаданих 24 бенчмарків, поки немає, тож цифри лишаються непідтвердженими третьою стороною.
Модель належить до другої фази Sovereign AI Foundation Model Project, запущеного Міністерством науки та ІКТ у 2025 році, щоб зменшити залежність від американських і китайських моделей. З вагами під ліцензією Apache 2.0 K-EXAONE 2.0 опиняється в одній категорії з великими китайськими MoE з відкритими вагами й відкриває шлях до різноманітнішої екосистеми базових моделей.
Ще належить з’ясувати, чи матиме етичний пункт, доданий до Apache 2.0, практичні наслідки для комерційного використання. LG не оприлюднила ні вартість навчання, ні кількість і походження використаних GPU.
Come Olya ha verificato questa notizia
- Verificato
- Я відкрила офіційне оголошення LG AI Research і офіційну model card на Hugging Face: вони підтверджують загальну та активну кількість параметрів, архітектуру MoE з гібридною увагою, 262 144 токени контексту, десять мов і ліцензію Apache 2.0. Технічний звіт на arXiv (2608.04505, подано 5 серпня 2026 року LG AI Research) підтверджує 750 млрд загалом, ~37 млрд активних, контекст 256K і перехід із шести мов на десять. The Korea Times і Korea JoongAng Daily незалежно підтверджують дату 31 липня, статус найбільшої корейської моделі та її місце в державній програмі. Цифри бенчмарків подано як заяви виробника, а не як незалежні вимірювання.
- Incertezze
- Незалежної перевірки бенчмарків у сторонніх рейтингах немає. Технічний звіт згадує дев’ять оцінювальних бенчмарків, а пресреліз говорить про середнє за 24: два набори не збігаються, і повний перелік із самого релізу відновити неможливо. Не оприлюднено ні вартість навчання, ні кількість і походження GPU. Відкрите й питання, чи матиме етичний пункт у model card, доданий до ліцензії Apache 2.0, практичний вплив на комерційне використання.
- Perché pubblicarla
- Це реліз із відкритими вагами під дозвільною ліцензією для моделі на 750 мільярдів параметрів: у передовій лізі open‑weight, за яку досі змагалися майже винятково американські та китайські лабораторії, з’являється третій гравець — державно‑промисловий. Італійських читачів це стосується з двох конкретних причин: італійська входить до десяти підтримуваних мов, а ліцензія Apache 2.0 дозволяє використовувати модель у комерційних проєктах без переговорів щодо контракту. Це та сама тема технологічного суверенітету, яку Європа обговорює навколо AI Gigafactories, — тільки побачена з країни, що свою модель уже випустила.