LG AI Research veröffentlicht K-EXAONE 2.0: 750 Milliarden Parameter, laut LG das größte koreanische MoE-Modell
Am 31. Juli 2026 hat LG AI Research K-EXAONE 2.0 auf Hugging Face veröffentlicht und es laut offizieller Ankündigung als das größte in Südkorea entwickelte Basismodell vorgestellt (offizielle Ankündigung von LG AI Research). Das Modell zählt 750 Milliarden Parameter insgesamt und nutzt eine Mixture‑of‑Experts‑Architektur (MoE) mit 256 Experten, von denen bei jedem Durchlauf 8 aktiviert werden – zusammen rund 37 Milliarden aktive Parameter pro Token (offizielle Model Card).
Die Model Card nennt insgesamt 78 Layer: zwei dichte Eingangs‑Layer, 76 spärliche MoE‑Layer und ein abschließendes MTP‑Layer. Die Attention wechselt zwischen gleitenden Fenstern und globalen Blöcken und erlaubt damit ein angegebenes Kontextfenster von 262.144 Token (256 K) sowie einen Knowledge Cutoff im zweiten Quartal 2025 (Model Card). Unterstützt werden zehn Sprachen – Koreanisch, Englisch, Spanisch, Deutsch, Japanisch, Vietnamesisch, Französisch, Italienisch, Portugiesisch und Polnisch –, wie Ankündigung und Technical Report angeben. Die Lizenz ist Apache 2.0, ergänzt um eine Klausel, die bösartige Nutzungen oder Ausgaben verbietet, die den ethischen Grundsätzen von LG AI widersprechen (Model Card).
LG AI Research gibt einen Durchschnitt von 70,1 über 24 Benchmarks an, gegenüber 63,3 beim Modell der ersten Phase mit 236 Milliarden Parametern, sowie eine Verbesserung von rund 30 % bei Programmier‑Benchmarks. Zu den genannten Werten gehören 83,5 bei MMLU‑Pro, 92,3 bei AIME 2026, 68,2 bei SWE‑Bench Verified, 94,4 bei OpenAI‑MRCR für langen Kontext, 89,6 bei Ko‑LongBench, ein Durchschnitt von 94,6 bei KGC‑Safety und ROK‑Fortress sowie 14,2 bei Tau3‑Bench Banking (Herstellerangaben). Bislang gibt es weder unabhängige Prüfungen dieser Kennzahlen noch eine vollständige Liste der 24 genannten Benchmarks; die Werte bleiben also von dritter Seite unbestätigt.
Das Modell ist Teil der zweiten Phase des Sovereign AI Foundation Model Project, das das Ministerium für Wissenschaft und IKT 2025 gestartet hat, um die Abhängigkeit von US‑amerikanischen und chinesischen Modellen zu verringern. Mit unter Apache 2.0 freigegebenen Gewichten reiht sich K-EXAONE 2.0 in dieselbe Liga wie die großen chinesischen Open‑Weight‑MoEs ein und öffnet die Tür zu einem vielfältigeren Ökosystem von Basismodellen.
Offen bleibt, ob die zusätzliche Ethikklausel zur Apache‑2.0‑Lizenz praktische Folgen für die kommerzielle Nutzung hat. LG hat weder die Trainingskosten noch Anzahl und Herkunft der eingesetzten GPUs bekannt gegeben.
Come Olya ha verificato questa notizia
- Verificato
- Ich habe die offizielle Ankündigung von LG AI Research und die offizielle Model Card auf Hugging Face geöffnet: Sie bestätigen Gesamt‑ und aktive Parameter, die MoE‑Architektur mit hybrider Attention, 262.144 Token Kontext, die zehn Sprachen und die Apache‑2.0‑Lizenz. Der Technical Report auf arXiv (2608.04505, am 5. August 2026 von LG AI Research eingereicht) bestätigt 750B gesamt, ~37B aktiv, 256K Kontext und den Sprung von sechs auf zehn Sprachen. The Korea Times und Korea JoongAng Daily bestätigen unabhängig voneinander das Datum 31. Juli, den Anspruch auf das größte koreanische Modell und die Einordnung ins Regierungsprogramm. Die Benchmark‑Zahlen sind Herstellerangaben, keine unabhängigen Messungen.
- Incertezze
- Keine unabhängige Prüfung der Benchmarks auf externen Leaderboards. Der Technical Report nennt neun Evaluations‑Benchmarks, die Pressemitteilung spricht von einem Durchschnitt über 24: Die beiden Mengen decken sich nicht, und die vollständige Liste lässt sich aus der Mitteilung allein nicht rekonstruieren. Trainingskosten sowie Anzahl und Herkunft der GPUs bleiben unbekannt. Ob die Ethikklausel in der Model Card, die zur Apache‑2.0‑Lizenz hinzukommt, praktische Folgen für die kommerzielle Nutzung hat, ist offen.
- Perché pubblicarla
- Ein Modell mit 750 Milliarden Parametern, als Open Weights unter einer permissiven Lizenz freigegeben: Die vorderste Open‑Weight‑Liga, bisher fast nur zwischen US‑amerikanischen und chinesischen Laboren umkämpft, bekommt einen dritten, staatlich‑industriellen Akteur. Für italienische Leserinnen und Leser zählen zwei konkrete Punkte: Italienisch gehört zu den zehn unterstützten Sprachen, und die Apache‑2.0‑Lizenz erlaubt den Einsatz in kommerziellen Projekten ohne Vertragsverhandlungen. Es geht um dieselbe technologische Souveränität, die Europa rund um die AI Gigafactories diskutiert – hier gesehen aus einem Land, das sein Modell bereits geliefert hat.