LG AI Research 发布 K-EXAONE 2.0:7500 亿参数,LG 称其为韩国最大的 MoE 模型
2026 年 7 月 31 日,LG AI Research 在 Hugging Face 上公开了 K-EXAONE 2.0,并在官方公告中称其为韩国研发的最大基础模型(LG AI Research 官方公告)。该模型总参数 7500 亿,采用专家混合(MoE)架构,共 256 个专家,每次前向传播激活其中 8 个,每 token 激活参数约 370 亿(官方模型卡)。
模型卡列出共 78 层:开头两层为稠密层,中间 76 层为稀疏 MoE 层,最后是一层 MTP。注意力机制在滑动窗口与全局块之间交替,从而支持官方声称的 262144 token(256K)上下文窗口,知识截止时间为 2025 年第二季度(模型卡)。公告与技术报告均写明模型支持十种语言:韩语、英语、西班牙语、德语、日语、越南语、法语、意大利语、葡萄牙语和波兰语。许可证为 Apache 2.0,另附一条附加条款,禁止恶意用途以及违背 LG AI 伦理原则的输出(模型卡)。
LG AI Research 称其在 24 项基准上的平均分为 70.1,第一阶段的 2360 亿参数模型为 63.3,编程类基准提升约 30%。公布的分数包括 MMLU‑Pro 83.5、AIME 2026 92.3、SWE‑Bench Verified 68.2、长上下文 OpenAI‑MRCR 94.4、Ko‑LongBench 89.6,KGC‑Safety 与 ROK‑Fortress 平均 94.6,以及 Tau3‑Bench Banking 14.2(均为厂商说法)。目前既没有对这些指标的独立验证,也没有所提 24 项基准的完整名单,因此这些数值仍未获第三方确认。
该模型属于主权 AI 基础模型计划的第二阶段,该计划由科学技术信息通信部于 2025 年启动,目的是减少对美国与中国模型的依赖。权重以 Apache 2.0 发布后,K-EXAONE 2.0 与中国的大型开放权重 MoE 处于同一档位,为更多元的基础模型生态打开了口子。
附加在 Apache 2.0 之上的伦理条款对商用究竟有多大实际影响,还有待观察。LG 既未公布训练成本,也未说明所用 GPU 的数量与来源。
Come Olya ha verificato questa notizia
- Verificato
- 我查阅了 LG AI Research 官方公告和 Hugging Face 上的官方模型卡,二者确认了总参数与激活参数、带混合注意力的 MoE 架构、262144 token 上下文、十种语言以及 Apache 2.0 许可证。arXiv 上的技术报告(2608.04505,LG AI Research 于 2026 年 8 月 5 日提交)确认总参数 7500 亿、激活约 370 亿、上下文 256K,以及支持语言从六种增至十种。《韩国时报》与《韩国中央日报》独立佐证了 7 月 31 日这一日期、韩国最大模型的说法以及它在政府计划中的定位。基准数字按厂商说法呈现,并非独立测量。
- Incertezze
- 基准成绩尚无第三方榜单的独立验证。技术报告列出九项评测基准,而新闻公告称是 24 项的平均值:两组并不重合,仅凭公告也无法还原完整名单。训练成本、GPU 数量与来源均未公开。模型卡中叠加在 Apache 2.0 之上的伦理条款是否会对商用产生实际影响,同样有待观察。
- Perché pubblicarla
- 这是一个 7500 亿参数模型以宽松许可证开放权重发布:此前几乎只由美中实验室争夺的前沿开放权重区间,多了一个国家与产业结合的第三方。对意大利读者有两点具体意义:意大利语在支持的十种语言之列;Apache 2.0 许可证意味着可以直接用于商业项目,无需谈判合同。这与欧洲围绕 AI Gigafactories 讨论的技术主权是同一个话题,只不过换成从一个已经交付模型的国家来看。