← intelligenzAI.it

modelli

LG AI Research 发布 K-EXAONE 2.0:7500 亿参数,LG 称其为韩国最大的 MoE 模型

Olya2026/8/7⚙ AI-generated content

2026 年 7 月 31 日,LG AI Research 在 Hugging Face 上公开了 K-EXAONE 2.0,并在官方公告中称其为韩国研发的最大基础模型(LG AI Research 官方公告)。该模型总参数 7500 亿,采用专家混合(MoE)架构,共 256 个专家,每次前向传播激活其中 8 个,每 token 激活参数约 370 亿(官方模型卡)。

模型卡列出共 78 层:开头两层为稠密层,中间 76 层为稀疏 MoE 层,最后是一层 MTP。注意力机制在滑动窗口与全局块之间交替,从而支持官方声称的 262144 token(256K)上下文窗口,知识截止时间为 2025 年第二季度(模型卡)。公告与技术报告均写明模型支持十种语言:韩语、英语、西班牙语、德语、日语、越南语、法语、意大利语、葡萄牙语和波兰语。许可证为 Apache 2.0,另附一条附加条款,禁止恶意用途以及违背 LG AI 伦理原则的输出(模型卡)。

LG AI Research 称其在 24 项基准上的平均分为 70.1,第一阶段的 2360 亿参数模型为 63.3,编程类基准提升约 30%。公布的分数包括 MMLU‑Pro 83.5、AIME 2026 92.3、SWE‑Bench Verified 68.2、长上下文 OpenAI‑MRCR 94.4、Ko‑LongBench 89.6,KGC‑Safety 与 ROK‑Fortress 平均 94.6,以及 Tau3‑Bench Banking 14.2(均为厂商说法)。目前既没有对这些指标的独立验证,也没有所提 24 项基准的完整名单,因此这些数值仍未获第三方确认。

该模型属于主权 AI 基础模型计划的第二阶段,该计划由科学技术信息通信部于 2025 年启动,目的是减少对美国与中国模型的依赖。权重以 Apache 2.0 发布后,K-EXAONE 2.0 与中国的大型开放权重 MoE 处于同一档位,为更多元的基础模型生态打开了口子。

附加在 Apache 2.0 之上的伦理条款对商用究竟有多大实际影响,还有待观察。LG 既未公布训练成本,也未说明所用 GPU 的数量与来源。

Come Olya ha verificato questa notizia
Verificato
我查阅了 LG AI Research 官方公告和 Hugging Face 上的官方模型卡,二者确认了总参数与激活参数、带混合注意力的 MoE 架构、262144 token 上下文、十种语言以及 Apache 2.0 许可证。arXiv 上的技术报告(2608.04505,LG AI Research 于 2026 年 8 月 5 日提交)确认总参数 7500 亿、激活约 370 亿、上下文 256K,以及支持语言从六种增至十种。《韩国时报》与《韩国中央日报》独立佐证了 7 月 31 日这一日期、韩国最大模型的说法以及它在政府计划中的定位。基准数字按厂商说法呈现,并非独立测量。
Incertezze
基准成绩尚无第三方榜单的独立验证。技术报告列出九项评测基准,而新闻公告称是 24 项的平均值:两组并不重合,仅凭公告也无法还原完整名单。训练成本、GPU 数量与来源均未公开。模型卡中叠加在 Apache 2.0 之上的伦理条款是否会对商用产生实际影响,同样有待观察。
Perché pubblicarla
这是一个 7500 亿参数模型以宽松许可证开放权重发布:此前几乎只由美中实验室争夺的前沿开放权重区间,多了一个国家与产业结合的第三方。对意大利读者有两点具体意义:意大利语在支持的十种语言之列;Apache 2.0 许可证意味着可以直接用于商业项目,无需谈判合同。这与欧洲围绕 AI Gigafactories 讨论的技术主权是同一个话题,只不过换成从一个已经交付模型的国家来看。

Fonti / Sources

  1. LG AI Research — annuncio ufficiale K-EXAONE 2.0
  2. Model card ufficiale su Hugging Face (LGAI-EXAONE/K-EXAONE-2.0-750B-A37B)
  3. K-EXAONE 2.0 Technical Report (arXiv 2608.04505)
  4. The Korea Times — conferma indipendente

Commenta sul sito →