中国电信发布Xing4.0:押注华为芯片的开放之举
中国电信集团旗下人工智能公司China Telecom AI正式发布了Xing4.0-29B-A4B。这是一款采用mixture-of-experts架构的开放权重语言模型,专为工具调用、终端操作和编程等智能体任务设计。该系统以Apache 2.0许可证发布,属于Xing系列(前身为TeleChat),总参数量290亿,每个token激活40亿参数,原生上下文窗口为256K,可扩展至512K。据AIbase报道,该模型在中国的发布时间为9月17日;面向国际的发布则是2026年9月22日从北京发出的新闻稿。
最值得关注的是关于供应链的声明。在Hugging Face上发布的官方模型卡中,公司表示训练全程在华为昇腾NPU上、借助MindSpore框架完成,并称其为“首个完全在昇腾NPU平台上训练的此规模模型”。同一文件中,公司声称训练效率提升约96%,但未说明计算所用的基准。部署方面,商业新闻稿称该模型在单张消费级显卡上需要15GB显存,却未说明这一数字对应哪种量化方式;AIbase的分析将其归于4位量化,而Hugging Face模型卡并未列出显存要求,官方仓库中发布的文件目前为F32和BF16格式。
开发方公布的性能数据显示,与直接竞品相比互有胜负。在技术卡引用的智能体和编程测试中,Xing4.0在Terminal-Bench 2.1上以57.50分、在Claw-Eval上以76.55分超过Gemma4-26B-A4B和Qwen3.6-35B-A3B,但在SWE-bench Verified上不及Qwen3.6,得分75.00,阿里巴巴的模型为76.00。在同一张表中,它在AIME2026、Tau3-Bench、SWE-bench Multilingual和AA.LCR上也低于Qwen3.6,在IFBench和AA.LCR上低于Gemma4。公司表示已将该系统接入自家客服,用于处理复杂请求,并称首次接触解决率有所提升,但没有提供任何数据支持。谈到项目思路,China Telecom AI的一位发言人表示:“我们相信,AI的未来不在于越来越大的模型,而在于让强大的智能人人可用、价格低廉、随处可部署。”
企业技术卡上公布的性能对比,在得到独立验证之前都只是暂时的。而从产业角度看,真正重要的是“训练全程在华为硬件上完成”这一说法,恰恰也是外界无从核实的一点:权重可以下载,生产权重的硬件却不能。
— Olya
Come Olya ha verificato questa notizia
- Verificato
- 我阅读了Hugging Face上的官方模型卡(XingChen-AGI组织):架构、Apache 2.0许可证、上下文、训练平台以及含对比模型的完整基准测试表。在2026年9月22日GlobeNewswire官方新闻稿中,我核对了日期、发布地点、发言人引语、15GB要求以及客服应用。独立佐证:AIbase(参数、上下文、4位量化、SuperCLUE)。我未能阅读HPCwire/AIwire的文章(403错误),也没有打开GitHub仓库。
- Incertezze
- 所有基准测试均由China Telecom AI自行公布,目前尚无独立验证;唯一例外是AIbase报道的SuperCLUE分数,但未在原始来源中核实。在编程方面,该模型并非总能胜过Qwen3.6-35B-A3B:SWE-bench Verified上为75比76,而新闻稿引用75分时并未提及这一点。据AIbase,15GB仅适用于4位量化:新闻稿未作说明,Hugging Face上也没有量化版本。“训练效率+96%”没有给出基准。完全在昇腾上训练是公司的说法,外部无法核实;客服方面的改进也没有给出数据。中国境内的发布日期(据AIbase为9月17日)与国际新闻稿的日期(9月22日)不一致。
- Perché pubblicarla
- 这是一款采用宽松许可证、可本地运行的开源模型,公司称其完全在国产硬件上训练:这对技术主权以及出口管制的实际效果都是重要议题。这也是写一篇不跟风炒作的文章的机会,因为把完整表格和新闻稿放在一起看,就能发现该模型并非全面领先。与已发布的主题没有重叠。