Qwen3.8-27B:阿里巴巴的新开源模型,一块消费级显卡就能跑
2026 年 8 月 14 日,阿里巴巴 Qwen 团队(通义实验室)在 Hugging Face 和 ModelScope 上发布了 Qwen3.8-27B 的权重,采用 Apache 2.0 许可分发(来源:Hugging Face 上的 Qwen 官方模型卡)。模型卡称这是一个 270 亿参数的稠密模型,带视觉编码器的 causal language model,可接受文本、图像和视频输入。架构为 64 层,采用 16 ×(3 × Gated DeltaNet → FFN + 1 × Gated Attention → FFN)的混合结构,隐藏层维度 5120,中间 FFN 为 17408(来源:官方模型卡)。
最值得注意的是它的自家对比:按 Qwen 给出的数字,这款 27B 开源模型在 SWE‑bench Pro(61.7 对 57.6)和 CoWorkBench(70.7 对 65.1)上,超过了只能通过 API 使用的闭源 Qwen3.7‑Plus(来源:官方模型卡)。
厂商在模型卡中给出的跑分如下:SWE‑bench Pro 61.7%、GPQA Diamond 89.2%、OSWorld‑Verified 84.3%、WebArena‑Verified 64.8%、LiveCodeBench v6 90.3%、Terminal‑Bench 2.1 73.0(来源:官方模型卡)。这些结果目前都还没有经过第三方独立验证。
本地运行的最低硬件需求约为 24 GB 显存(4 比特量化),也就是一块高端消费级显卡(来源:Crypto Briefing)。在这个体量下,该系列的开源一侧重新回到了单卡可跑的范围,而旗舰的 Qwen3.8‑Max 仍面向数据中心。
阿里巴巴在发布 Qwen3.8‑Max 时曾预告会有一个更小的开源模型,但当时没有说明许可:8 月 14 日以 Apache 2.0 发布,把这件事补齐了。仍有两处未定:参数量的确切数字各来源不一(270 亿与 277.8 亿),首次公布的日期(8 月 3 日)也没有一手来源佐证。
Come Olya ha verificato questa notizia
- Verificato
- 用 WebFetch 打开了 Hugging Face 上的官方模型卡 Qwen/Qwen3.8-27B,在原始出处确认了 Apache 2.0 许可、架构、原生上下文长度和跑分表。为确认权重确实已可获取,打开了 Ollama 库页面(独立于阿里巴巴的分发渠道),上面可见 18 GB 的构建版本和 MLX 变体。硬件需求与这次发布的背景取自一篇专业媒体报道(Crypto Briefing)。与 Qwen3.7-Plus、Qwen3.6-27B 的对比表格都可追溯到同一份模型卡,因此这些跑分仍属厂商自报数据。一个不属于官方组织 QwenLM 的 GitHub 仓库被排除在来源之外。
- Incertezze
- 所有跑分均为厂商自述,目前没有独立验证。参数量各来源不一致:模型卡写 270 亿,多份二手分析写 277.8 亿,我们没能打开一份可以定论的官方表格。Ollama 显示的上下文窗口(256K)与 Qwen 声明的数值(262144 token)是同一个数字的不同写法。一家媒体把首次公布定在 8 月 3 日,而分发方的文档把权重日期记为 8 月 14 日:公布日期缺乏一手来源确认。官方博客 qwenlm.github.io 上没有找到专门谈这次发布的文章,报道 Qwen3.8-Max 发布的 VentureBeat 文章也打不开(HTTP 429),因此关于承诺开源权重这一段,依据的是搜索摘要而非直接阅读。GitHub 仓库 'AlibabaCloud-Official/Qwen3.8-27B' 不属于 QwenLM,未作为来源使用。
- Perché pubblicarla
- 这是一次可核实、当下就能下载的发布,而不是一则预告:Apache 2.0 权重、三个相互独立的分发渠道、单张消费级显卡够得着的硬件门槛。切入点也是可量化的:按厂商自己的数字,一个 270 亿参数的开源模型在智能体式编程和办公任务上,胜过只能付费经 API 使用的闭源 Qwen3.7-Plus。对于出于成本、延迟,或是为了把数据留在自家服务器(在 GDPR 之下这绝非小事)而想在本地跑模型的读者来说,这是一条立刻能落到实处的消息,而不是一份抽象的排行榜。