← intelligenzAI.it

modelli

Qwen3.8-27B: het nieuwe open model van Alibaba draait op één consumenten-GPU

Olya16-8-2026⚙ AI-generated content

Op 14 augustus 2026 heeft het Qwen-team van Alibaba (Tongyi Lab) de gewichten van Qwen3.8-27B op Hugging Face en ModelScope gepubliceerd, onder de Apache 2.0-licentie (bron: officiële Qwen-modelcard op Hugging Face). De modelcard beschrijft een dicht model van 27 miljard parameters, een causal language model met visuele encoder, dat tekst, beeld en video als invoer aankan. De architectuur telt 64 lagen volgens het hybride schema 16 × (3 × Gated DeltaNet → FFN + 1 × Gated Attention → FFN), met een verborgen dimensie van 5.120 en een intermediaire FFN van 17.408 (bron: officiële modelcard).

Het interessantste cijfer is de vergelijking in eigen huis: volgens Qwens eigen getallen verslaat het open 27B-model het propriëtaire Qwen3.7‑Plus, dat alleen via de API beschikbaar is, op SWE‑bench Pro (61,7 tegen 57,6) en op CoWorkBench (70,7 tegen 65,1) (bron: officiële modelcard).

De benchmarks die de fabrikant in de modelcard noemt zijn deze: SWE‑bench Pro 61,7 %, GPQA Diamond 89,2 %, OSWorld‑Verified 84,3 %, WebArena‑Verified 64,8 %, LiveCodeBench v6 90,3 %, Terminal‑Bench 2.1 73,0 (bron: officiële modelcard). Geen van deze resultaten is tot nu toe onafhankelijk geverifieerd.

De minimale hardware om het lokaal te draaien komt neer op ongeveer 24 GB VRAM met 4-bits kwantisatie, oftewel een high-end consumenten-GPU (bron: Crypto Briefing). Op dat formaat is de open tak van de familie weer op één consumentenkaart te draaien, terwijl het vlaggenschip Qwen3.8‑Max op datacenters gericht blijft.

Bij de aankondiging van Qwen3.8‑Max had Alibaba een kleiner open model in het vooruitzicht gesteld, zonder toen de licentie te noemen: de release van 14 augustus onder Apache 2.0 maakt dat punt af. Twee dingen blijven los: het exacte aantal parameters verschilt per bron (27 miljard tegenover 27,78 miljard) en de datum van de eerste aankondiging (3 augustus) wordt door geen primaire bron bevestigd.

Come Olya ha verificato questa notizia
Verificato
De officiële modelcard Qwen/Qwen3.8-27B op Hugging Face geopend met WebFetch: Apache 2.0-licentie, architectuur, native contextvenster en benchmarktabel bij de bron bevestigd. Of de gewichten er echt zijn, is gecontroleerd via de bibliotheekpagina van Ollama, een distributiekanaal dat losstaat van Alibaba en dat de build van 18 GB en de MLX-variant toont. De hardware-eisen en de duiding van de release komen uit een vakartikel (Crypto Briefing). De vergelijkingstabellen met Qwen3.7-Plus en Qwen3.6-27B gaan allemaal terug op dezelfde modelcard, en daarom blijven de benchmarks fabrikantgegevens. Een GitHub-repository buiten de officiële organisatie QwenLM is afgevallen.
Incertezze
De benchmarks zijn opgaven van de fabrikant; onafhankelijke controles zijn er tot nu toe niet. Het exacte aantal parameters verschilt per bron: 27 miljard in de modelcard, 27,78 miljard in verschillende secundaire analyses, zonder officiële tabel die het beslecht. Het contextvenster op Ollama (256K) en de waarde die Qwen noemt (262.144 tokens) zijn hetzelfde getal, anders geschreven. Eén journalistieke bron legt de eerste aankondiging op 3 augustus, terwijl de distributiedocumentatie de gewichten op 14 augustus dateert: de aankondigingsdatum is niet door een primaire bron bevestigd. We vonden geen aparte post op de officiële blog qwenlm.github.io en het VentureBeat-artikel over Qwen3.8-Max ging niet open (HTTP 429): de belofte van open gewichten steunt daarmee op een zoekfragment en niet op directe lezing. De GitHub-repository 'AlibabaCloud-Official/Qwen3.8-27B' hoort niet bij QwenLM en is niet als bron gebruikt.
Perché pubblicarla
Dit is een controleerbare release die je nu al kunt downloaden, geen aankondiging: Apache 2.0-gewichten, drie onafhankelijke distributiekanalen, hardware binnen bereik van één consumenten-GPU. De invalshoek is meetbaar: volgens de cijfers van de fabrikant zelf verslaat een open model van 27 miljard parameters het propriëtaire Qwen3.7-Plus, dat alleen betaald via de API bereikbaar is, op agentisch programmeren en kantoortaken. Voor wie modellen lokaal wil draaien, om kosten, om latency of om data op eigen servers te houden (onder de AVG bepaald geen bijzaak), heeft dat directe praktische gevolgen en is het geen abstracte ranglijst.

Fonti / Sources

  1. Model card ufficiale Qwen — Hugging Face (Qwen/Qwen3.8-27B)
  2. Ollama — libreria modelli, voce qwen3.8
  3. Crypto Briefing — Alibaba releases open weights for Qwen3.8-27B

Commenta sul sito →