Hugging Face, zomer 2026: Qwen leidt bij de downloads. Maar de tellers meten niet alles
Hugging Face publiceerde op 14 augustus „State of Open Models: Summer 2026 Observations”, onder meer ondertekend door Adina Yakefu, Apolinário en Irene Solaiman en gebaseerd op de activiteit die in de eerste zeven maanden van 2026 op de Hub is geregistreerd. In die periode groeiden de openbare modelrepository’s van 2,43 naar 2,96 miljoen, de datasets van 711.000 naar 1 miljoen (voor het eerst boven die grens) en de Spaces van 1,00 naar 1,44 miljoen. De Hub is al jaren het openbare platform bij uitstek voor de verspreiding van modellen met open gewichten, en de downloadtellers zijn de meest geciteerde maatstaf geworden om te zeggen „wie er aan het winnen is”.
Volgens het rapport verzamelt de Qwen-familie van Alibaba 151.448 door de gemeenschap gebouwde afgeleide modellen: 2,6 keer de totale voetafdruk van de Meta-modellen en 4,7 keer de specifiek van Llama afgeleide modellen. De groei was constant — ongeveer 180 tot 210 nieuwe van Qwen afgeleide repository’s per dag in de periode — en niet alleen op lanceerdagen. Voor de op de Hub gemeten downloads van 2026 schrijft Hugging Face Qwen zo’n 2,045 miljard downloads toe (2,061 miljard als je alle repository’s meetelt), tegenover ongeveer 418 miljoen voor de modellen van Google en ongeveer 227 miljoen voor die van Meta. „Qwen has become part of the default workflow for developers deciding what models to fine-tune and deploy” — Hugging Face, officieel rapport („Qwen hoort inmiddels bij de standaardwerkwijze van wie beslist welke modellen worden bijgesteld en uitgerold”).
The Next Web (16 augustus, van de hand van Ana Maria Constantin) merkt op dat de 3 miljard downloads die Alibaba verspreidt zo’n 47% hoger liggen dan het cijfer dat Hugging Face in 2026 op de Hub heeft gemeten. The Next Web voegt eraan toe dat „The 3 billion figure came from Alibaba's own emailed statement” („de 3 miljard komt uit een per e-mail verstuurde verklaring van Alibaba”) en dat de geclaimde „ruim 300.000” afgeleide modellen boven de 151.448 op de Hub getelde uitkomen. The Next Web schrijft het verschil toe aan de reikwijdte: de gegevens van Hugging Face beslaan alleen de Hub en bevatten geen gebruik via API, geen private deployments en geen andere kanalen, waaronder ModelScope van Alibaba zelf. Alibaba heeft de methodologie achter de eigen 3 miljard en de „ruim 300.000” niet gepubliceerd, en Hugging Face heeft zich publiekelijk niet over het gat uitgelaten; de tellers van de Hub maken geen onderscheid tussen productiegebruik, tests en geautomatiseerd verkeer, en het rapport signaleert een aanzienlijk aandeel verkeer van niet-geregistreerde agents.
Behalve de ranglijst brengt het rapport ook de structuur van het gebruik scherp in beeld: 85,6% van de modellen heeft in totaal minder dan 200 downloads (sommige samenvattingen van derden melden „ongeveer de helft”: het officiële document blijft de maatstaf), terwijl 1,5% van de repository’s goed is voor 99,2% van alle downloads; modellen onder de 1 miljard parameters halen 83% van de historische downloads binnen, die boven de 100 miljard blijven op 1% steken. Vergelijk je de top 25 op downloads met de top 25 op „likes”, dan komt maar één repository in allebei voor: aandacht en gebruik meten verschillende dingen. Qua omvang hebben Chinese labs modellen met open gewichten uitgebracht tot 2,78 biljoen parameters; in vijf van de zeven onderzochte maanden bleef het grootste open model van een Amerikaans lab onder de 130 miljard parameters. Van de 178 Chinese open-gewichtenreleases boven de 20 miljard parameters die in 2026 zijn geteld, gebruikt 59% een Apache 2.0-licentie en 22% MIT; die percentages gelden alleen voor die deelverzameling.
Als de tellers het handigste kompas blijven, is het goed te onthouden wat ze buiten beschouwing laten. De voorsprong van Qwen op de Hub is onmiskenbaar, maar de afstand tot de cijfers die leveranciers claimen vertelt vooral iets over het ontbreken van een gedeelde maatstaf voor werkelijk gebruik. Zolang reikwijdte en methode uiteenlopen, geven de grafieken tendensen, geen vonnissen. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Ik heb het primaire rapport op de officiële blog van Hugging Face geopend en gelezen (huggingface.co/blog/state-of-open-models-summer-2026) en daarbij de publicatiedatum (14 augustus 2026), de auteurs en de precieze cijfers gecontroleerd: repository’s, datasets, Spaces, verdeling van de downloads, Qwen-afgeleiden, parameterdrempels, licenties. Als onafhankelijke bevestiging heb ik het artikel van The Next Web van 16 augustus gelezen, dat dezelfde Hub-cijfers meldt en daarnaast het gat met het door Alibaba genoemde cijfer documenteert plus de herkomst ervan (een verklaring per e-mail); verdere bevestiging bij Fortune (15 augustus) en in het overzicht van Techmeme van 16 augustus. Ik heb nieuws uit hetzelfde venster zonder officiële bevestiging laten vallen: de overname Stripe-OpenRouter (Stripe bevestigt niet, „wij reageren niet op geruchten”) en de kredietgarantie NVIDIA-OpenAI. Ook laten vallen: de DNA-perovskiet-memristor van Penn State — de berichtgeving van 16-17 augustus haalt een paper op dat op 19 januari 2026 in Advanced Functional Materials verscheen en een persbericht dat al in februari rondging, dus geen nieuws van deze week. De autonome vlucht van de F-16 VENOM viel af omdat het DARPA-bericht van 16 juli dateert.
- Incertezze
- De gegevens beslaan uitsluitend de Hub van Hugging Face: gebruik via API, private deployments, ModelScope en andere kanalen vallen erbuiten, dus geen van beide cijfers (2,045 miljard van Hugging Face en 3 miljard van Alibaba) beschrijft het totale werkelijke gebruik van de modellen. Alibaba heeft de methodologie achter de eigen 3 miljard downloads en de „ruim 300.000” afgeleiden niet gepubliceerd, en Hugging Face heeft zich publiekelijk niet over het verschil uitgelaten. De downloadtelling maakt geen onderscheid tussen productiegebruik, tests en geautomatiseerd verkeer, en het rapport zelf signaleert een aanzienlijk aandeel verkeer van niet-geregistreerde agents. Sommige samenvattingen van derden geven het aandeel modellen onder de 200 downloads anders weer (in één geval „ongeveer de helft” in plaats van de 85,6% uit het rapport): het referentiecijfer blijft dat uit de officiële tekst. De licentiepercentages betreffen alleen de Chinese releases boven de 20 miljard parameters, niet het hele ecosysteem.
- Perché pubblicarla
- Het is het stevigste systeemcijfer van de week over het ecosysteem van open modellen, het komt van een primaire bron die de eigen getallen volledig publiceert en het is regel voor regel na te trekken. Vooral biedt het twee dingen die in de gangbare berichtgeving ontbreken: een maat voor hoe weinig de overgrote meerderheid van de gepubliceerde modellen daadwerkelijk wordt gebruikt (1,5% van de repository’s doet 99,2% van de downloads) en een concreet geval van verschil tussen door een bedrijf geclaimde cijfers en door een derde platform gemeten cijfers — nuttig om ranglijsten te leren lezen en niet alleen te citeren.
Fonti / Sources
- Hugging Face — State of Open Models: Summer 2026 Observations (report ufficiale)
- The Next Web — Qwen is the world's most downloaded open model, by a smaller margin than Alibaba says (16 agosto 2026)
- Fortune — Alibaba AI models hit 3 billion downloads, passing Meta, Google (15 agosto 2026)
- Techmeme — rassegna del report Hugging Face (16 agosto 2026)