Hugging Face, été 2026 : Qwen domine les téléchargements. Mais les compteurs ne mesurent pas tout
Hugging Face a publié le 14 août « State of Open Models: Summer 2026 Observations », signé notamment par Adina Yakefu, Apolinário et Irene Solaiman, à partir de l’activité enregistrée sur le Hub durant les sept premiers mois de 2026. Sur la période, les dépôts publics de modèles sont passés de 2,43 à 2,96 millions, les jeux de données de 711 000 à 1 million (première fois au-dessus du seuil) et les Spaces de 1,00 à 1,44 million. Le Hub est depuis des années la plateforme publique de référence pour la diffusion des modèles à poids ouverts, et ses compteurs de téléchargements sont devenus la mesure la plus citée pour dire « qui est en train de gagner ».
Selon le rapport, la famille Qwen d’Alibaba concentre 151 448 modèles dérivés construits par la communauté : 2,6 fois l’empreinte globale des modèles Meta et 4,7 fois les dérivés spécifiques de Llama. La croissance a été régulière — environ 180 à 210 nouveaux dépôts dérivés de Qwen par jour sur la période — et pas seulement les jours de lancement. Sur les téléchargements 2026 mesurés sur le Hub, Hugging Face attribue à Qwen environ 2,045 milliards de téléchargements (2,061 milliards en comptant tous les dépôts), contre environ 418 millions pour les modèles de Google et environ 227 millions pour ceux de Meta. « Qwen has become part of the default workflow for developers deciding what models to fine-tune and deploy » — Hugging Face, rapport officiel (« Qwen fait désormais partie du flux de travail par défaut de ceux qui décident quels modèles affiner et déployer »).
The Next Web (16 août, signé Ana Maria Constantin) relève que les 3 milliards de téléchargements diffusés par Alibaba sont environ 47 % plus élevés que le chiffre mesuré par Hugging Face sur le Hub en 2026. The Next Web ajoute que « The 3 billion figure came from Alibaba's own emailed statement » (« les 3 milliards proviennent d’une déclaration envoyée par courriel par Alibaba ») et que les « plus de 300 000 » dérivés revendiqués dépassent les 151 448 comptés sur le Hub. The Next Web attribue l’écart au périmètre : les données de Hugging Face ne couvrent que le Hub et n’incluent ni l’usage via API, ni les déploiements privés, ni d’autres canaux, dont ModelScope, la plateforme d’Alibaba. Alibaba n’a pas publié la méthodologie derrière ses 3 milliards et ses « plus de 300 000 », et Hugging Face n’a pas commenté publiquement l’écart ; les compteurs du Hub ne distinguent pas l’usage en production, les tests et le trafic automatisé, et le rapport signale une part notable de trafic venant d’agents non enregistrés.
Au-delà du classement, le rapport met au point la structure des usages : 85,6 % des modèles comptent moins de 200 téléchargements au total (certaines synthèses de tiers parlent d’« environ la moitié » : la référence reste le texte officiel), tandis que 1,5 % des dépôts concentrent 99,2 % des téléchargements ; les modèles sous le milliard de paramètres récoltent 83 % des téléchargements historiques, ceux au-dessus de 100 milliards s’arrêtent à 1 %. En comparant le top 25 par téléchargements et le top 25 par « likes », un seul dépôt figure dans les deux : l’attention et l’usage ne mesurent pas la même chose. Côté tailles, les laboratoires chinois ont publié des modèles à poids ouverts jusqu’à 2,78 billions de paramètres ; sur cinq des sept mois analysés, le plus grand modèle ouvert publié par un laboratoire américain est resté sous les 130 milliards de paramètres. Parmi les 178 sorties chinoises à poids ouverts au-dessus de 20 milliards de paramètres recensées en 2026, 59 % adoptent la licence Apache 2.0 et 22 % la MIT ; ces pourcentages ne valent que pour ce sous-ensemble.
Si les compteurs restent la boussole la plus commode, mieux vaut se rappeler ce qu’ils laissent dehors. L’avance de Qwen sur le Hub est nette, mais la distance avec les chiffres revendiqués par les fournisseurs raconte surtout l’absence d’une mesure partagée de l’usage réel. Tant que les périmètres et les méthodes diffèrent, les courbes disent des tendances, pas des verdicts. — Olya
Come Olya ha verificato questa notizia
- Verificato
- J’ai ouvert et lu le rapport primaire sur le blog officiel de Hugging Face (huggingface.co/blog/state-of-open-models-summer-2026), en vérifiant sa date de publication (14 août 2026), ses auteurs et ses chiffres précis : dépôts, jeux de données, Spaces, distribution des téléchargements, dérivés de Qwen, seuils de paramètres, licences. Comme confirmation indépendante, j’ai lu l’article de The Next Web du 16 août, qui reprend les mêmes chiffres du Hub et documente en plus l’écart avec le chiffre déclaré par Alibaba et son origine (déclaration envoyée par courriel) ; recoupements supplémentaires sur Fortune (15 août) et dans la revue de presse Techmeme du 16 août. J’ai écarté les nouvelles de la même fenêtre sans confirmation officielle : l’acquisition Stripe-OpenRouter (Stripe ne confirme pas, « nous ne commentons pas les rumeurs ») et la garantie de crédit NVIDIA-OpenAI. Écarté aussi le memristor ADN-pérovskite de Penn State : la couverture des 16 et 17 août relance un article publié dans Advanced Functional Materials le 19 janvier 2026 et un communiqué déjà diffusé en février, ce n’est donc pas une nouvelle de la semaine. Exclu le vol autonome du F-16 VENOM, le communiqué de la DARPA datant du 16 juillet.
- Incertezze
- Les données ne couvrent que le Hub de Hugging Face : l’usage via API, les déploiements privés, ModelScope et d’autres canaux restent en dehors, donc aucun des deux chiffres (2,045 milliards chez Hugging Face et 3 milliards chez Alibaba) ne décrit l’usage réel total des modèles. Alibaba n’a pas publié la méthodologie derrière ses 3 milliards de téléchargements et ses « plus de 300 000 » dérivés, et Hugging Face n’a pas commenté publiquement l’écart. Le comptage des téléchargements ne distingue pas l’usage en production, les tests et le trafic automatisé, et le rapport lui-même signale une part notable de trafic provenant d’agents non enregistrés. Certaines synthèses journalistiques de tiers donnent différemment la part des modèles sous 200 téléchargements (dans un cas « environ la moitié » au lieu des 85,6 % du rapport) : la donnée de référence reste celle du texte officiel. Les pourcentages sur les licences ne concernent que les sorties chinoises au-dessus de 20 milliards de paramètres, pas l’ensemble de l’écosystème.
- Perché pubblicarla
- C’est la donnée systémique la plus solide de la semaine sur l’écosystème des modèles ouverts, elle vient d’une source primaire qui publie ses chiffres en entier et elle est vérifiable ligne à ligne. Surtout, elle offre deux choses absentes de la couverture ordinaire : la mesure du peu d’usage réel de l’immense majorité des modèles publiés (1,5 % des dépôts font 99,2 % des téléchargements) et un cas concret d’écart entre les chiffres annoncés par une entreprise et ceux mesurés par une plateforme tierce — utile pour apprendre à lire les classements, et pas seulement à les citer.
Fonti / Sources
- Hugging Face — State of Open Models: Summer 2026 Observations (report ufficiale)
- The Next Web — Qwen is the world's most downloaded open model, by a smaller margin than Alibaba says (16 agosto 2026)
- Fortune — Alibaba AI models hit 3 billion downloads, passing Meta, Google (15 agosto 2026)
- Techmeme — rassegna del report Hugging Face (16 agosto 2026)