Hugging Face, verano de 2026: Qwen encabeza las descargas. Pero los contadores no lo miden todo
Hugging Face publicó el 14 de agosto «State of Open Models: Summer 2026 Observations», firmado entre otros por Adina Yakefu, Apolinário e Irene Solaiman y basado en la actividad registrada en el Hub durante los siete primeros meses de 2026. En ese periodo, los repositorios públicos de modelos pasaron de 2,43 a 2,96 millones, los conjuntos de datos de 711.000 a 1 millón (por primera vez por encima del umbral) y los Spaces de 1,00 a 1,44 millones. El Hub es desde hace años la plataforma pública de referencia para distribuir modelos de pesos abiertos, y sus contadores de descargas se han convertido en la métrica más citada para decir «quién va ganando».
Según el informe, la familia Qwen de Alibaba concentra 151.448 modelos derivados construidos por la comunidad: 2,6 veces la huella conjunta de los modelos de Meta y 4,7 veces los derivados específicos de Llama. El crecimiento fue constante —unos 180-210 nuevos repositorios derivados de Qwen al día en el periodo— y no solo en las jornadas de lanzamiento. En las descargas de 2026 medidas en el Hub, Hugging Face atribuye a Qwen unos 2.045 millones (2.061 millones contando todos los repositorios), frente a unos 418 millones de los modelos de Google y unos 227 millones de los de Meta. «Qwen has become part of the default workflow for developers deciding what models to fine-tune and deploy» — Hugging Face, informe oficial («Qwen ha entrado en el flujo de trabajo por defecto de quienes deciden qué modelos ajustar y desplegar»).
The Next Web (16 de agosto, firma de Ana Maria Constantin) observa que los 3.000 millones de descargas difundidos por Alibaba son alrededor de un 47 % superiores al dato medido por Hugging Face en el Hub en 2026. The Next Web añade que «The 3 billion figure came from Alibaba's own emailed statement» («los 3.000 millones proceden de una declaración enviada por correo electrónico por Alibaba») y que los «más de 300.000» derivados reivindicados superan los 151.448 contados en el Hub. The Next Web atribuye la diferencia al perímetro: los datos de Hugging Face cubren solo el Hub y no incluyen el uso vía API, los despliegues privados ni otros canales, entre ellos ModelScope, de la propia Alibaba. Alibaba no ha publicado la metodología con la que calcula sus 3.000 millones y sus «más de 300.000», y Hugging Face no ha comentado públicamente la brecha; los contadores del Hub no distinguen entre uso en producción, pruebas y tráfico automatizado, y el informe señala una proporción relevante de tráfico procedente de agentes no registrados.
Más allá de la clasificación, el informe enfoca la estructura de uso: el 85,6 % de los modelos tiene menos de 200 descargas en total (algunas síntesis de terceros hablan de «alrededor de la mitad»: la referencia sigue siendo el texto oficial), mientras que el 1,5 % de los repositorios concentra el 99,2 % de las descargas totales; los modelos por debajo de 1.000 millones de parámetros reúnen el 83 % de las descargas históricas y los que superan los 100.000 millones se quedan en el 1 %. Al comparar el top 25 por descargas con el top 25 por «me gusta», solo un repositorio aparece en ambos: atención y uso miden cosas distintas. En cuanto a tamaños, los laboratorios chinos han publicado modelos de pesos abiertos de hasta 2,78 billones de parámetros; en cinco de los siete meses analizados, el mayor modelo abierto lanzado por un laboratorio estadounidense se quedó por debajo de los 130.000 millones de parámetros. Entre los 178 lanzamientos chinos de pesos abiertos por encima de 20.000 millones de parámetros censados en 2026, el 59 % adopta licencia Apache 2.0 y el 22 % MIT; los porcentajes valen solo para ese subconjunto.
Si los contadores siguen siendo la brújula más cómoda, conviene recordar qué dejan fuera. La ventaja de Qwen en el Hub es nítida, pero la distancia con las cifras que reivindican los proveedores habla sobre todo de la falta de una métrica compartida del uso real. Mientras perímetros y métodos sigan siendo distintos, los gráficos dicen tendencias, no veredictos. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Abrí y leí el informe primario en el blog oficial de Hugging Face (huggingface.co/blog/state-of-open-models-summer-2026), verificando su fecha de publicación (14 de agosto de 2026), sus autores y sus cifras concretas: repositorios, conjuntos de datos, Spaces, distribución de las descargas, derivados de Qwen, umbrales de parámetros, licencias. Como confirmación independiente abrí el artículo de The Next Web del 16 de agosto, que recoge los mismos números del Hub y además documenta la brecha con la cifra declarada por Alibaba y su origen (una declaración enviada por correo electrónico); más respaldo en Fortune (15 de agosto) y en el repaso de Techmeme del 16 de agosto. Descarté las noticias de la misma ventana sin confirmación oficial: la adquisición Stripe-OpenRouter (Stripe no la confirma, «no comentamos rumores») y la garantía de crédito NVIDIA-OpenAI. También descarté el memristor de ADN y perovskita de Penn State: la cobertura del 16-17 de agosto relanza un artículo publicado en Advanced Functional Materials el 19 de enero de 2026 y un comunicado ya difundido en febrero, así que no es noticia de la semana. Excluí el vuelo autónomo del F-16 VENOM porque el comunicado de DARPA es del 16 de julio.
- Incertezze
- Los datos cubren exclusivamente el Hub de Hugging Face: el uso vía API, los despliegues privados, ModelScope y otros canales quedan fuera, de modo que ninguna de las dos cifras (2.045 millones de Hugging Face y 3.000 millones de Alibaba) describe el uso real total de los modelos. Alibaba no ha publicado la metodología con la que calcula sus 3.000 millones de descargas y sus «más de 300.000» derivados, y Hugging Face no ha comentado públicamente la diferencia. El recuento de descargas no distingue entre uso en producción, pruebas y tráfico automatizado, y el propio informe señala una proporción relevante de tráfico procedente de agentes no registrados. Algunas síntesis periodísticas de terceros dan de otra forma la proporción de modelos por debajo de 200 descargas (en un caso «alrededor de la mitad» en lugar del 85,6 % del informe): el dato de referencia sigue siendo el del texto oficial. Los porcentajes sobre licencias se refieren solo a los lanzamientos chinos por encima de 20.000 millones de parámetros, no al ecosistema entero.
- Perché pubblicarla
- Es el dato de sistema más sólido de la semana sobre el ecosistema de los modelos abiertos, viene de una fuente primaria que publica sus números íntegros y se puede verificar línea a línea. Sobre todo, ofrece dos cosas que faltan en la cobertura habitual: la medida de lo poco que se usa realmente la inmensa mayoría de los modelos publicados (el 1,5 % de los repositorios hace el 99,2 % de las descargas) y un caso concreto de desfase entre los números que declara una empresa y los que mide una plataforma tercera —útil para enseñar a leer las clasificaciones, no solo a citarlas.
Fonti / Sources
- Hugging Face — State of Open Models: Summer 2026 Observations (report ufficiale)
- The Next Web — Qwen is the world's most downloaded open model, by a smaller margin than Alibaba says (16 agosto 2026)
- Fortune — Alibaba AI models hit 3 billion downloads, passing Meta, Google (15 agosto 2026)
- Techmeme — rassegna del report Hugging Face (16 agosto 2026)