Hugging Face, лето 2026: по загрузкам лидирует Qwen. Но счётчики измеряют не всё
14 августа Hugging Face опубликовала отчёт «State of Open Models: Summer 2026 Observations», подписанный в том числе Адиной Якефу, Аполинариу и Ирен Солейман и основанный на активности, зафиксированной на Hub за первые семь месяцев 2026 года. За этот период число публичных репозиториев моделей выросло с 2,43 до 2,96 миллиона, наборов данных — с 711 тысяч до 1 миллиона (впервые выше этой отметки), Spaces — с 1,00 до 1,44 миллиона. Hub уже много лет остаётся главной публичной площадкой распространения моделей с открытыми весами, а его счётчики загрузок стали самой цитируемой метрикой, когда речь заходит о том, «кто побеждает».
По данным отчёта, семейство Qwen от Alibaba собрало 151 448 производных моделей, созданных сообществом: в 2,6 раза больше совокупного следа моделей Meta и в 4,7 раза больше производных именно от Llama. Рост был ровным — примерно 180–210 новых репозиториев, производных от Qwen, в день на протяжении периода — и не сводился к дням релизов. По загрузкам 2026 года, измеренным на Hub, Hugging Face приписывает Qwen около 2,045 миллиарда загрузок (2,061 миллиарда, если считать все репозитории) против примерно 418 миллионов у моделей Google и примерно 227 миллионов у моделей Meta. «Qwen has become part of the default workflow for developers deciding what models to fine-tune and deploy» — Hugging Face, официальный отчёт («Qwen вошёл в рабочий процесс по умолчанию у тех, кто решает, какие модели дообучать и разворачивать»).
The Next Web (16 августа, материал Аны Марии Константин) отмечает, что 3 миллиарда загрузок, о которых сообщила Alibaba, примерно на 47% выше значения, измеренного Hugging Face на Hub в 2026 году. Издание добавляет: «The 3 billion figure came from Alibaba's own emailed statement» («цифра в 3 миллиарда взята из заявления, присланного Alibaba по электронной почте»), а заявленные «свыше 300 000» производных превышают 151 448, подсчитанных на Hub. The Next Web объясняет разницу периметром: данные Hugging Face охватывают только Hub и не включают использование через API, частные развёртывания и другие каналы, в том числе принадлежащий Alibaba ModelScope. Alibaba не опубликовала методику, по которой считает свои 3 миллиарда и «свыше 300 000», а Hugging Face публично не прокомментировала расхождение; счётчики Hub не разделяют продуктивное использование, тесты и автоматизированный трафик, и сам отчёт указывает на заметную долю трафика от незарегистрированных агентов.
Помимо рейтинга, отчёт наводит резкость на структуру использования: у 85,6% моделей суммарно меньше 200 загрузок (некоторые сторонние пересказы говорят «примерно половина»: ориентиром остаётся официальный текст), тогда как 1,5% репозиториев дают 99,2% всех загрузок; модели меньше 1 миллиарда параметров собирают 83% исторических загрузок, а модели свыше 100 миллиардов останавливаются на 1%. Если сравнить топ-25 по загрузкам с топ-25 по «лайкам», в обоих списках окажется всего один репозиторий: внимание и использование измеряют разное. По размерам китайские лаборатории выпускали модели с открытыми весами вплоть до 2,78 триллиона параметров; в пяти из семи проанализированных месяцев крупнейшая открытая модель от американской лаборатории оставалась ниже 130 миллиардов параметров. Среди 178 китайских релизов с открытыми весами свыше 20 миллиардов параметров, учтённых в 2026 году, 59% используют лицензию Apache 2.0 и 22% — MIT; эти доли относятся только к данному подмножеству.
Если счётчики остаются самым удобным компасом, стоит помнить, что они оставляют за кадром. Первенство Qwen на Hub очевидно, но дистанция до цифр, заявленных поставщиками, говорит прежде всего об отсутствии общей метрики реального использования. Пока периметры и методы расходятся, графики показывают тенденции, а не приговоры. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Я открыла и прочитала первичный отчёт в официальном блоге Hugging Face (huggingface.co/blog/state-of-open-models-summer-2026), проверив дату публикации (14 августа 2026 года), авторов и конкретные цифры: репозитории, наборы данных, Spaces, распределение загрузок, производные Qwen, пороги по параметрам, лицензии. В качестве независимого подтверждения открыла материал The Next Web от 16 августа: там приводятся те же цифры Hub и вдобавок задокументировано расхождение с показателем, заявленным Alibaba, и его происхождение (заявление, присланное по электронной почте); дополнительная сверка — Fortune (15 августа) и обзор Techmeme от 16 августа. Отбросила новости того же окна без официального подтверждения: покупку OpenRouter компанией Stripe (Stripe не подтверждает, «мы не комментируем слухи») и кредитную гарантию NVIDIA-OpenAI. Отбросила и мемристор на ДНК и перовските из Penn State: публикации 16-17 августа пересказывают статью в Advanced Functional Materials от 19 января 2026 года и пресс-релиз, разосланный ещё в феврале, — это не новость недели. Исключила автономный полёт F-16 VENOM, поскольку сообщение DARPA датировано 16 июля.
- Incertezze
- Данные охватывают исключительно Hub Hugging Face: использование через API, частные развёртывания, ModelScope и другие каналы остаются за пределами, поэтому ни одна из двух цифр (2,045 миллиарда у Hugging Face и 3 миллиарда у Alibaba) не описывает реальное совокупное использование моделей. Alibaba не опубликовала методику расчёта своих 3 миллиардов загрузок и «свыше 300 000» производных, а Hugging Face публично не прокомментировала расхождение. Подсчёт загрузок не разделяет продуктивное использование, тесты и автоматизированный трафик, и сам отчёт указывает на заметную долю трафика от незарегистрированных агентов. Некоторые сторонние журналистские пересказы иначе передают долю моделей с менее чем 200 загрузками (в одном случае «примерно половина» вместо 85,6% из отчёта): опорным остаётся значение из официального текста. Проценты по лицензиям относятся только к китайским релизам свыше 20 миллиардов параметров, а не ко всей экосистеме.
- Perché pubblicarla
- Это самая надёжная системная цифра недели по экосистеме открытых моделей: она исходит из первичного источника, который публикует свои данные целиком, и проверяется построчно. Главное — она даёт читателю две вещи, которых нет в обычных публикациях: меру того, как мало на самом деле используется подавляющее большинство опубликованных моделей (1,5% репозиториев дают 99,2% загрузок), и конкретный случай расхождения между цифрами, заявленными компанией, и цифрами, измеренными сторонней платформой, — полезно, чтобы научиться читать рейтинги, а не только их цитировать.
Fonti / Sources
- Hugging Face — State of Open Models: Summer 2026 Observations (report ufficiale)
- The Next Web — Qwen is the world's most downloaded open model, by a smaller margin than Alibaba says (16 agosto 2026)
- Fortune — Alibaba AI models hit 3 billion downloads, passing Meta, Google (15 agosto 2026)
- Techmeme — rassegna del report Hugging Face (16 agosto 2026)