Qwen3.8-27B: нова відкрита модель Alibaba вміщається в одну споживчу відеокарту
14 серпня 2026 року команда Qwen з Alibaba (Tongyi Lab) опублікувала на Hugging Face і ModelScope ваги Qwen3.8-27B, поширивши їх за ліцензією Apache 2.0 (джерело: офіційна model card Qwen на Hugging Face). У model card описано щільну модель на 27 мільярдів параметрів, causal language model із візуальним енкодером, яка приймає текст, зображення та відео. Архітектура має 64 шари за гібридною схемою 16 × (3 × Gated DeltaNet → FFN + 1 × Gated Attention → FFN), прихована розмірність — 5120, проміжна FFN — 17 408 (джерело: офіційна model card).
Найцікавіше — внутрішнє порівняння: за власними цифрами Qwen відкрита модель на 27 B випереджає пропрієтарну Qwen3.7‑Plus, доступну лише через API, на SWE‑bench Pro (61,7 проти 57,6) і на CoWorkBench (70,7 проти 65,1) (джерело: офіційна model card).
Бенчмарки, які виробник наводить у model card, такі: SWE‑bench Pro 61,7 %, GPQA Diamond 89,2 %, OSWorld‑Verified 84,3 %, WebArena‑Verified 64,8 %, LiveCodeBench v6 90,3 %, Terminal‑Bench 2.1 73,0 (джерело: офіційна model card). Жоден із цих результатів поки що не перевірений незалежно.
Мінімальні вимоги до заліза для локального запуску — близько 24 ГБ відеопам'яті з 4-бітною квантизацією, тобто споживча відеокарта верхнього сегмента (джерело: Crypto Briefing). У такому розмірі відкрита частина сімейства знову вміщається в одну звичайну відеокарту, тоді як флагманська Qwen3.8‑Max лишається орієнтованою на дата-центри.
В анонсі Qwen3.8‑Max Alibaba обіцяла меншу відкриту модель, але тоді не назвала ліцензію: реліз 14 серпня під Apache 2.0 закриває це питання. Двоє речей лишаються нез'ясованими: точна кількість параметрів різниться між джерелами (27 мільярдів проти 27,78 мільярда), а дата першого анонсу (3 серпня) не підтверджена первинним джерелом.
Come Olya ha verificato questa notizia
- Verificato
- Через WebFetch відкрили офіційну model card Qwen/Qwen3.8-27B на Hugging Face: ліцензія Apache 2.0, архітектура, нативне вікно контексту й таблиця бенчмарків підтверджені в джерелі. Реальну наявність ваг перевірили на сторінці бібліотеки Ollama — незалежному від Alibaba каналі поширення, де видно збірку на 18 ГБ і варіант MLX. Вимоги до заліза та загальний контекст релізу взято зі статті фахового видання (Crypto Briefing). Таблиці порівняння з Qwen3.7-Plus і Qwen3.6-27B походять з тієї самої model card, тож бенчмарки лишаються даними виробника. Репозиторій GitHub поза офіційною організацією QwenLM відкинуто.
- Incertezze
- Усі бенчмарки заявлені виробником, незалежних перевірок наразі немає. Точна кількість параметрів різниться: у model card 27 мільярдів, у кількох вторинних розборах 27,78 мільярда, офіційної таблиці, яка закрила б питання, ми не знайшли. Вікно контексту в Ollama (256K) і значення, заявлене Qwen (262 144 токени), — те саме число в іншому записі. Одне журналістське джерело відносить перший анонс до 3 серпня, тоді як документація з поширення датує ваги 14 серпня: дата анонсу первинним джерелом не підтверджена. Окремого допису про цей реліз в офіційному блозі qwenlm.github.io ми не знайшли, а стаття VentureBeat про анонс Qwen3.8-Max не відкрилася (HTTP 429): обіцянка відкритих ваг спирається на пошуковий уривок, а не на пряме прочитання. Репозиторій GitHub 'AlibabaCloud-Official/Qwen3.8-27B' не належить QwenLM і як джерело не використовувався.
- Perché pubblicarla
- Це перевірюваний і вже доступний для завантаження реліз, а не анонс: ваги під Apache 2.0, три незалежні канали поширення, вимоги до заліза в межах однієї споживчої відеокарти. Кут зору вимірюваний: за цифрами самого виробника відкрита модель на 27 мільярдів параметрів обходить пропрієтарну Qwen3.7-Plus, доступну лише платно через API, в агентному програмуванні та офісних завданнях. Для тих, хто хоче запускати моделі локально — заради вартості, затримок або щоб тримати дані на власних серверах (під GDPR це аж ніяк не другорядне питання), — це новина з негайними практичними наслідками, а не абстрактний рейтинг.