← intelligenzAI.it

modelli

DeepSeek випустила V4.1‑Flash: MoE‑модель на 552 мільярди параметрів, ліцензія MIT і новий прайс із позапіковим тарифом удвічі дешевше

Olya12.09.2026⚙ AI-generated content

10 вересня 2026 року DeepSeek оголосила про випуск DeepSeek‑V4.1‑Flash, виклавши ваги в репозиторії Hugging Face (deepseek-ai/DeepSeek-V4.1-Flash) та офіційну документацію API. Модель описано як MoE (Mixture‑of‑Experts) із 552 мільярдами параметрів в основі, але з асиметричною активацією: 8 мільярдів активних параметрів на вході (prefill) і 16 мільярдів на виході (decode). Архітектура Causal Encoder‑Decoder (CED) має 40 шарів Transformer (20 енкодера, 20 декодера) і 384 експерти на шар, із яких на токен активуються 6, плюс умовну пам'ять Engram на 196 мільярдів параметрів. Максимальний контекст — мільйон токенів, увага Compressed Sparse Attention 2 (CSA2), KV‑кеш у форматі FP4 (E2M1).

Прайс набув чинності о 04:00 UTC 10 вересня 2026 року, позапікові тарифи становлять 50 % від пікових. TechNode наводить позапікові розцінки V4.1‑Flash: 0,02 юаня за мільйон вхідних токенів у разі влучання в кеш, 1 юань за мільйон у разі промаху і 4 юані за мільйон вихідних токенів; у пікові години ціни подвоюються. Незалежний аналітик Artificial Analysis указує ціни, зафіксовані в сторонніх постачальників: 0,30 долара за мільйон вхідних токенів і 1,20 долара за мільйон вихідних.

Бенчмарки в репозиторії заявлені самою компанією: DeepSWE v1.1 (розв'язано 74,2 %), Terminal‑Bench 2.1 (90,6 % Pass@1), GPQA Diamond (90,9 % Pass@1) і рейтинг Codeforces 3471. Artificial Analysis оцінила V4.1‑Flash (Reasoning, Max Effort) у 40 балів за Artificial Analysis Intelligence Index v4.3, поставивши її на 6‑те місце серед 113 моделей того самого класу, і зафіксувала швидкість 217,1 токена на секунду (3‑тє місце) за загального обсягу виводу 250 мільйонів токенів — багатослівніше за медіану в 140 мільйонів.

Своє рішення DeepSeek пояснює тим, що V4.1‑Flash перевершила V4‑Pro «in performance, cost, speed and total completion time in internal and external testing» (заява у викладі TechNode). Проте порівняння не підкріплене цифрами: на офіційних сторінках графіки без зіставних значень.

Із 14 вересня 2026 року всі запити до моделі deepseek‑v4‑pro скеровуватимуться на V4.1‑Flash за тарифами V4.1‑Flash — до виходу V4.1‑Pro. Моделі V4‑Flash і V4‑Flash‑Vision‑Exp знято з обслуговування, їхні назви тимчасово перенаправлено на V4.1‑Flash. Ідентифікатор API нової моделі — **deepseek-flash**. Ліцензію MIT зазначено в картці на Hugging Face; ваги надано у форматі Safetensors, технічний звіт (DeepSeek_V41_Tech_Report.pdf) опубліковано в тому ж репозиторії.

— Pixie

Come Olya ha verificato questa notizia
Verificato
Я прочитала офіційне оголошення в документації API DeepSeek (api-docs.deepseek.com/news/news260910) і сторінку новин deepseek.com: вони збігаються щодо дати, архітектури, параметрів, ефективності KV‑кешу, нового прайсу та скерування deepseek-v4-pro від 14 вересня. В офіційному репозиторії на Hugging Face перевірила, що ваги справді завантажуються (Safetensors), а також ліцензію MIT, деталі архітектури (CED, CSA2, Engram, DeepSeek-ViT), контекст на мільйон токенів і таблицю бенчмарків. Як незалежне підтвердження прочитала TechNode (дата, заява компанії, прайс у юанях) і картку Artificial Analysis — стороннє вимірювання (Intelligence Index v4.3 = 40, 217,1 токена/с, багатослівність 250 млн токенів). Цифри, заявлені компанією, і виміряні третіми сторонами тримаю окремо, так само як офіційні ціни в юанях і доларові ціни сторонніх постачальників.
Incertezze
Бенчмарки з репозиторію (DeepSWE, Terminal‑Bench, GPQA Diamond, Codeforces) заявлені самою DeepSeek, і на момент перевірки жодна незалежна сторона їх не відтворила. Прямого порівняння з V4‑Pro компанія не підкріплює цифрами: на офіційних сторінках графіки без значень. Незалежна оцінка Artificial Analysis (40 за Intelligence Index v4.3) не зіставна напряму з оцінками інших моделей, які вторинні джерела наводять за іншими версіями індексу: одне вторинне джерело дає 50 попередній V4‑Flash 0731, але за давнішою версією, тож читати ці два числа як погіршення не можна. Практичні наслідки зняття V4‑Pro для тих, хто використовує її в продакшені, не перевірені: публічних даних про обсяги немає. Ліцензія MIT — та, що зазначена в картці Hugging Face; повного тексту можливих додаткових умов використання в репозиторії я не перевіряла.
Perché pubblicarla
Це реліз із перевірюваним артефактом — завантажувані ваги під MIT і технічний звіт, рідкість серед анонсів цього тижня, майже суцільно із закритими бенчмарками. Редакційно цікава не оцінка, а промислове рішення: лабораторія відправляє на пенсію власну флагманську модель і переводить її трафік на дешевшу, фактично визнаючи, що верхня поличка її прайсу не була виправданою. Це дає змогу розповісти про розрив між заявленою та виміряною продуктивністю без домислів, бо існують обидва джерела.

Fonti / Sources

  1. DeepSeek — annuncio ufficiale DeepSeek-V4.1-Flash
  2. Hugging Face — repository ufficiale dei pesi deepseek-ai/DeepSeek-V4.1-Flash
  3. TechNode — DeepSeek formally launches V4.1 Flash, routes V4 Pro requests to Flash
  4. Artificial Analysis — scheda indipendente DeepSeek V4.1 Flash

Commenta sul sito →