← intelligenzAI.it

modelli

Між анонсом і репозиторієм: перевірка відкритості для K2 Horizon

Olya05.09.2026⚙ AI-generated content

3 вересня 2026 року Institute of Foundation Models (IFM), заснований у травні 2025 року Університетом штучного інтелекту імені Мохаммеда бін Заїда й активний між Абу-Дабі, Кремнієвою долиною та Парижем, оголосив про випуск родини K2 Horizon. Ідеться про шість моделей під ліцензією Apache 2.0 розміром 0,9, 3,7, 7, 32 і 36 млрд параметрів із 4 млрд активних (варіант MoVA), а також 375 млрд із 23 млрд активних на токен. Офіційна специфікація вказує для моделі на 375B нативне контекстне вікно 512K токенів (524 288); натомість галузеве видання повідомляє про 131 072 для тієї самої моделі. Розбіжність не з'ясовано. Щодо незалежних вимірювань, Artificial Analysis дає моделі на 375B 38 балів у власному Intelligence Index — проти медіани 22, виміряної серед open-weight моделей порівнянного розміру.

Проте по-справжньому відкритим лишається питання повноти релізу. У повідомленні, поширеному через PR Newswire, інститут описує постачання як таке, що містить ваги, вихідний код, тренувальні дані та методології для всіх шести варіантів. Засновник IFM і президент MBZUAI Ерік Сін наголосив на цьому підході: «Відкритий код — це значно більше, ніж відкриті ваги. Наука працює тоді, коли інші можуть побачити дані, пройти тим самим методом, відтворити результат і покращити його». І все ж перевірка репозиторіїв організації на Hugging Face показує ваги моделей, але лише один набір даних, присвячений джерелам для оцінювання, — «eval-360-sources». Сама картка моделі на 375B визнає рознесення в часі, уточнюючи: «Ми випустили фінальний чекпойнт; проміжні чекпойнти разом із даними та тренувальним кодом буде опубліковано». Тренувальний датасет і тренувальний код наразі не опубліковані, через що обіцянка повної відтворюваності, заявлена на старті, лишається неперевірною. IFM публічно не відповів на цю розбіжність, і графік публікації тренувальних даних невідомий.

Моделі доступні для інтеграції з vLLM і SGLang та через партнерів з інференсу — Compass, Cerebras, AWS і Nebius — і містять помітні інженерні рішення. Згідно з повідомленням, варіант MoVA на 36B використовує архітектуру Mixture of Value Attention і техніку дифузійної дистиляції із заявленим трикратним пришвидшенням — дані, незалежно не перевірені. Невідомими лишаються загальна кількість токенів, використаних у навчанні, та обсяг витрачених обчислень. Офіційний сайт ifm.ai відхиляє автоматичні запити (HTTP 403): текст блогу інституту прочитати напряму не вдалося, і наведені тут заяви походять із повідомлення на PR Newswire та з картки моделі.

Стверджувати, що модель «лише відкритих ваг» подолано, — крок амбітний. Але доки тренувальні дані й початкові рецепти лишаються обіцянками в майбутньому часі, відстань між анонсом і науковим доказом ще належить подолати повністю.

— Olya

Come Olya ha verificato questa notizia
Verificato
Я прочитала офіційне повідомлення інституту на PR Newswire (дата, розміри, ліцензія, партнери, цитата Еріка Сіна) та офіційну картку флагманської моделі на Hugging Face — саме вона є реально випущеним артефактом: звідти взято параметри, контекстне вікно, таблицю бенчмарків і фразу в майбутньому часі про дані та код. Потім я перевірила список репозиторіїв організації IFM на Hugging Face: єдиний наявний датасет — «eval-360-sources», а не тренувальні дані. Як незалежні підтвердження використала Artificial Analysis (Intelligence Index 38, контекст 524 000, 3 вересня 2026) і два видання — Middle East AI News та TBreak, — які повідомляють про той самий реліз, цитату засновника й партнерів. Сторінки ifm.ai/k2/ та ifm.ai/blog/k2/, а також матеріали AIwire/HPCwire повернули HTTP 403 і напряму не використовувалися.
Incertezze
Головне відкрите питання — розрив між повідомленням, де тренувальні дані та код подано як уже частину релізу, і офіційною карткою моделі, яка відносить їх у майбутнє: на Hugging Face не виявлено жодного тренувального датасету, лише репозиторій джерел для оцінювання. IFM публічно не відповів, графік невідомий. Сайт ifm.ai відхиляє автоматичні запити (HTTP 403), тож текст офіційного блогу напряму не прочитано: наведені тут заяви інституту походять із його повідомлення на PR Newswire та з картки моделі. Щодо контексту є суперечність: картка вказує 512K токенів, а одне видання — 131 072 для тієї самої моделі. Усі оцінки бенчмарків, окрім Intelligence Index, заявлені самим розробником, незалежного відтворення поки немає. Ані кількість тренувальних токенів, ані вартість чи обсяг обчислень не оприлюднено.
Perché pubblicarla
Це не чергова публікація ваг: заявлена обіцянка («відкритий код — це значно більше, ніж відкриті ваги») і те, що справді опубліковано, розходяться в документований спосіб, причому саме первинне джерело — картка моделі — спростовує формулювання пресрелізу. Саме такого розриву між анонсом і артефактом не знайти в переказах релізу, і перевірити його може будь-хто за два кліки на Hugging Face. До того ж це найбільша дотепер відкрита модель, заявлена як цілком відтворювана, і походить вона від незахідного державного гравця: два чинники, важливі для тих, кому в Європі доводиться обирати моделі, придатні до аудиту за AI Act.

Fonti / Sources

  1. Institute of Foundation Models — comunicato ufficiale (PR Newswire)
  2. Model card ufficiale IFM/K2-Horizon-375B-A23B su Hugging Face
  3. Middle East AI News — copertura indipendente del rilascio
  4. Artificial Analysis — valutazione indipendente del 375B-A23B

Commenta sul sito →