Между анонсом и репозиторием: проверка открытости для K2 Horizon
3 сентября 2026 года Institute of Foundation Models (IFM), созданный в мае 2025 года Университетом искусственного интеллекта имени Мохаммеда бин Заида и работающий между Абу-Даби, Кремниевой долиной и Парижем, объявил о выпуске семейства K2 Horizon. Речь идёт о шести моделях под лицензией Apache 2.0 размером 0,9, 3,7, 7, 32 и 36 млрд параметров с 4 млрд активных (вариант MoVA), а также 375 млрд с 23 млрд активных на токен. Официальная спецификация указывает для модели на 375B нативное контекстное окно в 512K токенов (524 288); отраслевое издание, напротив, сообщает о 131 072 для той же модели. Расхождение не разъяснено. По независимым измерениям Artificial Analysis даёт модели на 375B 38 баллов в собственном Intelligence Index при медиане 22, измеренной среди open-weight моделей сопоставимого размера.
Однако по-настоящему открытым остаётся вопрос о полноте релиза. В сообщении, распространённом через PR Newswire, институт описывает поставку как включающую веса, исходный код, обучающие данные и методики для всех шести вариантов. Основатель IFM и президент MBZUAI Эрик Син подчеркнул этот подход: «Открытый код — это гораздо больше, чем открытые веса. Наука работает тогда, когда другие могут увидеть данные, пройти тем же методом, воспроизвести результат и улучшить его». Тем не менее проверка репозиториев организации на Hugging Face показывает веса моделей, но лишь один набор данных, посвящённый источникам для оценки, — «eval-360-sources». Сама карточка модели на 375B признаёт разнесение во времени, уточняя: «Мы выпустили финальный чекпойнт; промежуточные чекпойнты вместе с данными и обучающим кодом будут опубликованы». Обучающий датасет и обучающий код на данный момент не опубликованы, из-за чего заявленное при запуске обещание полной воспроизводимости остаётся непроверяемым. IFM публично не ответил на это расхождение, и график публикации обучающих данных неизвестен.
Модели доступны для интеграции с vLLM и SGLang и через партнёров по инференсу — Compass, Cerebras, AWS и Nebius — и содержат заметные инженерные решения. Согласно сообщению, вариант MoVA на 36B использует архитектуру Mixture of Value Attention и метод диффузионной дистилляции с заявленным трёхкратным ускорением — данные, независимо не проверенные. Неизвестными остаются общее число токенов, использованных при обучении, и объём затраченных вычислений. Официальный сайт ifm.ai отклоняет автоматические запросы (HTTP 403): текст блога института прочитать напрямую не удалось, и приведённые здесь заявления взяты из сообщения на PR Newswire и из карточки модели.
Заявлять, что модель «только открытых весов» преодолена, — шаг амбициозный. Но пока обучающие данные и исходные рецепты остаются обещаниями в будущем времени, расстояние между анонсом и научным доказательством ещё предстоит пройти целиком.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я прочитала официальное сообщение института на PR Newswire (дата, размеры, лицензия, партнёры, цитата Эрика Сина) и официальную карточку флагманской модели на Hugging Face — именно она является реально выпущенным артефактом: оттуда взяты параметры, контекстное окно, таблица бенчмарков и фраза в будущем времени о данных и коде. Затем я проверила список репозиториев организации IFM на Hugging Face: единственный имеющийся датасет — «eval-360-sources», а не обучающие данные. В качестве независимых подтверждений использовала Artificial Analysis (Intelligence Index 38, контекст 524 000, 3 сентября 2026) и два издания — Middle East AI News и TBreak, — которые сообщают о том же релизе, цитате основателя и партнёрах. Страницы ifm.ai/k2/ и ifm.ai/blog/k2/, а также материалы AIwire/HPCwire вернули HTTP 403 и напрямую не использовались.
- Incertezze
- Главный открытый вопрос — разрыв между сообщением, где обучающие данные и код представлены как уже часть релиза, и официальной карточкой модели, которая относит их к будущему: на Hugging Face не обнаружено ни одного обучающего датасета, только репозиторий источников для оценки. IFM публично не ответил, график публикации неизвестен. Сайт ifm.ai отклоняет автоматические запросы (HTTP 403), поэтому текст официального блога напрямую не прочитан: приведённые здесь заявления института взяты из его сообщения на PR Newswire и из карточки модели. По контексту есть противоречие: карточка указывает 512K токенов, а одно издание — 131 072 для той же модели. Все оценки бенчмарков, кроме Intelligence Index, заявлены самим разработчиком, независимого воспроизведения пока нет. Ни число обучающих токенов, ни стоимость или объём вычислений не раскрыты.
- Perché pubblicarla
- Это не очередная публикация весов: заявленное обещание («открытый код — это гораздо больше, чем открытые веса») и то, что действительно опубликовано, расходятся документируемым образом, причём сам первичный источник — карточка модели — опровергает формулировку пресс-релиза. Именно такой разрыв между анонсом и артефактом не встретишь в пересказах релиза, и проверить его может любой в два клика на Hugging Face. К тому же это крупнейшая на сегодня открытая модель, заявленная как полностью воспроизводимая, и она исходит от незападного государственного игрока: два обстоятельства, важные для тех, кому в Европе приходится выбирать модели, проверяемые в рамках AI Act.