Kimi K3: Moonshot AI выпускает гиганта с открытыми весами, чтобы обойти ограничения по вычислениям
Китайский стартап Moonshot AI выложил свой козырь: Kimi K3. С 2,8 триллиона параметров в сумме это крупнейшая когда-либо распространённая модель с открытыми весами, но само число менее интересно, чем то, как им распоряжаются. Архитектура Mixture-of-Experts разрежена: из 896 экспертов на токен активируется, по первым анализам, лишь около 16 (Moonshot пока официально не подтвердил эту цифру). Это значит, что вычислительный каркас огромен, но практическое использование хирургически точное — необходимость, продиктованная скорее аппаратными ограничениями, наложенными санкциями, чем чистым духом соперничества.
На бумаге показатели убедительны: Kimi K3 занимает первое место в бенчмарке Frontend Code Arena, обходя модели уровня Claude Fable 5 и GPT-5.6 Sol. Система мультимодальна — принимает на вход текст, изображения и видео — и предлагает окно контекста в миллион токенов. Для таких длинных контекстов Moonshot заявляет, что новая Kimi Delta Attention ускоряет декодирование до 6,3 раза, в паре с техникой Attention Residuals. Рассуждение всегда включено и регулируется параметром «reasoning_effort», но именно здесь возникает неопределённость: сколь бы лестными ни были внутренние бенчмарки, независимые тесты реального расхода токенов пока не появились. Слухи о чрезмерном расходе ресурсов на банальных задачах остаются пока лишь слухами.
Однако настоящий стратегический ход — не технический, а коммерческий. Пока США затягивают петлю вокруг экспорта передовых чипов, Китай отвечает не попыткой соперничать в секретности, а доступностью. Предложить модель такого класса по бросовым ценам — 3 доллара за миллион входных токенов и 15 за миллион выходных — да ещё с открытыми весами, это эффективный способ обойти аппаратные барьеры и захватить долю рынка. Тень остаётся над лицензией: названа «изменённой MIT», но пока не опубликована целиком. До 27 июля, когда выйдут полные веса, открытость остаётся обещанием, а не свершившимся фактом.
Раздавать доступ, чтобы доминировать в инфраструктуре, — похоже на новый капитализм. Посмотрим, выдержит ли обещанная эффективность нагрузку миллионов разработчиков, готовых нажать «скачать».
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Перепроверено в июле 2026 через поиск и загрузку источников. Tom's Hardware подтверждает, что K3 обходит Claude Fable 5 в Frontend Code Arena; VentureBeat был недоступен (403/429), но подтверждён по фрагментам поиска и по MLQ, KuCoin, Gizmochina и felloai. felloai предоставил архитектуру, экспертов, бенчмарки, лицензию и цены. Оценки и цены совпадают по всем источникам.
- Incertezze
- Лицензия («изменённая MIT») анонсирована, но ещё не опубликована: остаётся непроверенной до выхода весов 27 июля. Ни один источник не подтверждает чрезмерный расход токенов — независимые бенчмарки ещё в ожидании, — поэтому этот пункт следует рассматривать лишь как наблюдение, требующее смягчения. Соотношение 16 из 896 активных экспертов взято у felloai, а не у Moonshot. VentureBeat и Tom's Hardware теперь блокируют загрузку: факты подтверждены по фрагментам и согласующимся источникам, но без полного перечитывания.
- Perché pubblicarla
- Прочная и всё ещё актуальная новость: реальная, уже выпущенная модель, с бенчмарками и ценами, совпадающими по нескольким независимым источникам, и ключевой датой (веса 27 июля) в будущем и поддающейся проверке. Значимо: первая модель с открытыми весами класса 3 триллионов, первое место в Frontend Code Arena выше проприетарных систем США, с чётким геополитическим контекстом.