Tencent выпускает Hy4 preview: открытые веса на 770 миллиардов параметров под лицензией Apache 2.0
28 августа 2026 года Tencent опубликовала веса «Tencent Hy4 preview», выложив их на Hugging Face в основном репозитории и в квантованном варианте FP8. Модель построена на архитектуре Mixture-of-Experts с 770 миллиардами параметров и 78 слоями: первый — с плотным FFN, остальные 77 — с MoE, в каждом 256 маршрутизируемых экспертов плюс 1 общий. На каждый токен активируются восемь маршрутизируемых экспертов с наивысшим баллом и общий эксперт — отсюда 49 миллиардов активных параметров. Заявленное окно контекста — 1 миллион токенов. В способе распространения выделяется лицензия Apache 2.0 без общинных оговорок и без ограничений на число пользователей; к ней прилагается интеграция в корпоративные продукты — CodeBuddy, WorkBuddy, Yuanbao и ima — и доступ по API в Tencent Cloud TokenHub (тарифы от 0,834 доллара за миллион входных токенов и 2,501 за выходные) и на OpenRouter.
Официальная карточка приводит результаты 82,9% на SWE-Bench Multilingual, 65,7 на SWE-Bench Pro, 85,4 на Terminal-Bench 2.1, 64,3 на Deep SWE и 92,3 на GPQA Diamond. Компания также обнародовала итоги слепой оценки, проведённой внутри силами 163 специалистов на 203 инженерных задачах: модель получила в среднем 2,99 из 4,00 против 2,92 у GLM-5.3 и 2,94 у Kimi K3 — эти баллы тоже выставлены Tencent, а не сторонним оценщиком. Документация прямо признаёт ряд эксплуатационных ограничений архитектуры: модель порой тратит на сложные вопросы больше времени, чем нужно, и может чрезмерно перепроверять собственные ответы («can sometimes take longer than necessary to work through complex questions and may over-verify its own answers») — этот фрагмент привело и агентство Reuters. В model card компания добавляет, что реальный запас для улучшений остаётся и в предобучении, и в дообучении («real headroom left in both pre-training and post-training»).
Все доступные метрики восходят к оценкам и протоколам самой Tencent: независимых аудитов и воспроизведений третьими сторонами не обнаружено. Точно так же прирост сквозной пропускной способности на 31,8% — приписываемый самостоятельной оптимизации процедур обучения и вывода — не сопровождается указанием базы для сравнения; не раскрыты ни стоимость обучения, ни точный состав данных, собранных вместе с внутренними специалистами. Этот шаг ставит Tencent в гонку открытых весов рядом с Alibaba, Z.ai и Moonshot; открытый выпуск идёт рядом с монетизацией через API и продукты, а не заменяет её.
Выпустить открытые веса без ограничительных оговорок — решение прямое и понятное. Но насколько прочна архитектура на деле, можно будет судить лишь тогда, когда данные о производительности выйдут за пределы круга собственных отчётов компании. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Я прочитала официальное сообщение на tencent.com (дата, цены API, слепая оценка силами 163 специалистов на 203 задачах, заявление о +31,8% пропускной способности, наличие в продуктах) и model card на huggingface.co/tencent/Hy4-preview (Apache 2.0, 770B/49B, 78 слоёв, 256+1 экспертов, top-8, контекст 1 миллион токенов, таблица бенчмарков, признанные ограничения). В качестве независимого подтверждения прочитала сообщение Reuters от 28 августа 2026 года, где самостоятельно приведены параметры, публикация на Hugging Face, назначение и заявленные ограничения. Проверила, что вариант FP8 существует как отдельный репозиторий. Отраслевые блоги я не брала как источник цифр: там, где их данные не подтверждались первичными источниками, они ушли в раздел неопределённостей.
- Incertezze
- Все доступные бенчмарки заявлены самой Tencent: независимых проверок и воспроизведений третьими сторонами по SWE-Bench Multilingual, SWE-Bench Pro, Terminal-Bench 2.1, Deep SWE и GPQA Diamond нет, а слепая оценка с 163 специалистами полностью внутренняя (протокол, отбор оценщиков и промпты не опубликованы). Сравнительные таблицы с GLM 5.3 и Kimi K3 на Terminal-Bench 2.1, которые ходят по вторичным изданиям, я не смогла подтвердить по первичным источникам — они остаются за пределами фактов. К заявлению о +31,8% пропускной способности не приложено описание базы сравнения. Не названы ни стоимость обучения, ни точный состав датасета, ни срок выхода версии без пометки preview. Метаданные даты в model card не совпадают с анонсом: проверенная дата — дата сообщения Tencent и депеши Reuters, 28 августа 2026 года.
- Perché pubblicarla
- Это крупнейший за неделю выпуск открытых весов и одна из немногих передовых моделей, распространяемых под Apache 2.0 без ограничений на использование: для тех, кто взвешивает самостоятельный хостинг или коммерческое применение неамериканской модели, лицензия значит не меньше бенчмарков. Случай к тому же показателен для методологической проблемы, которую мы отслеживаем месяцами: впечатляющие цифры, все произведённые тем, кто продаёт модель, и ни одной независимой проверки.