SpaceXAI выпускает Grok 4.6: обновление пост‑обучения, прежние цены и новый уровень рассуждения xhigh
12 августа 2026 года SpaceXAI (ранее xAI) опубликовала в официальном блоге анонс Grok 4.6 — прямого преемника Grok 4.5. Модель доступна сразу в Cursor и Grok Build, через API на console.x.ai и у партнёров OpenRouter, Vercel и Cloudflare, причём в первую неделю включённый объём использования удвоен (источник: SpaceXAI, официальный анонс). В документации API указаны 2 USD за миллион входных токенов, 0,50 USD за миллион входных токенов из кеша и 6 USD за миллион выходных токенов — при промпте до 200 000 токенов; сверх этого порога тарифы удваиваются (4 USD / 1 USD / 12 USD). Вариант «fast» стоит вдвое дороже стандартного тарифа. Окно контекста — 500 000 токенов, как и у Grok 4.5; на вход модель принимает текст и изображения, но генерирует только текст (источник: SpaceXAI, release notes API).
SpaceXAI перечисляет четыре уровня рассуждения — low, medium, high (по умолчанию) и новый xhigh — и публикует набор бенчмарков для конфигурации High: Artificial Analysis Intelligence Index 61, GDPval‑AA v2 1753 Elo, CursorBench v3.2 69,9 %, DeepSWE v1.1 65,9 %, FrontierCode v1.1 61,3 %, APEX‑Agents 57,5 %, APEX‑SWE 56,4 %, AA‑Briefcase 1577, Harvey LAB 15,8 % и Terminal‑Bench v3.0 26 % (источник: SpaceXAI, официальный анонс). Независимая организация Artificial Analysis подтверждает индекс интеллекта 61, цены в 2 USD и 6 USD за миллион токенов и размер окна, добавляя скорость генерации 65,5 токена в секунду — ниже медианы сопоставимых моделей (источник: Artificial Analysis, независимая карточка).
VentureBeat пишет, что с такими результатами Grok 4.6 обходит Kimi K3 и встаёт вровень с GPT‑5.6 Sol, занимая третье место в рейтинге Artificial Analysis. Однако все бенчмарки, кроме индекса Artificial Analysis, предоставлены самим производителем и не проверялись независимыми третьими сторонами. Число параметров (около 1,5 трлн) упоминают некоторые агрегаторы, но оно не встречается ни в одном официальном источнике и не поддаётся проверке (источник: неуточнённые агрегаторы). Дата отсечения знаний (1 февраля 2026 года) тоже взята из неофициальных источников (MarkTechPost) и не подтверждена документацией SpaceXAI. Наконец, никто независимо не посчитал, во что реально выливается удвоение тарифов после 200 000 токенов промпта на длинных агентных нагрузках, так что фактическая стоимость интенсивного использования остаётся неизвестной.
В Terminal‑Bench v3.0, который измеряет разработку ПО из командной строки, Grok 4.6 останавливается на 26 % против 34 % у GPT‑5.6 Sol Max: по тем же таблицам, что распространяет сама SpaceXAI, это самое слабое место модели.
Скачок в производительности SpaceXAI объясняет дополнительным обучением на отобранных данных, сгенерированных самой моделью, улучшенным оптимизатором и агентным обучением с подкреплением в нескольких доменах — а не более крупной базовой моделью. Публикация весов не планируется: модель остаётся доступной только через API и партнёрские платформы.
Grok 4.6 выходит примерно через пять недель после Grok 4.5 и не меняет прайс‑лист. В год, когда сравнение флагманских моделей сместилось от абсолютного балла к соотношению «интеллект/цена» — особенно на агентных нагрузках, где одна задача способна сжечь миллионы токенов, — позиционирование получается ясным: недорогая альтернатива моделям с тем же баллом.
Итого: Grok 4.6 — инкрементальное обновление пост‑обучения, с заметным прогрессом в части бенчмарков (DeepSWE, APEX‑Agents, GDPval‑AA v2, AA‑Briefcase) и с ценовой политикой, неизменной относительно Grok 4.5. Но отсутствие независимой проверки большинства результатов, нехватка данных о стоимости в долгую и слабое место в Terminal‑Bench требуют осторожности в общей оценке.
Come Olya ha verificato questa notizia
- Verificato
- Я открыла официальный анонс на x.ai/news/grok-4-6 и release notes для разработчиков на docs.x.ai: они подтверждают дату, доступность, двухступенчатый прайс‑лист, контекст в 500 000 токенов и новый уровень рассуждения xhigh. Индекс 61, цены и ширина окна независимо подтверждаются карточкой Artificial Analysis, где добавлена и скорость генерации (65,5 токена/с). Место в рейтинге и сравнение с Kimi K3 и GPT‑5.6 Sol взяты из материала VentureBeat; технический разбор MarkTechPost подтверждает модальности, ценовые ступени и отсутствие открытых весов. Ничего из утечек и неофициальных анонсов: данные без первичного источника (параметры, дата отсечения знаний) перенесены в раздел неопределённостей.
- Incertezze
- Все бенчмарки, кроме индекса Artificial Analysis, заявлены производителем и не воспроизведены независимыми третьими сторонами. Число параметров (некоторые агрегаторы говорят о 1,5 трлн) не встречается ни в одном официальном источнике и не проверяемо. Дата отсечения знаний (1 февраля 2026 года, по данным MarkTechPost) официальной документацией тоже не подтверждена. Некоторые сайты‑агрегаторы указывают датой выхода 7 августа: официальный анонс и отраслевые издания датируют запуск 12 августа 2026 года. Наконец, нет независимых данных о реальной стоимости длинных агентных сессий, где удвоение тарифов после 200 000 токенов промпта способно ощутимо изменить счёт.
- Perché pubblicarla
- Это релиз переднего края, подтверждённый первичным источником, с проверяемыми цифрами и с ценовым параметром, который значит больше, чем балл: заявленный уровень GPT‑5.6 по индексу Artificial Analysis при доле стоимости за токен. Тема напрямую касается тех, кто выбирает модель для агентов и разработки, и позволяет без пафоса рассказать и о слабом месте (26 % в Terminal‑Bench), и о структурном ограничении (никаких открытых весов, никакого self‑hosting), которое важно для всех, у кого есть требования к суверенитету данных.