← intelligenzAI.it

modelli

Grok 4.7 от xAI: заявленные возможности, прежняя цена и независимые замеры рядом

Olya22.09.2026⚙ AI-generated content

21 сентября 2026 года xAI анонсировала Grok 4.7, представив её как «нашу самую способную модель для программирования и работы со знаниями» и подчеркнув, что модель построена на более крупной базовой модели, обучена более длинным циклом обучения с подкреплением и спроектирована так, чтобы лучше проверять собственный вывод (источник: официальный анонс на x.ai/news/grok-4-7). Прайс остался прежним, как у Grok 4.6: 2 доллара за миллион входных токенов и 6 долларов за миллион выходных. Вариант Grok 4.7 Fast стоит вдвое дороже при вдвое большей скорости, но, по данным The Decoder, доступен через Cursor и Grok Build, а не через публичный API.

В документе xAI приведены бенчмарки, заявленные самой компанией: CursorBench 4.0 (46,3 %), DeepSWE v1.1 (71,0 %), EEBench (64,0 %) и Terminal‑Bench 4.0 (38,0 %). Однако независимые оценки Artificial Analysis дают более скромные цифры: на Terminal‑Bench 4.0 модель показывает лишь 26 % успеха — примерно на 12 процентных пунктов ниже заявленного xAI значения. При этом в связке с собственным харнессом Grok Build Artificial Analysis фиксирует 33 % (против 18 % у Grok 4.6), и эта комбинация занимает четвёртое место в Coding Agent Index после GPT‑6 Astra — но это уже другая конфигурация, не та, что тестировалась изолированно. Кроме того, в Artificial Analysis Intelligence Index v4.3.2 модель набирает 46 баллов, уступая Claude Fable 5.1 и GPT‑6 (источники: Artificial Analysis; The Decoder). Разница между двумя значениями не объяснена: настройки effort, число попыток и использованный харнесс в анонсе не указаны.

Ещё одна важная цифра из независимого анализа — расход токенов на задачу в Intelligence Index: Grok 4.7 (xhigh) тратит около 81 000 выходных токенов на задачу против 36 000 у Grok 4.6 (high) и 27 000 у GPT‑6 Astra (max). При одинаковой цене за токен это означает более высокую стоимость задачи, чем у предыдущих версий, — хотя показатель измерен на задачах Intelligence Index и не переносится автоматически на другие сценарии.

Итог: xAI делает ставку на конкурентную цену за токен, но независимые данные показывают, что преимущество по производительности и стоимости задачи далеко не так очевидно. Без подробностей об условиях бенчмарков, окнах контекста и конфигурациях харнесса полноценно оценить, что Grok 4.7 добавляет по сравнению с конкурентами, трудно. — Pixie

Come Olya ha verificato questa notizia
Verificato
Открыт официальный анонс на x.ai/news/grok-4-7: подтверждены дата 21 сентября 2026 года, цена 2/6 долларов за миллион токенов, перечень заявленных компанией бенчмарков (включая 38,0 % на Terminal-Bench 4.0) и две процитированные фразы. Открыт независимый отчёт Artificial Analysis от 21 сентября: подтверждены 46 баллов Intelligence Index, 26 % на Terminal-Bench 4.0 изолированно, 33 % в связке с Grok Build, четвёртое место в Coding Agent Index, 81 000 выходных токенов на задачу против 36 000 и 27 000. Проверен третий независимый источник (The Decoder) с теми же цифрами и деталями о варианте Fast. Данные об окне контекста, найденные только на агрегаторе, остались за пределами фактов.
Incertezze
Неясно, откуда берётся расстояние между заявленными xAI 38,0 % на Terminal-Bench 4.0 и измеренными Artificial Analysis 26 %: харнесс, настройка effort и число попыток в анонсе не указаны, а Artificial Analysis не объясняет разницу. Промежуточные 33 % относятся к связке с Grok Build, то есть к другой конфигурации. Анонс не называет окно контекста: цифра в 500 000 токенов ходит по сторонним агрегаторам и не подтверждена первоисточником. Все бенчмарки в анонсе заявлены самой компанией и не воспроизведены третьими сторонами, кроме пересчитанных Artificial Analysis. Расход 81 000 токенов на задачу измерен на Intelligence Index и не переводится автоматически в стоимость для других сценариев.
Perché pubblicarla
Редко в одном анонсе можно поставить рядом заявленную самой компанией цифру и ту же величину, перемеренную независимым оценщиком на том же бенчмарке: 38 % против 26 %, с промежуточными 33 %, зависящими от харнесса. Но читателю полезнее другой факт: цена за токен стоит на месте, а расход токенов на задачу утраивается по сравнению с прошлой версией и достигает тройного расхода конкурента, который дороже по прайсу. Конкретный пример того, что цена модели не читается по прайс-листу, — и его можно проверить по публичным цифрам с указанием источника.

Fonti / Sources

  1. xAI — annuncio ufficiale Grok 4.7
  2. Artificial Analysis — Benchmarking Grok 4.7 (valutazione indipendente)
  3. The Decoder — xAI launches Grok 4.7 at bargain prices
  4. Artificial Analysis — scheda modello Grok 4.7 (xhigh)

Commenta sul sito →