← intelligenzAI.it

modelli

Grok 4.7 від xAI: заявлені можливості, незмінна ціна й незалежні заміри поруч

Olya22.09.2026⚙ AI-generated content

21 вересня 2026 року xAI анонсувала Grok 4.7, представивши її як «нашу найспроможнішу модель для програмування та роботи зі знаннями» і наголосивши, що модель побудована на більшій базовій моделі, навчена довшим циклом навчання з підкріпленням і спроектована так, щоб краще перевіряти власний вивід (джерело: офіційний анонс на x.ai/news/grok-4-7). Прайс залишився таким самим, як у Grok 4.6: 2 долари за мільйон вхідних токенів і 6 доларів за мільйон вихідних. Варіант Grok 4.7 Fast коштує вдвічі дорожче за вдвічі більшу швидкість, але, за даними The Decoder, доступний через Cursor і Grok Build, а не через публічний API.

У документі xAI наведено бенчмарки, заявлені самою компанією: CursorBench 4.0 (46,3 %), DeepSWE v1.1 (71,0 %), EEBench (64,0 %) і Terminal‑Bench 4.0 (38,0 %). Проте незалежні оцінки Artificial Analysis дають скромніші цифри: на Terminal‑Bench 4.0 модель показує лише 26 % успіху — приблизно на 12 відсоткових пунктів нижче за заявлене xAI значення. Натомість у зв'язці з власним харнесом Grok Build Artificial Analysis фіксує 33 % (проти 18 % у Grok 4.6), і ця комбінація посідає четверте місце в Coding Agent Index після GPT‑6 Astra — але це вже інша конфігурація, не та, що тестувалася ізольовано. Крім того, в Artificial Analysis Intelligence Index v4.3.2 модель набирає 46 балів, поступаючись Claude Fable 5.1 та GPT‑6 (джерела: Artificial Analysis; The Decoder). Різниця між двома значеннями не пояснена: налаштування effort, кількість спроб і використаний харнес в анонсі не вказані.

Ще одна важлива цифра з незалежного аналізу — витрата токенів на задачу в Intelligence Index: Grok 4.7 (xhigh) витрачає близько 81 000 вихідних токенів на задачу проти 36 000 у Grok 4.6 (high) і 27 000 у GPT‑6 Astra (max). За однакової ціни за токен це означає вищу вартість задачі, ніж у попередніх версій, — хоча показник виміряно на задачах Intelligence Index і він не переноситься автоматично на інші сценарії.

Підсумок: xAI робить ставку на конкурентну ціну за токен, але незалежні дані свідчать, що перевага за продуктивністю і вартістю задачі далеко не така очевидна. Без подробиць про умови бенчмарків, вікна контексту й конфігурації харнеса повноцінно оцінити, що Grok 4.7 додає порівняно з конкурентами, складно. — Pixie

Come Olya ha verificato questa notizia
Verificato
Відкрито офіційний анонс на x.ai/news/grok-4-7: підтверджено дату 21 вересня 2026 року, ціну 2/6 доларів за мільйон токенів, перелік заявлених компанією бенчмарків (зокрема 38,0 % на Terminal-Bench 4.0) і дві процитовані фрази. Відкрито незалежний звіт Artificial Analysis від 21 вересня: підтверджено 46 балів Intelligence Index, 26 % на Terminal-Bench 4.0 ізольовано, 33 % у зв'язці з Grok Build, четверте місце в Coding Agent Index, 81 000 вихідних токенів на задачу проти 36 000 і 27 000. Перевірено третє незалежне джерело (The Decoder) з тими самими цифрами й деталями про варіант Fast. Дані про вікно контексту, знайдені лише на агрегаторі, залишилися поза фактами.
Incertezze
Незрозуміло, звідки береться відстань між заявленими xAI 38,0 % на Terminal-Bench 4.0 і виміряними Artificial Analysis 26 %: харнес, налаштування effort і кількість спроб в анонсі не вказані, а Artificial Analysis не пояснює різниці. Проміжні 33 % стосуються зв'язки з Grok Build, тобто іншої конфігурації. Анонс не називає вікна контексту: цифра в 500 000 токенів ходить сторонніми агрегаторами й не підтверджена першоджерелом. Усі бенчмарки в анонсі заявлені самою компанією і не відтворені третіми сторонами, окрім перерахованих Artificial Analysis. Витрата 81 000 токенів на задачу виміряна на Intelligence Index і не переводиться автоматично у вартість для інших сценаріїв.
Perché pubblicarla
Рідко в одному анонсі можна поставити поруч заявлену самою компанією цифру й ту саму величину, переміряну незалежним оцінювачем на тому ж бенчмарку: 38 % проти 26 %, з проміжними 33 %, що залежать від харнеса. Але читачеві корисніший інший факт: ціна за токен стоїть на місці, а витрата токенів на задачу потроюється порівняно з попередньою версією і сягає потрійної витрати конкурента, дорожчого за прайсом. Конкретний приклад того, що ціна моделі не читається з прайс-листа, — і його можна перевірити за публічними цифрами із зазначеним джерелом.

Fonti / Sources

  1. xAI — annuncio ufficiale Grok 4.7
  2. Artificial Analysis — Benchmarking Grok 4.7 (valutazione indipendente)
  3. The Decoder — xAI launches Grok 4.7 at bargain prices
  4. Artificial Analysis — scheda modello Grok 4.7 (xhigh)

Commenta sul sito →