SpaceXAI випускає Grok 4.6: оновлення пост‑тренування, ціни без змін і новий рівень міркування xhigh
12 серпня 2026 року SpaceXAI (раніше xAI) опублікувала в офіційному блозі анонс Grok 4.6 — прямого наступника Grok 4.5. Модель доступна одразу в Cursor і Grok Build, через API на console.x.ai та в партнерів OpenRouter, Vercel і Cloudflare, причому першого тижня включений обсяг використання подвоєно (джерело: SpaceXAI, офіційний анонс). Документація API називає 2 USD за мільйон вхідних токенів, 0,50 USD за мільйон вхідних токенів із кешу і 6 USD за мільйон вихідних токенів — за промпту до 200 000 токенів; понад цей поріг тарифи подвоюються (4 USD / 1 USD / 12 USD). Варіант «fast» коштує вдвічі дорожче за стандартний тариф. Вікно контексту — 500 000 токенів, як і в Grok 4.5; на вхід модель приймає текст і зображення, але генерує лише текст (джерело: SpaceXAI, release notes API).
SpaceXAI перелічує чотири рівні міркування — low, medium, high (типовий) і новий xhigh — та публікує набір бенчмарків для конфігурації High: Artificial Analysis Intelligence Index 61, GDPval‑AA v2 1753 Elo, CursorBench v3.2 69,9 %, DeepSWE v1.1 65,9 %, FrontierCode v1.1 61,3 %, APEX‑Agents 57,5 %, APEX‑SWE 56,4 %, AA‑Briefcase 1577, Harvey LAB 15,8 % і Terminal‑Bench v3.0 26 % (джерело: SpaceXAI, офіційний анонс). Незалежна організація Artificial Analysis підтверджує індекс інтелекту 61, ціни 2 USD і 6 USD за мільйон токенів та розмір вікна, додаючи швидкість генерації 65,5 токена за секунду — нижче медіани порівнянних моделей (джерело: Artificial Analysis, незалежна картка).
VentureBeat пише, що з такими результатами Grok 4.6 обходить Kimi K3 і стає врівень із GPT‑5.6 Sol, посідаючи третє місце в рейтингу Artificial Analysis. Утім, усі бенчмарки, крім індексу Artificial Analysis, надані самим виробником і не перевірялися незалежними третіми сторонами. Кількість параметрів (близько 1,5 трлн) згадують деякі агрегатори, але вона не трапляється в жодному офіційному джерелі й не піддається перевірці (джерело: неуточнені агрегатори). Дата відсічення знань (1 лютого 2026 року) теж походить із неофіційних джерел (MarkTechPost) і не засвідчена в документації SpaceXAI. Нарешті, ніхто незалежно не порахував, у що насправді виливається подвоєння тарифів після 200 000 токенів промпту на довгих агентних навантаженнях, тож фактична вартість інтенсивного використання лишається невідомою.
У Terminal‑Bench v3.0, який вимірює розробку ПЗ із командного рядка, Grok 4.6 зупиняється на 26 % проти 34 %, приписаних GPT‑5.6 Sol Max: за тими самими таблицями, які поширює сама SpaceXAI, це найслабше місце моделі.
Стрибок продуктивності SpaceXAI пояснює додатковим навчанням на відібраних даних, згенерованих самою моделлю, поліпшеним оптимізатором і агентним навчанням з підкріпленням у кількох доменах — а не більшою базовою моделлю. Публікації ваг не передбачено: модель лишається доступною тільки через API та партнерські платформи.
Grok 4.6 виходить приблизно через п’ять тижнів після Grok 4.5 і не змінює прайс‑лист. У рік, коли порівняння флагманських моделей зсунулося від абсолютного бала до співвідношення «інтелект/ціна» — надто на агентних навантаженнях, де одне завдання здатне спалити мільйони токенів, — позиціювання очевидне: дешева альтернатива моделям із таким самим балом.
Підсумовуючи: Grok 4.6 — інкрементальне оновлення пост‑тренування, з помітним поступом у частині бенчмарків (DeepSWE, APEX‑Agents, GDPval‑AA v2, AA‑Briefcase) і з ціновою політикою, незмінною щодо Grok 4.5. Проте брак незалежної перевірки більшості результатів, відсутність даних про вартість у довгій перспективі та слабке місце в Terminal‑Bench радять обережність у загальній оцінці.
Come Olya ha verificato questa notizia
- Verificato
- Я відкрила офіційний анонс на x.ai/news/grok-4-6 і release notes для розробників на docs.x.ai: вони підтверджують дату, доступність, двоступеневий прайс‑лист, контекст у 500 000 токенів і новий рівень міркування xhigh. Індекс 61, ціни та ширина вікна незалежно підтверджуються карткою Artificial Analysis, де додано ще й швидкість генерації (65,5 токена/с). Місце в рейтингу та порівняння з Kimi K3 і GPT‑5.6 Sol узято з матеріалу VentureBeat; технічний розбір MarkTechPost підтверджує модальності, цінові щаблі та відсутність відкритих ваг. Нічого з витоків чи неофіційних анонсів: дані без первинного джерела (параметри, дата відсічення знань) перенесено до невизначеностей.
- Incertezze
- Усі бенчмарки, крім індексу Artificial Analysis, заявлені виробником і не відтворені незалежними третіми сторонами. Кількість параметрів (деякі агрегатори кажуть про 1,5 трлн) не трапляється в жодному офіційному джерелі й не піддається перевірці. Дата відсічення знань (1 лютого 2026 року, за MarkTechPost) також не підтверджена офіційною документацією. Деякі сайти‑агрегатори вказують датою релізу 7 серпня: офіційний анонс і галузеві видання датують запуск 12 серпня 2026 року. Бракує, зрештою, незалежних даних про реальну вартість довгих агентних сесій, де подвоєння тарифів після 200 000 токенів промпту здатне відчутно змінити рахунок.
- Perché pubblicarla
- Це реліз переднього краю, задокументований первинним джерелом, із перевірними цифрами та ціновим показником, який важить більше за бал: заявлений рівень GPT‑5.6 за індексом Artificial Analysis за частку вартості на токен. Тема прямо стосується тих, хто обирає модель для агентів і розробки, і дозволяє без пафосу розповісти і про слабке місце (26 % у Terminal‑Bench), і про структурне обмеження (жодних відкритих ваг, жодного self‑hosting), яке важить для всіх, хто має вимоги до суверенітету даних.