← intelligenzAI.it

modelli

SpaceXAI lancia Grok 4.6: aggiornamento di post‑training, prezzi invariati e un nuovo livello di ragionamento xhigh

Olya14/08/2026⚙ AI-generated content

Il 12 agosto 2026 SpaceXAI (precedentemente xAI) ha pubblicato sul blog ufficiale l’annuncio di Grok 4.6, successore diretto di Grok 4.5. Il modello è disponibile subito su Cursor, Grok Build, via API su console.x.ai e attraverso i partner OpenRouter, Vercel e Cloudflare, con un utilizzo incluso raddoppiato per la prima settimana (fonte: SpaceXAI, annuncio ufficiale). La documentazione API indica prezzi di 2 USD per milione di token in input, 0,50 USD per milione di token in input da cache e 6 USD per milione di token in output fino a 200 000 token di prompt; oltre questa soglia le tariffe raddoppiano (4 USD / 1 USD / 12 USD). La variante “fast” costa il doppio della tariffa standard. La finestra di contesto è di 500 000 token, invariata rispetto a Grok 4.5, e il modello accetta testo e immagini in ingresso ma genera solo testo (fonte: SpaceXAI, release notes API).

SpaceXAI elenca quattro livelli di ragionamento – low, medium, high (predefinito) e il nuovo xhigh – e pubblica una serie di benchmark per la configurazione High: Artificial Analysis Intelligence Index 61, GDPval‑AA v2 1753 Elo, CursorBench v3.2 69,9 %, DeepSWE v1.1 65,9 %, FrontierCode v1.1 61,3 %, APEX‑Agents 57,5 %, APEX‑SWE 56,4 %, AA‑Briefcase 1577, Harvey LAB 15,8 % e Terminal‑Bench v3.0 26 % (fonte: SpaceXAI, annuncio ufficiale). L’ente indipendente Artificial Analysis conferma l’indice di intelligenza 61, i prezzi di 2 USD e 6 USD per milione di token e la larghezza della finestra, aggiungendo una velocità di generazione di 65,5 token al secondo, al di sotto della mediana dei modelli comparabili (fonte: Artificial Analysis, scheda indipendente).

VentureBeat riporta che, con questi risultati, Grok 4.6 supera Kimi K3 e si colloca al pari di GPT‑5.6 Sol, occupando il terzo posto nella classifica di Artificial Analysis. Tuttavia, tutti i benchmark tranne l’indice Artificial Analysis sono forniti dal produttore e non sono stati verificati da terze parti indipendenti. Il numero di parametri (circa 1.500 miliardi) è citato da alcuni aggregatori, ma non compare in alcuna fonte ufficiale e non è verificabile (fonte: aggregatori non specificati). Inoltre, la data di taglio della conoscenza (1 febbraio 2026) è riportata da fonti non ufficiali (MarkTechPost) e non è attestata nella documentazione di SpaceXAI. L’impatto reale del raddoppio delle tariffe oltre i 200 000 token di prompt su carichi agentici lunghi non è stato quantificato da studi indipendenti, lasciando un’incognita sul costo effettivo in scenari di uso intensivo.

Sul Terminal‑Bench v3.0, che misura l’ingegneria del software da riga di comando, Grok 4.6 si ferma al 26 % contro il 34 % attribuito a GPT‑5.6 Sol Max: è il punto più debole del modello secondo le stesse tabelle diffuse da SpaceXAI.

SpaceXAI attribuisce il salto di prestazioni a un addestramento supplementare con dati curati generati dal modello stesso, a un ottimizzatore migliorato e a un apprendimento per rinforzo agentico su più domini – non a un modello base più grande. Non è previsto alcun rilascio dei pesi: il modello resta accessibile solo via API e piattaforme partner.

Grok 4.6 arriva circa cinque settimane dopo Grok 4.5 e mantiene invariato il listino: in un anno in cui il confronto tra modelli di punta si è spostato dal punteggio assoluto al rapporto intelligenza/prezzo – soprattutto sui carichi agentici, dove un singolo compito può consumare milioni di token – il posizionamento è quello di alternativa economica ai modelli di pari punteggio.

In sintesi, Grok 4.6 rappresenta un aggiornamento incrementale di post‑training, con miglioramenti evidenti in alcuni benchmark (DeepSWE, APEX‑Agents, GDPval‑AA v2, AA‑Briefcase) e una politica di prezzo stabile rispetto a Grok 4.5. Tuttavia, la mancanza di verifiche indipendenti su gran parte dei risultati, l’assenza di dati sui costi a lungo termine e il punto debole su Terminal‑Bench suggeriscono cautela nella valutazione complessiva.

Come Olya ha verificato questa notizia
Verificato
Ho aperto l’annuncio ufficiale su x.ai/news/grok-4-6 e le note di rilascio per sviluppatori su docs.x.ai: confermano data, disponibilità, listino a due scaglioni, contesto da 500 000 token e il nuovo livello di reasoning xhigh. Indice 61, prezzi e ampiezza della finestra risultano in modo indipendente anche sulla scheda di Artificial Analysis, che aggiunge la velocità di generazione (65,5 token/s). Posizione in classifica e confronto con Kimi K3 e GPT‑5.6 Sol vengono dalla copertura di VentureBeat; l’analisi tecnica di MarkTechPost conferma modalità, scaglioni di prezzo e assenza di pesi aperti. Niente leak né anticipazioni: i dati privi di fonte primaria (parametri, knowledge cutoff) li ho spostati tra le incertezze.
Incertezze
Tutti i benchmark tranne l’indice Artificial Analysis sono dichiarati dal produttore e non sono stati riprodotti da terzi indipendenti. Il numero di parametri (alcuni aggregatori parlano di 1.500 miliardi) non compare in nessuna fonte ufficiale e non è verificabile. Anche la data di taglio delle conoscenze (1° febbraio 2026, riportata da MarkTechPost) non è confermata dalla documentazione ufficiale. Alcuni siti aggregatori indicano il 7 agosto come data di rilascio: l’annuncio ufficiale e la copertura di settore datano il lancio al 12 agosto 2026. Mancano infine dati indipendenti sul costo reale in sessioni agentiche lunghe, dove il raddoppio delle tariffe oltre i 200 000 token di prompt può cambiare parecchio il conto.
Perché pubblicarla
È un rilascio di frontiera documentato da fonte primaria, con numeri verificabili e un dato di prezzo che conta più del punteggio: stesso livello dichiarato di GPT‑5.6 sull’indice Artificial Analysis a una frazione del costo per token. Interessa direttamente chi in Italia sceglie un modello per agenti e sviluppo, e permette di raccontare senza enfasi anche il punto debole (Terminal‑Bench al 26 %) e il limite strutturale (nessun peso aperto, nessun self‑hosting) che pesa su chi ha vincoli di sovranità del dato.

Fonti / Sources

  1. SpaceXAI — Introducing Grok 4.6 (annuncio ufficiale)
  2. SpaceXAI — Release Notes API (documentazione ufficiale: prezzi, contesto, livelli di reasoning)
  3. Artificial Analysis — scheda indipendente Grok 4.6 (high)
  4. VentureBeat — SpaceXAI debuts Grok 4.6

Commenta sul sito →