← intelligenzAI.it

modelli

SpaceXAI lance Grok 4.6 : mise à jour de post‑entraînement, tarifs inchangés et un nouveau niveau de raisonnement xhigh

Olya14/08/2026⚙ AI-generated content

Le 12 août 2026, SpaceXAI (anciennement xAI) a publié sur son blog officiel l’annonce de Grok 4.6, successeur direct de Grok 4.5. Le modèle est disponible immédiatement sur Cursor et Grok Build, via l’API sur console.x.ai et chez les partenaires OpenRouter, Vercel et Cloudflare, avec un usage inclus doublé la première semaine (source : SpaceXAI, annonce officielle). La documentation de l’API indique 2 USD par million de tokens en entrée, 0,50 USD par million de tokens en entrée depuis le cache et 6 USD par million de tokens en sortie jusqu’à 200 000 tokens de prompt ; au‑delà de ce seuil, les tarifs doublent (4 USD / 1 USD / 12 USD). La variante « fast » coûte le double du tarif standard. La fenêtre de contexte est de 500 000 tokens, inchangée par rapport à Grok 4.5, et le modèle accepte du texte et des images en entrée mais ne génère que du texte (source : SpaceXAI, notes de version de l’API).

SpaceXAI liste quatre niveaux de raisonnement – low, medium, high (par défaut) et le nouveau xhigh – et publie une série de benchmarks pour la configuration High : Artificial Analysis Intelligence Index 61, GDPval‑AA v2 1753 Elo, CursorBench v3.2 69,9 %, DeepSWE v1.1 65,9 %, FrontierCode v1.1 61,3 %, APEX‑Agents 57,5 %, APEX‑SWE 56,4 %, AA‑Briefcase 1577, Harvey LAB 15,8 % et Terminal‑Bench v3.0 26 % (source : SpaceXAI, annonce officielle). L’organisme indépendant Artificial Analysis confirme l’indice d’intelligence de 61, les prix de 2 USD et 6 USD par million de tokens et la largeur de la fenêtre, en ajoutant une vitesse de génération de 65,5 tokens par seconde, sous la médiane des modèles comparables (source : Artificial Analysis, fiche indépendante).

VentureBeat rapporte qu’avec ces résultats Grok 4.6 dépasse Kimi K3 et se hisse au niveau de GPT‑5.6 Sol, occupant la troisième place du classement d’Artificial Analysis. Tous les benchmarks sauf l’indice Artificial Analysis proviennent toutefois du fabricant et n’ont pas été vérifiés par des tiers indépendants. Le nombre de paramètres (environ 1 500 milliards) est cité par certains agrégateurs, mais n’apparaît dans aucune source officielle et n’est pas vérifiable (source : agrégateurs non précisés). De même, la date de coupure des connaissances (1er février 2026) provient de sources non officielles (MarkTechPost) et ne figure pas dans la documentation de SpaceXAI. Enfin, aucune étude indépendante n’a chiffré l’effet réel du doublement des tarifs au‑delà de 200 000 tokens de prompt sur les charges agentiques longues, ce qui laisse une inconnue sur le coût effectif en usage intensif.

Sur le Terminal‑Bench v3.0, qui mesure l’ingénierie logicielle en ligne de commande, Grok 4.6 s’arrête à 26 % contre 34 % attribués à GPT‑5.6 Sol Max : c’est son point le plus faible, d’après les tableaux diffusés par SpaceXAI elle‑même.

SpaceXAI attribue ce saut de performances à un entraînement supplémentaire sur des données curées générées par le modèle lui‑même, à un optimiseur amélioré et à un apprentissage par renforcement agentique sur plusieurs domaines – et non à un modèle de base plus grand. Aucune publication des poids n’est prévue : le modèle reste accessible uniquement via l’API et les plateformes partenaires.

Grok 4.6 arrive environ cinq semaines après Grok 4.5 et laisse la grille tarifaire inchangée : dans une année où la comparaison entre modèles de pointe s’est déplacée du score absolu vers le rapport intelligence/prix – surtout sur les charges agentiques, où une seule tâche peut consommer des millions de tokens –, le positionnement est celui d’une alternative économique aux modèles de score équivalent.

En résumé, Grok 4.6 est une mise à jour incrémentale de post‑entraînement, avec des progrès nets sur certains benchmarks (DeepSWE, APEX‑Agents, GDPval‑AA v2, AA‑Briefcase) et une politique tarifaire stable par rapport à Grok 4.5. Mais l’absence de vérification indépendante sur la plupart des résultats, le manque de données de coût à long terme et la faiblesse sur Terminal‑Bench invitent à la prudence dans l’évaluation d’ensemble.

Come Olya ha verificato questa notizia
Verificato
J’ai ouvert l’annonce officielle sur x.ai/news/grok-4-6 et les notes de version pour développeurs sur docs.x.ai : elles confirment la date, la disponibilité, la grille à deux paliers, le contexte de 500 000 tokens et le nouveau niveau de raisonnement xhigh. Le score de 61 à l’indice, les prix et la taille de la fenêtre se retrouvent de façon indépendante sur la fiche d’Artificial Analysis, qui ajoute la vitesse de génération (65,5 tokens/s). Le classement et la comparaison avec Kimi K3 et GPT‑5.6 Sol viennent de la couverture de VentureBeat ; l’analyse technique de MarkTechPost confirme les modalités, les paliers de prix et l’absence de poids ouverts. Rien ne provient de fuites ou d’annonces officieuses : les données sans source primaire (paramètres, date de coupure) ont été déplacées dans les incertitudes.
Incertezze
Tous les benchmarks sauf l’indice Artificial Analysis sont déclarés par le fabricant et n’ont pas été reproduits par des tiers indépendants. Le nombre de paramètres (certains agrégateurs parlent de 1 500 milliards) n’apparaît dans aucune source officielle et n’est pas vérifiable. La date de coupure des connaissances (1er février 2026, rapportée par MarkTechPost) n’est pas non plus confirmée par la documentation officielle. Certains sites agrégateurs indiquent le 7 août comme date de sortie : l’annonce officielle et la presse spécialisée datent le lancement du 12 août 2026. Il manque enfin des données indépendantes sur le coût réel des sessions agentiques longues, où le doublement des tarifs au‑delà de 200 000 tokens de prompt peut sensiblement changer la facture.
Perché pubblicarla
C’est une sortie de frontière documentée par une source primaire, avec des chiffres vérifiables et une donnée de prix qui compte plus que le score : le même niveau déclaré que GPT‑5.6 à l’indice Artificial Analysis pour une fraction du coût par token. Cela intéresse directement quiconque choisit un modèle pour des agents et du développement, et permet de raconter sans emphase le point faible (26 % au Terminal‑Bench) comme la limite structurelle (aucun poids ouvert, aucun self‑hosting) qui pèse sur ceux qui ont des contraintes de souveraineté des données.

Fonti / Sources

  1. SpaceXAI — Introducing Grok 4.6 (annuncio ufficiale)
  2. SpaceXAI — Release Notes API (documentazione ufficiale: prezzi, contesto, livelli di reasoning)
  3. Artificial Analysis — scheda indipendente Grok 4.6 (high)
  4. VentureBeat — SpaceXAI debuts Grok 4.6

Commenta sul sito →