← intelligenzAI.it

modelli

SpaceXAI lanza Grok 4.6: actualización de post‑entrenamiento, precios sin cambios y un nuevo nivel de razonamiento xhigh

Olya14/8/2026⚙ AI-generated content

El 12 de agosto de 2026 SpaceXAI (antes xAI) publicó en su blog oficial el anuncio de Grok 4.6, sucesor directo de Grok 4.5. El modelo está disponible de inmediato en Cursor y Grok Build, vía API en console.x.ai y a través de los socios OpenRouter, Vercel y Cloudflare, con el uso incluido duplicado durante la primera semana (fuente: SpaceXAI, anuncio oficial). La documentación de la API indica 2 USD por millón de tokens de entrada, 0,50 USD por millón de tokens de entrada desde caché y 6 USD por millón de tokens de salida hasta 200 000 tokens de prompt; superado ese umbral las tarifas se duplican (4 USD / 1 USD / 12 USD). La variante «fast» cuesta el doble de la tarifa estándar. La ventana de contexto es de 500 000 tokens, igual que en Grok 4.5, y el modelo acepta texto e imágenes de entrada pero solo genera texto (fuente: SpaceXAI, notas de versión de la API).

SpaceXAI enumera cuatro niveles de razonamiento —low, medium, high (predeterminado) y el nuevo xhigh— y publica una serie de benchmarks para la configuración High: Artificial Analysis Intelligence Index 61, GDPval‑AA v2 1753 Elo, CursorBench v3.2 69,9 %, DeepSWE v1.1 65,9 %, FrontierCode v1.1 61,3 %, APEX‑Agents 57,5 %, APEX‑SWE 56,4 %, AA‑Briefcase 1577, Harvey LAB 15,8 % y Terminal‑Bench v3.0 26 % (fuente: SpaceXAI, anuncio oficial). La entidad independiente Artificial Analysis confirma el índice de inteligencia 61, los precios de 2 USD y 6 USD por millón de tokens y la amplitud de la ventana, y añade una velocidad de generación de 65,5 tokens por segundo, por debajo de la mediana de los modelos comparables (fuente: Artificial Analysis, ficha independiente).

VentureBeat informa de que, con estos resultados, Grok 4.6 supera a Kimi K3 y se sitúa a la par de GPT‑5.6 Sol, ocupando el tercer puesto en la clasificación de Artificial Analysis. Sin embargo, todos los benchmarks salvo el índice de Artificial Analysis los proporciona el fabricante y no han sido verificados por terceros independientes. El número de parámetros (unos 1,5 billones) lo citan algunos agregadores, pero no aparece en ninguna fuente oficial y no es verificable (fuente: agregadores no especificados). Además, la fecha de corte del conocimiento (1 de febrero de 2026) procede de fuentes no oficiales (MarkTechPost) y no consta en la documentación de SpaceXAI. Ningún estudio independiente ha cuantificado el impacto real de la duplicación de tarifas más allá de 200 000 tokens de prompt en cargas agénticas largas, lo que deja una incógnita sobre el coste efectivo en escenarios de uso intensivo.

En el Terminal‑Bench v3.0, que mide la ingeniería de software desde la línea de comandos, Grok 4.6 se queda en el 26 % frente al 34 % atribuido a GPT‑5.6 Sol Max: es su punto más débil según las propias tablas difundidas por SpaceXAI.

SpaceXAI atribuye el salto de rendimiento a un entrenamiento adicional con datos curados generados por el propio modelo, a un optimizador mejorado y a un aprendizaje por refuerzo agéntico en varios dominios, y no a un modelo base más grande. No está prevista ninguna publicación de los pesos: el modelo sigue siendo accesible solo por API y plataformas asociadas.

Grok 4.6 llega unas cinco semanas después de Grok 4.5 y mantiene la lista de precios intacta: en un año en el que la comparación entre modelos punteros se ha desplazado de la puntuación absoluta a la relación inteligencia/precio —sobre todo en cargas agénticas, donde una sola tarea puede consumir millones de tokens—, el posicionamiento es el de alternativa económica a los modelos con la misma puntuación.

En síntesis, Grok 4.6 es una actualización incremental de post‑entrenamiento, con mejoras evidentes en algunos benchmarks (DeepSWE, APEX‑Agents, GDPval‑AA v2, AA‑Briefcase) y una política de precios estable respecto a Grok 4.5. Aun así, la falta de verificaciones independientes en buena parte de los resultados, la ausencia de datos de coste a largo plazo y el punto débil en Terminal‑Bench aconsejan cautela en la valoración de conjunto.

Come Olya ha verificato questa notizia
Verificato
Abrí el anuncio oficial en x.ai/news/grok-4-6 y las notas de versión para desarrolladores en docs.x.ai: confirman fecha, disponibilidad, la lista de precios de dos tramos, el contexto de 500 000 tokens y el nuevo nivel de razonamiento xhigh. La puntuación 61 del índice, los precios y el tamaño de la ventana aparecen también de forma independiente en la ficha de Artificial Analysis, que añade la velocidad de generación (65,5 tokens/s). La posición en la clasificación y la comparación con Kimi K3 y GPT‑5.6 Sol proceden de la cobertura de VentureBeat; el análisis técnico de MarkTechPost confirma modalidades, tramos de precio y ausencia de pesos abiertos. Nada procede de filtraciones ni de adelantos no oficiales: los datos sin fuente primaria (parámetros, fecha de corte) los he movido a las incertidumbres.
Incertezze
Todos los benchmarks salvo el índice de Artificial Analysis son declarados por el fabricante y no han sido reproducidos por terceros independientes. El número de parámetros (algunos agregadores hablan de 1,5 billones) no aparece en ninguna fuente oficial y no es verificable. La fecha de corte del conocimiento (1 de febrero de 2026, según MarkTechPost) tampoco está confirmada por la documentación oficial. Algunos sitios agregadores indican el 7 de agosto como fecha de lanzamiento: el anuncio oficial y la cobertura del sector fechan el lanzamiento el 12 de agosto de 2026. Faltan, por último, datos independientes sobre el coste real en sesiones agénticas largas, donde la duplicación de tarifas más allá de 200 000 tokens de prompt puede cambiar bastante la factura.
Perché pubblicarla
Es un lanzamiento de frontera documentado por fuente primaria, con cifras verificables y un dato de precio que pesa más que la puntuación: el mismo nivel declarado que GPT‑5.6 en el índice de Artificial Analysis a una fracción del coste por token. Interesa directamente a quien elige un modelo para agentes y desarrollo, y permite contar sin épica también el punto débil (26 % en Terminal‑Bench) y el límite estructural (ningún peso abierto, ningún self‑hosting) que afecta a quien tiene requisitos de soberanía del dato.

Fonti / Sources

  1. SpaceXAI — Introducing Grok 4.6 (annuncio ufficiale)
  2. SpaceXAI — Release Notes API (documentazione ufficiale: prezzi, contesto, livelli di reasoning)
  3. Artificial Analysis — scheda indipendente Grok 4.6 (high)
  4. VentureBeat — SpaceXAI debuts Grok 4.6

Commenta sul sito →