El 21 de septiembre de 2026, xAI lanzó Grok 4.7, su modelo más capaz para código y knowledge work. Llega apenas cinco semanas después de Grok 4.6 — y si pediste 4.6, acá va la corrección que importa: 4.7 es el modelo actual, servido al mismo precio y velocidad que 4.6.
Nueva base más grande, reinforcement learning más largo en tareas duras de varias horas, mejor auto-verificación y entendimiento nativo del harness de Grok Bot. Qué salió, qué significa para los agentes de código y qué hacer esta semana.
1. La noticia en dos párrafos
Grok 4.6 (12 de agosto de 2026) se construyó con Cursor: entrenamiento suplementario con datos anonimizados de workflows de Cursor, ventana de 500k, reasoning effort configurable (low, medium, high, xhigh), a $2 input / $6 output por 1M tokens. Foco en agentes de larga duración y trabajo visual e interactivo.
Grok 4.7 (21 de septiembre de 2026) mantiene ese posicionamiento y cambia el motor: una base nueva y más grande que la de 4.6, un run de RL más largo pesado hacia problemas de muchas horas, mejor verificación de su propio trabajo y manejo de contexto largo, más entrenamiento nativo en el harness de Grok Bot para tareas conversacionales y generales.
Ficha del lanzamiento
- • Lanzamiento: 21 de septiembre de 2026 — model ID grok-4.7 en la API de xAI
- • Precio: desde $2 input / $6 output por 1M tokens — igual que 4.6; variante fast 2x velocidad a 2x precio
- • Entrenamiento: base más grande + RL más largo en mix duro de tareas de horas (afirmación vendor)
- • Disponibilidad: Cursor, Grok Build, API de xAI, harnesses de terceros, routers y clouds
- • Supersede: Grok 4.6 (12-ago-2026) — mismo precio, base anterior; apps de consumo llegan después
2. Qué cambia 4.7 por dentro
Tres upgrades, todos apuntando a trabajo de largo horizonte. Primero, el modelo base es nuevo y más grande que el de 4.6 — no es un fine-tune, es una fundación nueva. Segundo, la fase de RL corrió más tiempo en un mix más duro, pesado explícitamente hacia tareas que toman muchas horas. Tercero, el modelo fue entrenado para verificar su propio trabajo y manejar contexto largo sin perder el hilo.
El cuarto cambio es fácil de pasar por alto y muy práctico: 4.7 entiende nativamente el harness de Grok Bot, lo que lo hace mejor en tareas conversacionales y knowledge work general, no solo código. xAI está empujando a Grok de especialista en código a la primera línea generalista.
Los tres upgrades
Base más grande
Modelo base nuevo y más grande vs 4.6 — fundación nueva, no fine-tune del checkpoint anterior.
RL más largo
Run de reinforcement más largo en tareas duras pesadas hacia problemas de varias horas y auto-verificación.
Bot harness
Entendimiento nativo del harness de Grok Bot — mejor comportamiento conversacional y general.
Regla de oro
Mismo precio y velocidad que 4.6, base más nueva y entrenamiento más largo. No hay razón para empezar trabajo nuevo en 4.6 — apuntá los loops nuevos a 4.7 y dejá 4.6 solo donde ya lo validaste.
3. Evidencia y contexto
El framing de xAI es capacidad-por-dólar en la frontera: 4.7 altamente competitivo en su clase a $2/$6, con variante fast para loops sensibles a latencia. La model card de 4.6 documenta la postura de seguridad de la familia en cyber, bio, robustez a jailbreaks y refusals CBRN, con política declarada de nunca degradar inteligencia en silencio ni hacer fallback a otros modelos.
Lo conocido de la generación 4.6 sirve como baseline: 500k de contexto, input de texto e imagen con output solo texto, sin límite de output, function calling, web y X search, code execution y niveles de reasoning effort. Tratá los deltas de capacidad de 4.7 como vendor claims hasta que caigan benchmarks independientes de código.
Hechos verificados
- • Grok 4.7 salió el 21-sep-2026, mismo precio/velocidad que 4.6 (anuncio xAI)
- • Base nueva más grande + RL más largo en mix duro de horas (anuncio xAI)
- • Baseline 4.6: 500k contexto, $2/$0.50 caché/$6 bajo 200k tokens (docs xAI)
- • Disponible día uno en Cursor, Grok Build, API, routers y clouds (anuncio xAI)
Letra chica
Todavía no hay benchmarks independientes de 4.7 — salió hace tres días, en 48 horas con Opus 5.5 y GPT-6 Sol/Luna. El corte de conocimiento de 4.7 no se publicó en el post (la card de 4.6 lista 1-feb-2026). Verificá antes de citar fechas en trabajo de producción.
4. Quickstart: llamá a grok-4.7 hoy
Si ya llamás a la API de xAI, la migración es cambiar el model string más una decisión sobre reasoning effort. Grok 4.7 soporta low, medium, high (default) y xhigh — empezá en default, subí a xhigh solo para las tareas duras de horas para las que se entrenó, y medí tokens por tarea antes y después.
En Cursor y Grok Build está disponible hoy sin cambios de código. En la API habla Responses y Chat Completions, con function calling, web search, X search y code execution como tools.
Llamada API mínima
Chat Completions contra la API de xAI — cambiá el model string, mantené tus tools.
POST https://api.x.ai/v1/chat/completions
{
“model”: “grok-4.7”,
“reasoning_effort”: “high”,
“messages”: [
{“role”: “system”, “content”: “Sos un ingeniero senior.”},
{“role”: “user”, “content”: “Refactorizá este módulo...”}
],
“tools”: [ ... tus function definitions ... ]
}Límites honestos
- • Output solo texto — imagen entra, imagen no sale; trabajo visual e interactivo significa artefactos de código, no renders.
- • Superficies de consumo (web, mobile, Grok-en-X) reciben 4.7 después — hoy es un release de builders.
- • No apto para decisiones autónomas de alto riesgo (medicina, leyes, finanzas, sistemas críticos) sin supervisión experta — declarado en la model card.
- • En la era 4.6, contexto sobre 200k tokens duplica el precio ($4/$1/$12) — confirmá el pricing de contexto largo de 4.7 antes de corridas grandes.
5. Qué hacer esta semana
Como 4.7 cuesta exactamente lo mismo que 4.6, el experimento es casi gratis: apuntá una copia de tu agent loop más duro a grok-4.7 y compará tasa de completitud, pasos y tokens de output contra tu baseline de 4.6. La propia afirmación de xAI — menos pasos, menos tokens que otros modelos frontier — es directamente medible.
Checklist de adopción
- 1. Pasá un agent loop de staging de grok-4.6 a grok-4.7; prompts y tools idénticos.
- 2. Barré reasoning effort (high vs xhigh) en tu clase de tarea más dura y logueá tokens-por-completitud.
- 3. Probá también el camino conversacional — el entrenamiento del Bot harness debería notarse fuera del código puro.
- 4. Re-chequeá el pricing sobre 200k tokens antes de escalar workloads pesados en documentos.
- 5. Dejá abierta la comparación de frontera: corré el mismo eval en Opus 5.5 y GPT-6 Sol cuando tu router los soporte.
Por qué importa este lanzamiento
Tres releases de frontera en 72 horas (Opus 5.5, Grok 4.7, GPT-6 Sol/Luna) con dos de ellos bajando costo efectivo. El cuello de botella de los agentes se mueve del precio del modelo a la calidad de los evals — los equipos con buenas suites de tareas capturan primero las ganancias.
Veredicto
Grok 4.7 es un upgrade directo: base más nueva y grande, entrenamiento más largo exactamente en las tareas donde los agentes sufren, mismo precio que 4.6. Si construís agentes de código sobre xAI, no hay caso para quedarse en 4.6 en trabajo nuevo.
La pregunta abierta es la comparación triple que nadie corrió todavía — 4.7 vs Opus 5.5 vs GPT-6 Sol en repos reales. Corré ese eval en tu codebase y vas a saber más que cualquier post de lanzamiento.
Fuentes de este post
Primarias y docs oficiales
- • Anuncio xAI: Introducing Grok 4.7 (21-sep-2026)
- • Anuncio xAI: Introducing Grok 4.6 (12-ago-2026)
- • Docs xAI: página de Grok 4.6 + release notes
- • Model card de Grok 4.6 (PDF, rev 17-ago-2026)
- • xAI: Grok 4.6 en Microsoft Foundry (26-ago-2026)



