Grok 4.7 a fondo: especificaciones, benchmarks y precios del nuevo frontier de xAI
Qué es Grok 4.7 y por qué importa
El 21 de septiembre de 2026, SpaceXAI (antes xAI) liberó Grok 4.7, su modelo más capaz para programación y trabajo de conocimiento. La premisa oficial es directa: el doble de rápido a mitad de precio que los modelos comparables. La frase no es marketing vacío: a $2 por millón de tokens de entrada y $6 de salida, compite contra GPT-5.6 Sol ($4/$20) y Claude Fable 5.1 ($10/$50) desde una posición de costo entre 2 y 8 veces más baja.
Ficha técnica
| Especificación | Valor |
|---|---|
| Contexto de entrada | 500.000 tokens (~752 páginas) |
| Modalidades | Entrada texto + imagen, salida texto |
| Base | Modelo base nuevo, más grande que Grok 4.6 |
| Entrenamiento | RL prolongado, ponderado hacia tareas de varias horas |
| Licencia | Propietaria (términos de producto y API) |
| Corte de conocimiento | Junio 2026 |
| Precio API | USD 2 entrada / USD 6 salida por millón; cached USD 0,50 |
| Variante rápida | Doble velocidad de salida a doble precio |
Dos decisiones de diseño explican el salto respecto a Grok 4.6. Primera: el entrenamiento por refuerzo se extendió con una mezcla de tareas más difíciles, ponderada hacia problemas que tardan varias horas en resolverse, lo que mejora el rendimiento en trabajo agéntico sostenido. Segunda: el modelo fue entrenado para verificar su propio trabajo y para entender de forma nativa el harness de Grok Bot, el producto de agentes conversacionales de la compañía.
Benchmarks: los números oficiales
Estos son los resultados publicados por SpaceXAI en el anuncio, comparados con los frontier de OpenAI y Anthropic:
| Benchmark | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 (coding) | 46,3% | 40,4% | 41,7% | 51,8% |
| DeepSWE v1.1 (SWE) | 71,0%* | 65,2% | 72,7% | 70,0% |
| EEBench (ingeniería eléctrica) | 64,0% | 53,0% | 39,4% | 56,4% |
| Terminal-Bench 4.0 | 38,0% | 20,3% | 37,3% | 57,9% |
| Harvey Legal Agent | 19,6% | 15,8% | 2,5% | 6,7% |
| HealthBench Professional | 56,7% | 48,5% | 60,5% | 62,1% |
| AA Briefcase v1.1 (oficina) | 1.657 | 1.546 | 1.487 | 1.678 |
*Puntuación con esfuerzo alto. En GDPval (trabajo profesional multi-hora), Grok 4.7 alcanza un Elo de 1.695, entre Fable 5.1 (1.735) y GPT-6 Astra (1.542).
La lectura honesta: Grok 4.7 no gana en todo — Fable 5.1 domina coding puro y salud — pero lidera con claridad en dominios técnicos especializados como ingeniería eléctrica y trabajo legal agéntico, y su mejora sobre Grok 4.6 es sustancial en todos los frentes (Terminal-Bench casi se duplica: de 20,3% a 38,0%). El punto fuerte es la relación calidad-precio: en CursorBench 4.0, que estresa tareas de programación largas, xAI posiciona a Grok 4.7 en la frontera de precio-rendimiento del mercado.
Seguridad: el stack nuevo
SpaceXAI construyó para 4.7 una pila de salvaguardas enteramente nueva, y la presenta como su modelo más fuerte en resistencia a jailbreaks y negativas apropiadas. Los datos verificables: encabeza el benchmark de biosafety de LatchBio con 62,4% y en HackerBench v0.3 (tareas cibernéticas riesgosas) deja pasar solo el 3,3% de los prompts duales bloqueando poco el trabajo de seguridad legítimo. La compañía además abrió acceso por invitación a capacidades de red-team para socios de ciberdefensa.
Disponibilidad y precios en la práctica
- API oficial (console.x.ai): USD 2 entrada / USD 6 salida por millón de tokens; prefijos cacheados a USD 0,50.
- Variante rápida: el doble de velocidad de salida al doble de precio, pensada para chat y agentes con latencia crítica.
- Productos: disponible desde el día uno en Cursor, Grok Build (con CLI gratuita de prueba), harnesses de código de terceros, routers de modelos y plataformas cloud.
- Documentación: docs.x.ai con la ficha del modelo y system card pública en PDF.
Qué significa para desarrolladores en Latinoamérica
Para equipos de la región, Grok 4.7 se vuelve relevante en dos frentes. Como motor de agentes de programación (Cursor, harnesses propios), el contexto de 500K y el entrenamiento en tareas largas lo hacen apto para refactorizaciones grandes y sesiones agénticas sostenidas. Como opción de costo: con salida a $6 por millón, correr un agente que consume millones de tokens diarios cuesta una fracción de lo que cuesta con los frontier de OpenAI o Anthropic, sin caer en la categoría económica. La cautela habitual: los benchmarks son del fabricante; los rankings independientes todavía se están actualizando.
Preguntas frecuentes
- ¿Cuándo se lanzó Grok 4.7? El 21 de septiembre de 2026, con disponibilidad inmediata en Cursor, Grok Build y la API de xAI.
- ¿Cuánto cuesta? USD 2 por millón de tokens de entrada y USD 6 de salida, con entrada cacheada a USD 0,50. Existe una variante al doble de velocidad y doble precio.
- ¿Qué contexto tiene? 500.000 tokens de entrada, unos 752 páginas de texto.
- ¿Es mejor que GPT-5.6 Sol? Depende del dominio: gana en ingeniería eléctrica, legal agéntico y costo; Sol mantiene ventaja en DeepSWE y salud. En coding general (CursorBench) lo supera 46,3% vs 41,7%.
- ¿Tiene licencia abierta? No, es propietario, bajo los términos de producto y API de SpaceXAI.
Fuentes y referencias
Fuentes verificadas
https://x.ai/news/grok-4-7
x.ai
https://docs.x.ai/docs/models/grok-4.7
docs.x.ai
https://media.x.ai/v1/website/4p7card-5eccc980.pdf
media.x.ai
https://llm-stats.com/models/grok-4.7
llm-stats.com