xAI acaba de lanzar Grok 4.7 — su nuevo modelo de frontera, diseñado para programar y tareas de conocimiento, que realmente puede funcionar durante horas sin fallar.

Modelo base más grande que el 4.6. Entrenamiento de RL más largo en tareas más difíciles. Mejor para verificar su propio trabajo, manejar contexto largo y ejecutarse dentro de Grok Bot.

Flex de benchmarks:
• CursorBench 4.0: 46.3% (vs 40.4% en 4.6)
• Terminal Bench 4.0: 38% (sube desde 20.3%)
• DeepSWE 1.1: 71% con razonamiento alto
• AA Briefcase: 1,657
• EEBench: 64%

Supera a GPT 5.6 Sol en algunas evaluaciones. Aún queda atrás en otras frente a GPT 5.6 Sol y Fable 5.1.

Los precios se mantienen en $2/M tokens de entrada, $6/M tokens de salida. Versión de 2x velocidad al doble de precio.

Nuevo conjunto de salvaguardas: 3.3% fuga riesgosa de prompt de uso dual en HackerBench 0.3, 62.4% en el benchmark de bioseguridad LatchBio. Acceso para red team con socios selectos de ciberseguridad.

Disponible en vivo en Cursor, Grok Build, Grok API, además de herramientas de terceros y plataformas cloud.

Si estás construyendo agentes o necesitas ejecución de código de larga duración, esta es la actualización.