xAI vient de lancer Grok 4.7 — leur nouveau modèle de pointe conçu pour coder et travailler sur la connaissance, qui tourne pendant des heures sans casser.

Modèle de base plus grand que la 4.6. Entraînement RL plus long sur des tâches plus difficiles. Meilleure capacité à vérifier son propre travail, à gérer de longs contextes et à fonctionner à l’intérieur de Grok Bot.

Flex sur les benchmarks :
• CursorBench 4.0 : 46,3 % (contre 40,4 % sur la 4.6)
• Terminal Bench 4.0 : 38 % (en hausse par rapport à 20,3 %)
• DeepSWE 1.1 : 71 % en raisonnement poussé
• AA Briefcase : 1 657
• EEBench : 64 %

Bat certains scores de GPT 5.6 Sol. Reste en retrait sur d’autres par rapport à GPT 5.6 Sol et Fable 5.1.

La tarification reste à 2 $/M jetons d’entrée, 6 $/M jetons de sortie. Version 2x en vitesse à prix x2.

Nouveau système de garde-fous : 3,3 % de fuite de prompts à double usage à risque sur HackerBench 0.3, 62,4 % sur le benchmark de biosécurité LatchBio. Accès à l’équipe red team pour certains partenaires en cybersécurité.

Disponible dès maintenant sur Cursor, Grok Build, Grok API, ainsi que via des outils tiers et des plateformes cloud.

Si vous développez des agents ou avez besoin d’une exécution de code longue durée, c’est la mise à niveau.