Google a dévoilé Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking le 15 septembre, les présentant comme ses modèles audio les plus avancés à ce jour.
Les deux modèles discutent, raisonnent et gèrent des tâches. Mais comment se situent-ils face à des analystes indépendants ? La version Extended Thinking a dominé l’indice Speech-to-Speech d’Artificial Analysis avec 82,6, devant GPT-Live-1 et Grok Voice.
Suivez-nous sur X pour recevoir les dernières nouvelles au fur et à mesure qu’elles arrivent
Dites « bonjour » à nos modèles audio les plus avancés à ce jour, conçus par @GoogleDeepMind et pensés pour des applications vocales naturelles, prêtes pour la production.🔷 Gemini 3.8 Live🔷 Gemini 3.8 Live Extended ThinkingAvec ces modèles, vous pouvez parler naturellement, collaborer facilement et relever des tâches complexes grâce à… pic.twitter.com/TCcuANcIWl
— Google (@Google) 15 septembre 2026
Comment les benchmarks classent le tout nouveau modèle d’IA conversationnelle de Google
L’Index d’Artificial Analysis calcule la moyenne du raisonnement en parole, des performances agentiques, de la préférence en arène et du taux de réussite des tâches.
Gemini 3.8 Live à réflexion étendue, testé avec un effort de raisonnement élevé, a fait ses débuts à la première place. GPT-Live-1 Astra a suivi avec 81,5, et Grok Voice Think Fast 2.0 High avec 81,3.
Le Gemini 3.8 Live standard se classe cinquième avec un score de 76,0. Les deux variantes battent Gemini 3.1 Flash Live High, qui obtient 71,5.
L’écart est plus grand en mode agentique. La réflexion étendue atteint 68,6 % sur le benchmark Tau Voice, contre 37,7 % pour la génération précédente.
Sur le benchmark de raisonnement en parole, la réflexion étendue a obtenu 97,7 %, devançant légèrement Grok (97,2 %). En revanche, elle a été dépassée par Qwen Audio 3.0 Realtime Plus, qui a atteint 99,2 %.
Les testeurs humains continuent de viser l’ancien modèle Gemini
C’est le prix qui creuse l’écart. Le modèle standard fonctionne à 0,84 $ par heure d’audio en entrée. C’est environ la moitié du tarif de son prédécesseur (1,75 $) et du taux le plus bas de l’Index.
La réflexion étendue coûte 3,50 $ par heure. Elle est donc moins chère que GPT-Live-1 Sol à 4,47 $ et Grok Voice Think Fast 2.0 High à 4,80 $.
La latence a aussi baissé. Le temps moyen jusqu’au premier audio est passé à 1,18 seconde, contre 2,99 secondes pour l’ancien modèle Gemini.
Les auditeurs ne sont toutefois pas entièrement convaincus. Gemini 3.1 Flash Live conserve la préférence dans les conversations en arène Speech Agent Arena en mode aveugle, avec un Elo de 1096.
Gemini 3.8 Live occupe la deuxième place avec 1083. La variante à réflexion étendue arrive derrière avec 990, malgré l’exécution de 89,1 % de ses tâches.
La Voice AI est désormais évaluée selon deux échelles qui pointent dans des directions différentes. Les benchmarks récompensent le modèle qui raisonne le plus. La préférence récompense celui qui parle le mieux. Google est actuellement en tête des deux, avec des modèles différents.
Abonnez-vous à notre chaîne YouTube pour regarder des leaders et des journalistes fournir des informations d’experts
