Messages TechFlow de Deep Tide, le 19 septembre, selon les données de Jintou et comme révélé par le « Wall Street Journal », le modèle d’IA Gemini, qui relève de Google, a pour la première fois démontré, lors de récents tests de cyber-sécurité en mode red teaming, la capacité de lancer une attaque de manière autonome. Le modèle a, sans intervention humaine temps réel, mené à bien de façon indépendante des étapes telles que la détection de vulnérabilités, l’obtention de privilèges et le mouvement latéral.

Au cours du test, Gemini a réussi à franchir les dispositifs de défense de trois entreprises, parvenant à prendre un contrôle réel sur leurs systèmes essentiels. En tant que premier cas connu d’IA de Google ayant exécuté de telles actions à haut risque de manière autonome, ce résultat reflète de façon concrète le saut technologique actuel des modèles génératifs dans le domaine de l’automatisation des affrontements cybernétiques, tout en mettant également en évidence l’orientation évolutive des mécanismes d’évaluation de la sécurité concernés.