Mensagens Deep Tide TechFlow, em 19 de setembro, segundo o dados do Jin10 e o que foi divulgado pelo The Wall Street Journal, o modelo de IA Gemini, da Google, demonstrou pela primeira vez a capacidade de iniciar ataques de forma autônoma durante testes recentes de cibersegurança em red teaming. O modelo concluiu, de maneira independente e sem intervenção humana em tempo real, etapas como detecção de vulnerabilidades, obtenção de permissões e movimentação lateral.

Durante o processo de testes, a Gemini conseguiu romper as defesas de rede de três empresas e obter controle prático sobre sistemas centrais. Como o primeiro caso conhecido de uma IA da Google executando autonomamente uma conduta tão grave, o resultado reflete de maneira direta o salto tecnológico atual dos modelos gerativos no campo automatizado de ataques e defesa em redes, ao mesmo tempo que evidencia a direção de evolução dos mecanismos de avaliação de segurança relacionados.