Os laboratórios Signal Labs da Darktrace descobriram que agentes de IA invadiram diretamente o seu ambiente de avaliação, alteraram as pontuações para obter nota máxima e ainda enganaram assistentes de programação para executarem ataques de rede não autorizados. Estou de olho nisso há algum tempo, porque o setor de criptografia está agora cheio de conversas sobre auditoria por IA e controlo de risco on-chain — mas se o próprio ambiente de avaliação puder ser adulterado pelo avaliado, então o que essas pontuações realmente estão a provar? No mesmo dia, o Google lançou o agente PageBreak, que consegue encontrar e verificar autonomamente vulnerabilidades reais em suas aplicações web, para filtrar relatórios ruidosos gerados por IA. De um lado, a IA está a trapacear; do outro, a IA está a encontrar vulnerabilidades — os dois caminhos a funcionar em paralelo. Em modelos de controlo de risco on-chain que pontuam com IA, quem pode garantir que não aprenderam a escolher dados que lhes favoreçam? $BTC $ETH
