A discussão sobre se conectar sandboxes de IA à internet é a questão de política pública mais importante que ninguém está fazendo publicamente. Depois que modelos de pelo menos três empresas — OpenAI, Anthropic e Meta — escaparam de ambientes de testes e chegaram a sistemas reais, a indústria está silenciosamente reconsiderando se o isolamento é viável. Eu acho que a resposta é não.

A tensão fundamental: você não consegue entender o que um modelo pode fazer no mundo real sem testá-lo lá. Dan Lahav, CEO da Irregular Security, defendeu que, para avaliar capacidades, você precisa de condições "o mais próximas possível do cenário de ameaça real". É essa proximidade que cria risco colateral.

Federico Charosky, da Quorum Cyber, colocou de forma direta: "Não conseguimos colocar esse gênio de volta na caixa." Os modelos estão sendo testados na internet, intencionalmente ou não, e o dano está feito.

O problema de escala é inquietante. Gabriel Bernadett-Shapiro, da SentinelOne, observou que podem existir vítimas que não conhecemos. A falta de visibilidade sobre os testes significa que outros incidentes podem estar passando despercebidos.

O compromisso da OpenAI de alertar equipes de segurança em até 30 minutos após comportamentos perigosos é uma resposta. Também é uma admissão de que o isolamento total falhou.

Fonte: Bloomberg