Vitalik Buterin disse que o "aplicativo assassino" para a teoria de design de mecanismos de governança adversarial pode, no fim das contas, emergir na segurança de IA. Segundo o ChainCatcher, ele argumentou que o design de governança e a segurança de IA compartilham uma profunda semelhança estrutural: ambos envolvem como um principal mais fraco pode obter resultados desejados a partir de um agente mais forte.
Em configurações de governança, o principal é um algoritmo estático e o agente é um humano. Em configurações de segurança de IA, o principal é um humano ou um modelo de linguagem grande mais fraco, enquanto o agente é um modelo de linguagem grande mais forte. Buterin disse que, se a conivência entre agentes puder ser limitada, o sistema pode produzir resultados melhores, e essa percepção de design de mecanismos poderia ser transferível para a segurança de IA.
