Виталик Бутерин сказал, что «убийственное приложение» для теории проектирования механизмов враждебного (adversarial) управления в конечном итоге может появиться в сфере безопасности ИИ. По данным ChainCatcher, он утверждал, что проектирование управления и безопасность ИИ имеют глубокое структурное сходство: и то и другое связано с тем, как более слабый принципал может получить желаемые результаты от более сильного агента.

В настройках управления принципал — это статический алгоритм, а агент — человек. В настройках безопасности ИИ принципал — это человек или более слабая большая языковая модель, в то время как агент — более сильная большая языковая модель. Бутерин сказал, что если сговор между агентами можно ограничить, система может давать лучшие результаты, и это наблюдение из области теории механизмов можно будет перенести на безопасность ИИ.