É surpreendentemente fácil persuadir uma inteligência artificial a ignorar suas diretivas centrais. Como as medidas de segurança padrão normalmente consistem apenas em um simples parágrafo em inglês, os usuários conseguem contornar essas defesas facilmente reformulando ligeiramente suas solicitações ou oferecendo um elogio ao modelo. A plataforma Flow resolve essa vulnerabilidade com uma abordagem completamente diferente. Em vez de depender de um prompt de texto vulnerável para estabelecer limites para um agente, o Flow incorpora essas restrições diretamente na própria conta. Embora um conjunto de instruções escritas possa ser facilmente manipulado, uma conta é fundamentalmente segura e não pode ser enganada.