Karena batas keselamatan standar hanya ditulis dalam bahasa Inggris sehari-hari, ternyata sangat mudah bagi pengguna untuk membujuk kecerdasan buatan agar meninggalkan pedomannya sendiri. Yang diperlukan hanyalah pertanyaan yang dipoles dengan cerdik atau sedikit sanjungan agar pertahanan yang tertulis itu bisa runtuh total.

Flow mengatasi kerentanan ini dengan pendekatan yang sama sekali berbeda. Alih-alih menempatkan pembatasan di dalam sebuah prompt, batasan agen ditetapkan dengan tegas pada tingkat akun. Meskipun seseorang mungkin dapat memanipulasi instruksi tertulis, benar-benar mustahil untuk menipu sebuah akun.