Sungguh mengejutkan betapa mudahnya membujuk kecerdasan buatan untuk mengabaikan arahan intinya. Karena langkah-langkah keselamatan standar biasanya hanya terdiri dari satu paragraf bahasa Inggris yang sederhana, pengguna dapat dengan mudah melewati pertahanan tersebut dengan sedikit mengubah permintaan mereka atau memberi pujian kepada model. Platform Flow mengatasi kerentanan ini dengan pendekatan yang sama sekali berbeda. Alih-alih mengandalkan prompt teks yang rentan untuk menetapkan batasan bagi sebuah agen, Flow menanamkan pembatasan ini langsung ke dalam akun itu sendiri. Meskipun kumpulan instruksi tertulis mungkin mudah dimanipulasi, sebuah akun pada dasarnya aman dan tidak bisa ditipu.
