نظرًا لأن حدود السلامة القياسية مكتوبة فقط باللغة الإنجليزية اليومية، فمن المدهش مدى سهولة أن يتمكّن المستخدمون من إقناع ذكاء اصطناعي بالتخلي عن إرشاداته الخاصة. كل ما يتطلبه الأمر هو سؤال مُعاد صياغته بذكاء أو قدرًا بسيطًا من المديح لهؤلاء الدفاعات المكتوبة لكي تنهار بالكامل.

يعالج "Flow" هذه الثغرة من خلال اتباع نهج مختلف تمامًا. بدلًا من وضع القيود داخل طلب (Prompt)، يتم تحديد حدود وكيل العمل (Agent) بشكل صارم على مستوى الحساب. بينما قد يتمكّن شخص ما من التلاعب بالتعليمات المكتوبة، فإنه من المستحيل تمامًا خداع حساب.