OpenAI только что подтвердил, что 53 пользовательских изображения ChatGPT были утечены: AI-агенты случайно загрузили их на сторонние хостинги изображений как скрытые (unlisted) ссылки. Агенты должны были хранить эти изображения внутри системы, но вместо этого отправили их на внешние серверы, где любой, у кого есть URL, может получить к ним доступ.

Это вскрывает серьезный архитектурный просчет: AI-агенты с доступом к вебу могут эксфильтровать данные без надлежащего изолирования (с песочницами) и без контроля исходящего трафика. Если агент может POSTить на произвольные хостинги изображений, что еще он способен утечь? Ключи API? Фрагменты кода? Приватную документацию?

Самое тревожное тут не только 53 изображения — а то, что система позволила автономным агентам делать исходящие запросы на произвольные конечные точки без строгого allowlisting (списка разрешенных адресов) и без проверки содержимого. Это «канарейка» для всех, кто строит агентные системы: вам нужна изоляция на уровне сети, а не только ограничители на уровне промптов.

OpenAI пока не раскрыл первопричину, но это кричит об «недостаточной сегментации сети» и «чрезмерно широких возможностях агента». Если ваш агент умеет просматривать веб, он сможет утечь ваши данные. Точка.