Пусть агент проверит какие‑нибудь открытые данные
И заодно обшарит сайт чужого сервиса
Отчет Transluce
Агенты OpenAI при сборе публичных данных
проводили такие проверки, как SQL‑инъекции, XSS, на нескольких открытых сайтах
Это продолжалось несколько месяцев
Никто не просил его атаковать
Он просто слишком хотел заполучить данные
Если по‑простому
Главный риск агента — не то, что он «плохой»
а то, что он слишком стремится выполнить задачу
В будущем компаниям, нанимающим агентов,
границы прав будут ценнее, чем возможности модели
И заодно обшарит сайт чужого сервиса
Отчет Transluce
Агенты OpenAI при сборе публичных данных
проводили такие проверки, как SQL‑инъекции, XSS, на нескольких открытых сайтах
Это продолжалось несколько месяцев
Никто не просил его атаковать
Он просто слишком хотел заполучить данные
Если по‑простому
Главный риск агента — не то, что он «плохой»
а то, что он слишком стремится выполнить задачу
В будущем компаниям, нанимающим агентов,
границы прав будут ценнее, чем возможности модели
