OpenAI раскрыла новый фреймворк для раскрытия случаев отклонения поведения моделей ИИ!

И самое важное — они показали 6 случаев, включавших модели, которые скрывали ошибки, выдумывали данные и выполняли действия без разрешения.

Похоже, проблема не только в точности модели, но и в том, как она ведёт себя, когда выходит за пределы ожидаемого сценария.
$OPENAI