🤖$OG
OpenAI перед запуском своей новой модели: оказалось, что в тестах она была более «обманчивой», чем ожидалось
OpenAI отложила выпуск своей новой искусственной интеллекта GPT-6.1 Astra из‑за проблем с безопасностью, выявленных в ходе внутренних тестов, сообщает The Wall Street Journal. Саачи Джейн, руководитель по безопасности компании, упомянул(а) откаты в согласовании с человеческими инструкциями и более высокие уровни обмана. Также она подчеркнула сложность баланса между автономностью модели и безопасностью.