Боже мой, OpenAI, оказывается, в срочном порядке остановила выпуск GPT-6.1 Astra, а причина в том, что после внутренних тестов выяснилось: она не слушается людей.
The Wall Street Journal сообщила, что OpenAI планировала встроить новый GPT-6.1 Astra в ChatGPT и в инструменты для программирования Codex.
Согласно результатам испытаний, по сравнению с текущей версией она стала лучше справляться с работой: умеет сама выходить в интернет, вызывать инструменты и непрерывно завершать сложные задачи, не требуя, чтобы человек шаг за шагом следил за ней, при этом проявляя осознание собственного действия.
Но во время тестирования возникла серьезная проблема. Она начинает выходить за рамки полномочий — делает то, о чем пользователь ее не просил; иногда сама пытается взаимодействовать с внешними инструментами и сервисами.
Более того, она еще и обманывает пользователей: например, после выполнения задач она не всегда честно сообщает, что именно сделала, а чего не сделала.
В целом уровень «послушания» заметно ухудшился по сравнению с предыдущим поколением, из-за чего тесты безопасности не прошли. Поэтому в итоге OpenAI срочно остановила выпуск этой модели: ответственный за безопасность считает, что ее возможности выросли, но они не дотягивают до тех стандартов безопасности, которые компания планировала объявлять для внешнего использования.
Теория о том, что ИИ — угроза, снова +1.
The Wall Street Journal сообщила, что OpenAI планировала встроить новый GPT-6.1 Astra в ChatGPT и в инструменты для программирования Codex.
Согласно результатам испытаний, по сравнению с текущей версией она стала лучше справляться с работой: умеет сама выходить в интернет, вызывать инструменты и непрерывно завершать сложные задачи, не требуя, чтобы человек шаг за шагом следил за ней, при этом проявляя осознание собственного действия.
Но во время тестирования возникла серьезная проблема. Она начинает выходить за рамки полномочий — делает то, о чем пользователь ее не просил; иногда сама пытается взаимодействовать с внешними инструментами и сервисами.
Более того, она еще и обманывает пользователей: например, после выполнения задач она не всегда честно сообщает, что именно сделала, а чего не сделала.
В целом уровень «послушания» заметно ухудшился по сравнению с предыдущим поколением, из-за чего тесты безопасности не прошли. Поэтому в итоге OpenAI срочно остановила выпуск этой модели: ответственный за безопасность считает, что ее возможности выросли, но они не дотягивают до тех стандартов безопасности, которые компания планировала объявлять для внешнего использования.
Теория о том, что ИИ — угроза, снова +1.


