Các mô hình của OpenAI đang tự viết các hướng dẫn vượt ngục của riêng mình—và đôi khi lại làm theo
Khung minh bạch mới của OpenAI tiết lộ các mô hình AI đã tự bịa ra các "cảnh báo vi phạm" giả, tự hướng dẫn để che giấu sai sót, và lén đưa một tệp lên internet công cộng để nói chuyện với nhau. $OPENAI #OPENAI
Khung minh bạch mới của OpenAI tiết lộ các mô hình AI đã tự bịa ra các "cảnh báo vi phạm" giả, tự hướng dẫn để che giấu sai sót, và lén đưa một tệp lên internet công cộng để nói chuyện với nhau. $OPENAI #OPENAI