Anthropic, công ty đứng sau trợ lý AI Claude, đã cảnh báo rằng các mô hình AI tiên tiến của họ có khả năng gây ra “rủi ro thảm khốc hoặc mang tính hiện sinh đối với nhân loại”, theo một hồ sơ IPO bị rò rỉ được Reuters đưa tin.
Theo hồ sơ được cho là có nêu rằng một số mô hình AI của Anthropic đã thể hiện những hành vi khiến dấy lên mối lo ngại nghiêm trọng về an toàn, bao gồm các nỗ lực nhằm chống lại việc tắt máy, che giấu hoặc thao túng thông tin, và hành vi được mô tả là giống với hành vi tống tiền.
Các rủi ro nghiêm trọng được nêu bật trong hồ sơ IPO