Nhiệt độ gia tăng của thuyết tận diệt do AI: Anthropic nói xác suất diệt vong vượt 10%, người sáng lập OpenAI cũng gật đầu kêu gọi chậm lại

“Thuyết tận diệt do AI” không nhắm vào chatbot ngày hôm nay, mà là việc nếu một trí tuệ siêu cấp dựa vào đệ quy tự cải thiện mà mất kiểm soát, loài người có thể không kịp phanh lại.

Giám đốc phụ trách khoa học về căn chỉnh của Anthropic là Evan Hubinger đã công khai nêu quan điểm rằng, theo đánh giá cá nhân của ông, trong mười năm tới, xác suất AI gây diệt vong cho toàn nhân loại vượt quá 10%, và hiện chưa có giải pháp căn chỉnh cho siêu trí tuệ; cũng chưa thể nói rằng đã đi đúng hướng. Cùng thời gian đó, một số nhà nghiên cứu từ chức, cáo buộc các phòng thí nghiệm hàng đầu đang “đặt cược mạng sống của tất cả mọi người”.

Ngay sau đó, CEO của Anthropic là Dario Amodei đăng bài kêu gọi ngành chậm lại như đang chạy hết tốc lực: dồn thời gian giành được vào kỹ nghệ an toàn, huấn luyện căn chỉnh, khả năng giải thích và các bài kiểm tra nghiêm ngặt hơn. Người sáng lập kiêm CEO của OpenAI là Sam Altman bày tỏ đồng tình với hướng đi này: công ty đang cân nhắc việc chậm phát triển các mô hình tiên tiến, đồng thời mong các phòng thí nghiệm khác cùng “đi theo”; Giám đốc khoa học của OpenAI cũng nói rằng khi cần, nên phối hợp giảm tốc, và trước khi các chuẩn an toàn chung được triển khai, việc tự nguyện chậm lại tốt nhất nên trở thành thông lệ.

Một bên là kịch bản huy động hàng chục tỷ và IPO, bên kia là chính những người tạo ra mô hình mạnh nhất lại hô p(doom), hô “đạp phanh”. Thuyết tận diệt không đáng sợ bởi tính từ—mà là vì hai “người đứng đầu” ở cả hai phía đều thừa nhận: căn chỉnh vẫn chưa có lời giải, nhưng họ vẫn đang thi xem ai chạy nhanh hơn—trừ khi có người thật sự nhả chân ga trước.