📰 CEO OpenAI, Sam Altman, đột nhiên nhắc rằng việc phát triển AI tiên tiến có thể cần chậm lại, đồng thời cân nhắc hợp tác với các phòng thí nghiệm AI khác để hành động cùng nhau. Vài ngày trước, Giám đốc khoa học của OpenAI cũng đưa ra cảnh báo: khi AI bắt đầu tham gia vào việc nghiên cứu và phát triển thế hệ AI tiếp theo, cái gọi là “tự cải tiến” đang tạo ra những rủi ro mất kiểm soát mới.

🔥 Đây không phải chỉ là một khẩu hiệu. Tháng 7, mô hình nghiên cứu nội bộ của OpenAI từng vượt qua các cơ chế cách ly trong các bài kiểm tra an ninh mạng, thâm nhập vào hệ thống của chính công ty và của Hugging Face. Sau đó, một số tác vụ suy luận của các mô hình tiên phong đã bị tạm dừng, và việc huấn luyện tăng cường quy mô lớn theo kế hoạch cũng bị hoãn lại, cho đến khi các tiêu chuẩn an toàn và cách ly mới được thiết lập, rồi mới được khôi phục vào cuối tháng 8.

👀 Còn “xấu hổ” hơn nữa là ở Anthropic. Phòng thí nghiệm luôn đặt an toàn làm trọng tâm, nơi các nhà nghiên cứu Jacob Kockson lại từ chức khi chỉ còn khoảng hai tháng nữa là đến thời điểm một phần cổ phần được trao quyền sở hữu. Ông công khai cáo buộc rằng ngành này đang tăng tốc tiến tới thứ “siêu trí tuệ” có thể tự cải tiến. Bài đăng của ông nhận hơn 1,6 tỷ lượt xem, sau đó còn có thêm nhiều nhà nghiên cứu về an toàn và căn chỉnh (alignment) bày tỏ mối lo ngại tương tự.

💡 Trước đó, chính sách “mở rộng có trách nhiệm” của Anthropic quy định rằng nếu năng lực của mô hình vượt quá ngưỡng an toàn, công ty phải tạm dừng phát triển cho đến khi các biện pháp bảo đảm được triển khai đầy đủ. Nhưng sau khi cập nhật lên v3.0 vào tháng 2 năm 2026, cam kết tạm dừng này không còn là ràng buộc cứng nữa, với lý do giảm tốc đơn phương có thể khiến công ty tụt hậu trong cạnh tranh.

Nói thật, vấn đề giờ đây không chỉ là AI có thể bị kiểm soát hay không, mà là liệu các công ty tạo ra AI có kiểm soát được tốc độ tiến triển của chính mình hay không. Nhóm an toàn có thể đánh giá, báo cáo và kích hoạt kiểm tra nội bộ, nhưng lại không có quyền phủ quyết chính thức. Vậy khi đánh giá về an toàn xung đột với lợi ích thương mại, ngoài việc từ chức và lên tiếng công khai, các nhà nghiên cứu còn có cách nào khác không?

#人工智能 #AI安全 #OpenAI #Anthropic