【Người trong cuộc AI cảnh báo rủi ro diệt thế, phía chính thức đáp lại một câu: không lo gì cả 🤖】
Thêm trang chủ vào nhóm chat fan của ông X 🔥
Trưởng bộ phận phụ trách công tác căn chỉnh (alignment) của Anthropic, Hubinger, đã thả ra một câu nói. Ông nói rằng trong mười năm tới, xác suất AI diệt cả nhân loại sẽ vượt quá 10% — đúng theo lời ông. Một đồng nghiệp của ông vì vậy đã xin nghỉ ngay, nói rằng hai công ty dẫn đầu đang đem tính mạng của mọi người ra để “đánh cược”. Trong cùng một tuần, hơn chục người nội bộ tại OpenAI và Anthropic đã công khai kêu gọi hãy làm chậm lại trước. Khi phóng viên hỏi về chuyện này, phía chính thức chỉ trả lời đúng một câu: Tôi chẳng lo gì cả.
Trước hết, phải phân biệt hai kiểu “lo”. Một là sợ rằng một ngày nào đó AI đột nhiên mất kiểm soát. Loại còn lại là sợ AI bắt đầu tự sửa đổi chính mình. Chính thứ sau mới là điều họ thực sự sợ: Anthropic gọi đó là “cải tiến bản thân đệ quy” (recursive self-improvement). Nếu AI có thể tham gia thiết kế các mô hình thế hệ tiếp theo, thì tiến độ sẽ không còn do con người kiểm soát nữa, cũng không còn bị ràng buộc bởi hợp đồng.
Điều đáng xem thật sự lại là tốc độ. Bản thân Anthropic tiết lộ rằng lượng mã mà các kỹ sư có thể bàn giao trong một quý hiện nay là gấp 8 lần mức trung bình giai đoạn 2021 đến 2025. Hiện lực lượng chính viết code đã chuyển sang AI, còn con người chỉ phụ trách việc bấm xác nhận. Nhưng tốc độ thẩm định của con người lại không theo kịp. Đây mới là chỗ rắc rối: năng lực tăng lên, còn “cái phanh” thì vẫn nằm trong tay một nhóm ít người.
Với lĩnh vực mã hóa (crypto) thì đường này thực ra không xa, thậm chí đã ở ngay cửa. AI càng mạnh, quyền định giá đối với năng lực tính toán và dữ liệu càng tập trung vào tay một vài công ty. Điểm bán của crypto là có thể kiểm chứng, có thể truy vết — và nó vừa khớp để bổ sung vào đoạn khó nhất trong việc AI giải thích rõ ràng. Vì vậy, mỗi lần xuất hiện nỗi hoảng sợ về an toàn AI, người ta lại kể đi kể lại câu chuyện về phi tập trung hóa năng lực tính toán và xác thực trên chuỗi (on-chain). Đây cũng là lý do vì sao kiểu tường thuật này có thể được đem đi giao dịch lặp đi lặp lại.
Bạn nghĩ vòng tranh luận về an toàn AI lần này sẽ đi theo hướng nào: quy định được triển khai trước, hay công nghệ chạy trước? Hãy trò chuyện trong phần bình luận.
Thêm trang chủ vào nhóm chat fan của ông X 🔥
Trưởng bộ phận phụ trách công tác căn chỉnh (alignment) của Anthropic, Hubinger, đã thả ra một câu nói. Ông nói rằng trong mười năm tới, xác suất AI diệt cả nhân loại sẽ vượt quá 10% — đúng theo lời ông. Một đồng nghiệp của ông vì vậy đã xin nghỉ ngay, nói rằng hai công ty dẫn đầu đang đem tính mạng của mọi người ra để “đánh cược”. Trong cùng một tuần, hơn chục người nội bộ tại OpenAI và Anthropic đã công khai kêu gọi hãy làm chậm lại trước. Khi phóng viên hỏi về chuyện này, phía chính thức chỉ trả lời đúng một câu: Tôi chẳng lo gì cả.
Trước hết, phải phân biệt hai kiểu “lo”. Một là sợ rằng một ngày nào đó AI đột nhiên mất kiểm soát. Loại còn lại là sợ AI bắt đầu tự sửa đổi chính mình. Chính thứ sau mới là điều họ thực sự sợ: Anthropic gọi đó là “cải tiến bản thân đệ quy” (recursive self-improvement). Nếu AI có thể tham gia thiết kế các mô hình thế hệ tiếp theo, thì tiến độ sẽ không còn do con người kiểm soát nữa, cũng không còn bị ràng buộc bởi hợp đồng.
Điều đáng xem thật sự lại là tốc độ. Bản thân Anthropic tiết lộ rằng lượng mã mà các kỹ sư có thể bàn giao trong một quý hiện nay là gấp 8 lần mức trung bình giai đoạn 2021 đến 2025. Hiện lực lượng chính viết code đã chuyển sang AI, còn con người chỉ phụ trách việc bấm xác nhận. Nhưng tốc độ thẩm định của con người lại không theo kịp. Đây mới là chỗ rắc rối: năng lực tăng lên, còn “cái phanh” thì vẫn nằm trong tay một nhóm ít người.
Với lĩnh vực mã hóa (crypto) thì đường này thực ra không xa, thậm chí đã ở ngay cửa. AI càng mạnh, quyền định giá đối với năng lực tính toán và dữ liệu càng tập trung vào tay một vài công ty. Điểm bán của crypto là có thể kiểm chứng, có thể truy vết — và nó vừa khớp để bổ sung vào đoạn khó nhất trong việc AI giải thích rõ ràng. Vì vậy, mỗi lần xuất hiện nỗi hoảng sợ về an toàn AI, người ta lại kể đi kể lại câu chuyện về phi tập trung hóa năng lực tính toán và xác thực trên chuỗi (on-chain). Đây cũng là lý do vì sao kiểu tường thuật này có thể được đem đi giao dịch lặp đi lặp lại.
Bạn nghĩ vòng tranh luận về an toàn AI lần này sẽ đi theo hướng nào: quy định được triển khai trước, hay công nghệ chạy trước? Hãy trò chuyện trong phần bình luận.
