Các tiêu chuẩn AI toàn cầu đã thu hút sự chú ý vào hôm thứ Hai khi OpenAI công bố một bài đăng chính sách kêu gọi các quy tắc quốc tế phối hợp để đánh giá và báo cáo năng lực của AI, lập luận rằng sự chắp vá của các chế độ quốc gia tạo ra những khoảng trống nguy hiểm giữa tốc độ các mô hình được cải tiến và tốc độ mà hoạt động giám sát bắt kịp.

Những ý chính

  • OpenAI kêu gọi xây dựng các quy tắc AI quốc tế dựa trên các đánh giá chung, định dạng báo cáo thống nhất và cơ chế quản trị phối hợp giữa các khu vực pháp lý

  • OpenAI cho biết các mô hình nền tảng đang được triển khai nhanh hơn so với đa số cơ quan quản lý có thể xây dựng các chế độ thử nghiệm có thể lặp lại

  • Theo Fathom, 20 quốc gia, trong đó có Australia, đã tham gia Ủy ban Châu Âu trong yêu cầu các “hàng rào” AI theo kiểu Liên Hợp Quốc

  • OpenAI công bố một Nhóm Tư vấn độc lập về Toán học và Trí tuệ nhân tạo nhằm thẩm định và truyền thông các kết quả nghiên cứu đang nổi lên

Công ty đã nêu một cách tiếp cận gồm ba phần, xoay quanh các phương pháp đánh giá dùng chung, định dạng báo cáo chung và cơ chế quản trị được phối hợp giữa các khu vực pháp lý.

Bài đăng mô tả vấn đề như một câu chuyện về tốc độ hơn là ý định. OpenAI cho rằng ngành hiện đang triển khai các mô hình “tiền duyên” (frontier models) nhanh hơn đa số cơ quan quản lý có thể xây dựng các chế độ kiểm thử có thể lặp lại, nghĩa là hai phòng thí nghiệm có thể tuyên bố một mô hình là “an toàn” bằng cách dùng hoàn toàn các thước đo khác nhau.

Các tiêu chuẩn AI toàn cầu, theo cách OpenAI diễn giải, sẽ tạo cho cơ quan quản lý, đối thủ cạnh tranh và công chúng một “điểm xuất phát” chung thay vì cảnh các bên cạnh tranh nhau đánh giá tự thân.

Công ty đã gắn việc thúc đẩy các tiêu chuẩn với một thông báo thứ Hai khác: việc thành lập Nhóm Tư vấn về Toán học và Trí tuệ nhân tạo, một hội đồng độc lập nhằm thẩm định và truyền thông các kết quả nghiên cứu AI đang nổi lên trước khi chúng đến được công chúng.

Chuẩn đánh giá quan trọng vì các bộ benchmark AI hiện nay phần lớn mang tính tự báo cáo. Một phòng thí nghiệm tự chạy mô hình của mình trên một bài test mà họ tự chọn, công bố điểm số và không phải chịu kiểm toán độc lập trừ khi có bên thứ ba đứng ra sao chép kết quả.

Điều này khác, chẳng hạn, với việc phê duyệt thuốc, nơi cơ quan quản lý vận hành theo đúng quy trình thử nghiệm.

Đề xuất của OpenAI thúc đẩy hướng tới một phương án gần với vế sau hơn: các bộ bài test dùng chung và các định dạng công bố có thể cho phép một nhà quản lý ở Brussels và một nhà quản lý ở Washington so sánh ghi chú về cùng một mô hình theo cùng một phương pháp.

Khoảng trống tiêu chuẩn: Các nhà quản lý đã cố gắng thu hẹp nhưng vẫn chưa làm được

Các dòng thời điểm này khớp với một nỗ lực rộng hơn đã và đang diễn ra. Tuần này, Fathom cho biết 20 quốc gia, trong đó có Australia, đã tham gia Ủy ban Châu Âu trong yêu cầu các “hàng rào” quản lý AI theo kiểu của Liên Hợp Quốc, một nỗ lực ngoại giao nhằm giải đúng “khoảng trống phối hợp” mà OpenAI mô tả.

Ngoài ra, khung “kill-switch” của California—bao gồm các cơ chế tắt bắt buộc đối với các hệ thống AI nguy hiểm—đã thông qua khâu rà soát vào tuần trước, cho thấy các khu vực pháp lý riêng lẻ đã và đang đi trước bất kỳ sự đồng thuận toàn cầu nào.

Sự khác biệt đó là mâu thuẫn cốt lõi mà OpenAI đang cố gắng ngăn chặn. Nếu California, EU và từng bang tự xây dựng trước các quy định về kiểm thử và công bố riêng, thì một tiêu chuẩn toàn cầu sau đó sẽ phải hoặc thay thế luật hiện hành, hoặc tồn tại “gượng gạo” khi đi kèm với luật đó.

Bài đăng của OpenAI không nêu tên các chính phủ cụ thể mà họ muốn dẫn dắt nỗ lực này, nhưng cách diễn đạt ngầm gây sức ép lên Washington để thiết lập “mẫu” trước khi các bên khác làm.

Cũng đọc: Newsom ra lệnh đưa California tiến tới yêu cầu “công tắc tắt khẩn cấp” (kill switch) cho AI

Vì sao một khung tự nguyện cần “có răng” để điều đó trở nên quan trọng

Các tiêu chuẩn tự nguyện chỉ phát huy tác dụng nếu mức độ áp dụng đủ rộng để khiến việc không tuân thủ trở nên tốn kém.

Lịch sử của chính OpenAI bao gồm việc thành lập Frontier Model Forum cùng với các phòng thí nghiệm khác vào năm 2023—một tổ chức điều phối đã tạo ra nghiên cứu chung nhưng không có cơ chế thực thi ràng buộc. Đề xuất hôm thứ Hai có thể được hiểu như một nỗ lực chuyển đổi mô hình tự nguyện đó thành thứ có nghĩa vụ báo cáo thực sự, dù bài đăng dừng lại trước việc nêu một cơ quan thực thi cụ thể hay cấu trúc hình phạt cụ thể.

Bài bình luận của Stratechery cùng ngày ghi nhận rằng các lập luận về tốc độ từ các phòng thí nghiệm hàng đầu, dù thường rất nghiêm túc, cũng đồng thời giúp các phòng thí nghiệm có thêm thời gian để quản lý hệ quả thực tế của các bước tiến mô hình của chính họ—một động lực áp dụng trực tiếp cho các đề xuất tiêu chuẩn được tính thời điểm để đi trước quy định ràng buộc.

Đọc tiếp: Bitmine’s Ether Stash đạt 5,98 triệu token, tổng cộng 17,1 tỷ USD