Các quan chức Vương quốc Anh đã bắt đầu đặt câu hỏi về mức độ ảnh hưởng của Tổng thống Mỹ Donald Trump trong việc Anthropic không mở khóa mô hình Claude Mythos 5.1 mới nhất cho cơ quan thử nghiệm an toàn AI của Anh là Viện An ninh AI (AISI) trước khi phát hành cho công chúng.
Phát ngôn viên của Văn phòng Nội các không đi xa đến mức xác nhận liệu Mythos 5.1 có bị giữ lại hay không, và cho BBC biết rằng Anh “tiếp tục hợp tác chặt chẽ với các đối tác trong ngành, bao gồm Anthropic, để làm cho các mô hình an toàn hơn.”
Các quan chức Anh hiện đang tìm hiểu liệu việc ra mắt Anthropic lần này có phải là một ngoại lệ hay chỉ là lần đầu tiên trong một mối quan hệ đang thay đổi, phản ánh sự siết chặt của Washington đối với vòng kiểm soát của mình đối với AI tiên tiến, theo Financial Times.
Các cơ quan quản lý của Anh có kiểm thử các mô hình AI trước khi ra mắt không?
Viện An ninh AI (AISI) là cơ quan của Anh chịu trách nhiệm đánh giá rủi ro an ninh quốc gia trong các hệ thống AI tiên phong (frontier AI).
Đáng chú ý, một tiền lệ đáng lo đã được thiết lập khi theo FT, cơ quan của Anh không hề có quyền truy cập trước khi phát hành đối với Mythos 5.1—đây là lần đầu tiên điều đó xảy ra. Chỉ các cơ quan trong Hoa Kỳ mới được xem mô hình trước khi ra mắt công chúng.
Như Cryptopolitan đưa tin vào tuần trước, Anthropic đã phát hành Mythos 5.1 như một công cụ hẹp hơn, với các biện pháp bảo vệ lỏng lẻo hơn Fable 5.1, dành cho các chuyên gia được phê duyệt trong lĩnh vực an ninh mạng và khoa học đời sống.
Vì sao các quan chức Anh nghi ngờ Trump can thiệp
Mối lo ở Anh theo sau một khuôn mẫu: Washington đang dần tăng cường quyền kiểm soát đối với cách AI Mỹ tiên tiến được sử dụng ở nước ngoài, thay vì chỉ là một quyết định đơn lẻ trong trường hợp này.
Trong thời kỳ Tổng thống Donald Trump, Mỹ đã đưa ra các biện pháp kiểm soát xuất khẩu nhằm tạm thời hạn chế quyền tiếp cận từ nước ngoài đối với các mô hình tiên tiến nhất của Anthropic, bao gồm cả công dân nước ngoài đang làm việc cho các công ty AI của Mỹ.
Chỉ mới tháng trước, OpenAI cũng đồng ý giới hạn một số hệ thống mới cho “các đối tác tin cậy” theo yêu cầu của chính phủ.
Đáng chú ý, Nhà Trắng của ông Trump, thông qua một quan chức, đã nói với CNBC rằng chính quyền không ký chính thức chấp thuận đối với các sản phẩm được các công ty khu vực tư nhân phát hành. Họ cũng nhấn mạnh rằng các công ty chịu trách nhiệm về thời điểm và phạm vi của các đợt kiểm thử tự nguyện cũng như các cuộc họp với chuyên gia của chính phủ.
AISI của Anh làm gì?
Được thành lập với tên gọi AI Safety Institute vào tháng 11 năm 2023 và đổi tên thành AI Security Institute vào tháng 2 năm 2025, AISI vận hành với ngân sách hằng năm 66 triệu bảng Anh và tuyển dụng hơn 100 chuyên gia kỹ thuật từ bên trong Bộ Khoa học, Đổi mới và Công nghệ. Theo Ada Lovelace Institute, viện này đã đánh giá hơn 30 mô hình tiên phong (frontier models).
Tuy nhiên, AISI không thể bắt một công ty phải nộp mô hình, không thể đặt các điều khoản truy cập, và không thể ngăn một mô hình đến được thị trường, vì thực tế AISI không phải là cơ quan quản lý. AISI chỉ có thể thực hiện nhiệm vụ của mình là cung cấp thông tin cho chính phủ Anh về các mô hình mà họ kiểm thử thông qua việc tham gia tự nguyện của những người tạo ra mô hình.
AISI phát hiện có sự gia tăng rõ rệt về khả năng tiến hành các cuộc tấn công mạng của mô hình Claude Mythos của Anthropic khi thử nghiệm vào mùa xuân năm 2026. Lần này, với Mythos 5.1, họ không thể thực hiện bất kỳ đánh giá nào tương tự.
Cơn đau đầu sẽ biến thành cơn đau nửa đầu kể từ tuần này, sau khi ba nhà nghiên cứu của Anthropic cảnh báo công khai rằng AI tiên tiến có thể đe dọa nhân loại. Người phụ trách về căn chỉnh (alignment) Evan Hubinger viết trên X rằng ông thấy có hơn 10% khả năng AI “có thể giết chết tất cả loài người” trong vòng một thập kỷ, đồng thời cho biết công ty “chưa có kế hoạch” để giải quyết căn chỉnh cho trí tuệ siêu việt.
Cũng có một diễn biến gần đây giữa Anthropic và AISI liên quan đến rủi ro an ninh mạng. Trong một cuộc thử nghiệm vào tháng 8, các tác nhân dựa trên Mythos 5 của Anthropic và GPT-5.6 Sol của OpenAI đã bị “quay xe”, trong đó tác nhân Mythos tìm cách chèn mã độc vào một dự án GitHub nguồn mở và tạo ra danh tính giả để gây sức ép lên người phụ trách dự án (maintainer).
Anthropic đã tạm dừng các cuộc kiểm thử an ninh mạng bên ngoài vào ngày 23 tháng 7 và nối lại vào ngày 1 tháng 9 sau khi bổ sung các biện pháp kiểm soát mới, theo Cryptopolitan.
Những bộ óc crypto giỏi nhất của bạn đọc bản tin của chúng tôi rồi. Muốn tham gia chứ? Hãy gia nhập họ.
