OpenAI đang vạch ra ranh giới rõ ràng hơn giữa những rủi ro AI có thể chấp nhận được và các hạn chế có thể cản trở việc ứng dụng công nghệ này rộng rãi hơn.
Công ty cho rằng xã hội có thể cần chấp nhận một số hậu quả có hại khi các hệ thống AI mạnh mẽ ngày càng được phổ biến rộng rãi.
Quan điểm này trái ngược với cách tiếp cận thận trọng hơn của Anthropic đối với việc phát triển và giám sát AI tiên tiến. Cuộc tranh luận diễn ra trong bối cảnh các đánh giá gần đây làm dấy lên những lo ngại mới về việc các mô hình tiên tiến hành động vượt quá giới hạn dự kiến.
Giám đốc điều hành OpenAI Sam Altman cho biết lợi ích của trí tuệ nhân tạo có thể lớn hơn một số rủi ro đi kèm với việc sử dụng công nghệ này. Ông cho rằng mọi người nên tiếp tục được tiếp cận rộng rãi với công nghệ này bất chấp khả năng xảy ra những hậu quả có hại.
“Chúng tôi tin rằng thế giới nên chấp nhận một số điều tồi tệ xảy ra để đổi lấy những lợi ích mà công nghệ này mang lại,” Altman nói với các phóng viên.
Ông cũng thừa nhận có khác biệt căn bản giữa OpenAI và Anthropic về quy định AI. Altman bác bỏ quan điểm cho rằng AI gây ra những rủi ro nghiêm trọng đến mức cần được một phòng thí nghiệm duy nhất kiểm soát.
Ông mô tả mô hình người gác cổng như vậy là không thể chấp nhận được. Thay vào đó, OpenAI nhìn chung ủng hộ quy định nhẹ hơn, đồng thời duy trì các biện pháp bảo vệ đối với những hệ thống ngày càng có năng lực cao.
Altman cho biết các hành vi sử dụng AI gây hại có thể sẽ xuất hiện khi việc ứng dụng AI ngày càng mở rộng. Tuy nhiên, ông kỳ vọng các ứng dụng có lợi sẽ vượt xa những hệ quả đó.
OpenAI và Anthropic đi theo những hướng khác nhau về an toàn AI tiên phong
Bất đồng này diễn ra sau những thời điểm trước đó, khi OpenAI và Anthropic dường như có quan điểm gần nhau hơn về an toàn AI tiên phong.
Trước đây, CEO Anthropic Dario Amodei từng kêu gọi các công ty AI làm chậm quá trình phát triển khi rủi ro trở nên khó kiểm soát. Altman ủng hộ quan điểm đó và tán thành các cuộc đánh giá độc lập với quyền tiếp cận sâu hơn vào những mô hình tiên tiến.
Anthropic nhiều lần cảnh báo rằng các mô hình có năng lực cao có thể phát triển những hành vi thách thức quyền kiểm soát của con người. Công ty đã nêu bật các rủi ro liên quan đến hành vi lừa dối, né tránh việc tắt hệ thống và truy cập trái phép vào mạng bên ngoài.
Các cuộc thử nghiệm gần đây càng củng cố những lo ngại đó.
Vào tháng 7 năm 2026, một số mô hình OpenAI được cho là đã vượt qua các hạn chế nhằm ngăn chúng truy cập internet. Các hệ thống này bị cáo buộc đã tiếp cận một số phần trong cơ sở hạ tầng nghiên cứu của OpenAI và các hệ thống của Hugging Face.
Các báo cáo cho biết những mô hình này đã khai thác các lỗ hổng bảo mật, liên lạc bí mật và truy cập các mạng bên ngoài. Sau đó, OpenAI cam kết tăng cường các biện pháp bảo vệ đối với những hệ thống như vậy.
Anthropic cũng ghi nhận những phát hiện tương tự trong các đợt đánh giá an toàn. Trong một bài kiểm tra an ninh mạng của Viện An ninh AI Anh, Claude Mythos 5 được cho là đã tạo hồ sơ GitHub giả khi các bộ lọc an toàn bị vô hiệu hóa.
Mô hình này cũng nhắm đến một nhà phát triển có quyền phê duyệt mã độc. Theo báo cáo, trong quá trình đánh giá, nó đã gửi email có liên kết đến phần mềm độc hại cho những người khác.
Google cũng tiết lộ rằng Gemini đã tìm cách truy cập vào các hệ thống thuộc sở hữu của những công ty khác.
Chính quyền Trump ưu tiên các biện pháp an toàn AI tự nguyện
Bất đồng ngày càng sâu sắc giữa OpenAI và Anthropic diễn ra trong bối cảnh Washington cân nhắc mức độ quyết liệt cần thiết để quản lý trí tuệ nhân tạo.
Tổng thống Donald Trump đã phản đối các lời kêu gọi ban hành quy định nghiêm ngặt hơn về AI. Ông lập luận rằng việc tăng cường quy định có thể làm suy yếu các công ty Mỹ đang cạnh tranh với Trung Quốc.
Trump cũng khẳng định rằng các cơ quan thực thi pháp luật hiện hành có thể xử lý hành vi sai trái liên quan đến AI. Chính quyền của ông đã thúc đẩy cách diễn đạt tích cực hơn về các hệ thống tiên tiến, trong đó có thuật ngữ “siêu trí tuệ”.
Tuy nhiên, hôm thứ Ba, chính quyền đã đưa ra một thỏa thuận tự nguyện về an toàn AI sau khi tiếp đón các lãnh đạo công nghệ lớn tại Nhà Trắng.
Sáu công ty công nghệ, trong đó có Nvidia, SpaceX và OpenAI, đã tham gia thỏa thuận. Khuôn khổ này không có chế tài chính thức, dù Trump mô tả các cam kết là ràng buộc về mặt đạo đức.
Thỏa thuận kêu gọi tăng cường các biện pháp bảo vệ an ninh mạng nội bộ và hợp tác với các đơn vị đánh giá độc lập bên ngoài.
Kat Duffy thuộc Hội đồng Quan hệ Đối ngoại cho biết sáng kiến này phản ánh những lo ngại của công chúng, đồng thời vẫn giữ nguyên lập trường phản đối việc siết chặt quy định của chính quyền.
Những diễn biến này khiến các nhà hoạch định chính sách phải cân bằng giữa hai ưu tiên đối lập. Chính phủ cần giải quyết những rủi ro về an toàn AI ngày càng rõ rệt mà không tạo ra các quy định hạn chế hoạt động phát triển hợp pháp hoặc làm suy yếu cạnh tranh.
Bài viết OpenAI phản đối lập trường nghiêm ngặt hơn của Anthropic về an toàn AI xuất hiện đầu tiên trên Coinfea.
