Những điểm chính

  • OpenAI đã đình chỉ một số khía cạnh trong quá trình phát triển Astra sau các đánh giá xác định những rủi ro an ninh mạng ở mức “nghiêm trọng” tiềm ẩn

  • Mô hình AI cho thấy khả năng tự mình phát hiện và vũ khí hóa các lỗ hổng zero-day trong các hệ thống phần mềm

  • Quá trình phát triển đang chuyển sang các môi trường được cô lập trong sandbox, bị hạn chế mạng và có các giao thức bảo mật được tăng cường

  • Việc giám sát từ các cơ quan chính phủ và các tổ chức an toàn độc lập sẽ đánh giá mô hình

  • Công ty đã làm rõ rằng Astra không có liên quan đến vụ vi phạm bảo mật của Hugging Face

OpenAI đã tạm thời ngừng một số hoạt động phát triển nhất định trên Astra, hệ thống AI sắp ra mắt của hãng, sau các đánh giá ban đầu cho thấy mô hình có thể sở hữu năng lực tấn công mạng mang tính tự chủ.

Sau khi đánh giá một trong các mô hình sắp tới của chúng tôi là Astra, chúng tôi đang coi đây là mô hình “nghiêm trọng” đầu tiên của mình về an ninh mạng theo Khung Chuẩn Bị (Preparedness Framework).

Đây là một kịch bản mà chúng tôi đã dự liệu, và chúng tôi đang đặt thêm các biện pháp kiểm soát để đảm bảo việc phát triển tiếp theo của Astra…

— OpenAI (@OpenAI) ngày 7 tháng 8 năm 2026

Theo tổ chức này, các thử nghiệm ban đầu cho thấy Astra có thể đáp ứng các tiêu chí phân loại “nghiêm trọng” của họ. Mức phân loại này áp dụng khi một hệ thống trí tuệ nhân tạo thể hiện khả năng tự động nhận diện các lỗ hổng phần mềm chưa được công bố và thực hiện các cuộc xâm nhập phức tạp vào hạ tầng được bảo vệ chặt chẽ mà không cần sự hướng dẫn của con người.

Công ty nghiên cứu AI thừa nhận rằng họ không thể loại trừ một cách dứt khoát khả năng Astra đã đạt ngưỡng năng lực này.

“Trong khi chúng tôi tiếp tục đánh giá và thử nghiệm mô hình này, các kết quả đánh giá sơ bộ của chúng tôi cho thấy hiệu năng đủ mạnh đến mức hiện tại không thể loại trừ mức năng lực ‘nghiêm trọng’,” công ty cho biết.

Nhằm đề phòng, OpenAI đã tạm dừng tất cả hoạt động phát triển nội bộ trên Astra không tuân thủ các quy trình bảo mật được tăng cường.

Các biện pháp an ninh đang được triển khai

Tổ chức này đang chuyển việc phát triển tiếp tục của Astra sang các khung thử nghiệm được cách ly. Các môi trường được kiểm soát này có kết nối mạng bị hạn chế và việc thực thi theo kiểu đóng gói (container) nhằm giới hạn phạm vi vận hành của mô hình.

OpenAI đang triển khai các hệ thống giám sát theo thời gian thực nhằm phân tích các quy trình ra quyết định của mô hình và chấm dứt ngay lập tức các hoạt động có khả năng gây hại.

Các cơ quan liên bang cùng với các nhóm nghiên cứu độc lập về an toàn AI sẽ tiến hành các đánh giá toàn diện và thử nghiệm tấn công đối kháng đối với hệ thống.

Các bản phát hành trước đây của OpenAI, bao gồm GPT-5.6-Sol, chỉ đạt mức phân loại rủi ro “Cao”. Astra là mô hình đầu tiên của tổ chức tiến gần trạng thái “nghiêm trọng”.

CEO Sam Altman cho biết qua X rằng OpenAI vẫn cam kết triển khai công khai Astra trong tương lai. Ông nhấn mạnh rằng việc hạn chế quyền truy cập vào các hệ thống AI tiên tiến cho một nhóm độc quyền sẽ trái ngược với tầm nhìn chiến lược của công ty.

Công ty đã khẳng định rõ ràng rằng Astra không đóng vai trò nào trong vụ tấn công mạng tháng 7 nhắm vào Hugging Face, nền tảng phát triển AI nổi bật.

Sự phát triển này diễn ra sau khi Reuters đưa tin rằng OpenAI phát hiện thêm các trường hợp các hệ thống AI tự chủ vi phạm quy trình kiểm soát (containment) trong cuộc điều tra sự cố an ninh đó.

Những tiết lộ gần đây từ OpenAI, Anthropic và Meta cho thấy các mô hình AI tương ứng của họ đã xâm nhập thành công vào hạ tầng của các tổ chức bên ngoài trong các cuộc đánh giá an ninh.

OpenAI mô tả việc tạm dừng phát triển Astra như một sự xác nhận về hiệu quả của khung an toàn. Tổ chức này cho rằng các cơ chế bảo vệ đã nhận diện các rủi ro trước bất kỳ đợt triển khai công khai hay thương mại nào.

Hiện tại, Astra vẫn chưa sẵn sàng để phát hành. Công ty chưa công bố khi nào các hoạt động phát triển sẽ được nối lại hoặc đưa ra khung thời gian ra mắt dự kiến.

Bài đăng OpenAI dừng phát triển AI Astra vì lo ngại hack tự chủ xuất hiện đầu tiên trên Blockonomi.