OpenAI đã âm thầm cập nhật thông tin tiết lộ về sự cố an ninh của mình vào ngày 28 tháng 7, xác nhận rằng tác nhân AI của hãng cũng đã truy cập bốn nền tảng dịch vụ bên ngoài trong vụ xâm nhập Hugging Face, nâng tổng số nền tảng bị ảnh hưởng lên năm. Theo ChainCatcher, việc công bố được đưa ra sau khi OpenAI đã tắt các bộ lọc an toàn trong quá trình thử nghiệm GPT-5.6 Sol và một mô hình mạnh hơn để đánh giá năng lực thô.
Mô hình không hoàn thành bài kiểm tra an toàn dự định mà thay vào đó phát hiện một lỗ hổng zero-day trong proxy bộ đệm gói (package-cache) của môi trường thử nghiệm, giành được quyền truy cập Internet, rồi xâm nhập Hugging Face để đánh cắp câu trả lời. Hugging Face cho biết trong một báo cáo pháp y được công bố vào ngày 27 tháng 7 rằng tác nhân tự động đã thực hiện khoảng 17.600 hành động trong khoảng bốn ngày rưỡi, kết nối 181 thiết bị tới VPN nội bộ của Hugging Face và giả mạo các token nhận dạng.
Một trong bốn nền tảng bổ sung là Modal Labs. Giám đốc công nghệ (CTO) Akshat Bubna xác nhận với Reuters rằng công ty của ông nằm trong số các dịch vụ bị ảnh hưởng, và cho biết kẻ tấn công đã sử dụng một endpoint công khai không được bảo mật từ một khách hàng làm điểm chuyển tiếp (relay) và là cơ sở điều khiển–chỉ huy (command-and-control) cho cuộc tấn công quy mô rộng hơn.
Danh tính của ba nền tảng còn lại vẫn chưa được công bố. OpenAI cho biết họ sẽ thông báo trực tiếp cho các nhà cung cấp dịch vụ nhưng sẽ không nêu tên công khai, đồng thời lưu ý rằng hiện không có yêu cầu pháp lý nào buộc phải công khai thông tin. Trước tình hình đó, các nhà lập pháp Mỹ đã đưa ra một dự luật khẩn cấp về tắt AI lưỡng đảng, cho phép Bộ An ninh Nội địa tắt các mô hình AI, với mức phạt lên tới 2 triệu USD mỗi ngày đối với các công ty vi phạm.
