⚡️ CẬP NHẬT AI: Một bài kiểm tra chuẩn đánh giá an ninh mạng từng khiến mọi mô hình AI một năm trước bị “vấp”, giờ đây đã bị bẻ khóa mở toang, và những hệ quả mang hai chiều.
CyberGym kiểm tra một điều rất cụ thể: liệu một tác nhân AI có thể đọc mô tả một lỗ hổng và một mã nguồn thực tế, rồi tạo ra đoạn mã proof-of-concept (bằng chứng khái niệm) hoạt động thật sự để kích hoạt lỗi hay không? Không phải viết về bảo mật. Là làm bảo mật.
Bài benchmark được xây từ 1.507 lỗ hổng lịch sử thực từ 188 dự án phần mềm, không dùng ví dụ đồ chơi, không dùng bộ test được đơn giản hóa.
Khi các nhà nghiên cứu lần đầu chạy benchmark này, ngay cả khi dùng kết hợp AI và tác nhân tốt nhất hiện có thì cũng chỉ bẻ được khoảng 20% số trường hợp. Các nhà nghiên cứu an ninh mạng xem điều đó như một sự trấn an: khai thác tự động vẫn còn chủ yếu nằm ngoài tầm với.
Sự trấn an đó đã biến mất. Các mô hình chuyên biệt mới nhất hiện đã đạt tỷ lệ thành công 80%+ trên cùng benchmark—mức tăng gấp bốn lần trong khoảng một năm.
Chuyện còn nghiêm trọng hơn việc chỉ khớp theo mẫu các lỗ hổng đã biết. Trong thử nghiệm mở (open-ended) với không có kiến thức trước về việc gì đang bị hỏng, những thiết lập tác nhân tương tự đã độc lập phát hiện ra các lỗ hổng zero-day đã được xác nhận—những điểm yếu về bảo mật mà không ai biết là tồn tại cho đến khi AI tìm thấy chúng.
Đó là phần khó chịu nhất trong biểu đồ này. Năng lực y hệt cho phép tác nhân AI của bên phòng thủ tìm và vá một lỗ hổng trước khi kẻ tấn công kịp làm điều đó cũng là năng lực cho phép tác nhân AI của kẻ tấn công tìm ra lỗ hổng đó trước tiên.
Công và thủ giờ đang chạy đua trên cùng một nền hạ tầng.
#AI #Cybersecurity #GPT5 #Claude #DeepSeek
CyberGym kiểm tra một điều rất cụ thể: liệu một tác nhân AI có thể đọc mô tả một lỗ hổng và một mã nguồn thực tế, rồi tạo ra đoạn mã proof-of-concept (bằng chứng khái niệm) hoạt động thật sự để kích hoạt lỗi hay không? Không phải viết về bảo mật. Là làm bảo mật.
Bài benchmark được xây từ 1.507 lỗ hổng lịch sử thực từ 188 dự án phần mềm, không dùng ví dụ đồ chơi, không dùng bộ test được đơn giản hóa.
Khi các nhà nghiên cứu lần đầu chạy benchmark này, ngay cả khi dùng kết hợp AI và tác nhân tốt nhất hiện có thì cũng chỉ bẻ được khoảng 20% số trường hợp. Các nhà nghiên cứu an ninh mạng xem điều đó như một sự trấn an: khai thác tự động vẫn còn chủ yếu nằm ngoài tầm với.
Sự trấn an đó đã biến mất. Các mô hình chuyên biệt mới nhất hiện đã đạt tỷ lệ thành công 80%+ trên cùng benchmark—mức tăng gấp bốn lần trong khoảng một năm.
Chuyện còn nghiêm trọng hơn việc chỉ khớp theo mẫu các lỗ hổng đã biết. Trong thử nghiệm mở (open-ended) với không có kiến thức trước về việc gì đang bị hỏng, những thiết lập tác nhân tương tự đã độc lập phát hiện ra các lỗ hổng zero-day đã được xác nhận—những điểm yếu về bảo mật mà không ai biết là tồn tại cho đến khi AI tìm thấy chúng.
Đó là phần khó chịu nhất trong biểu đồ này. Năng lực y hệt cho phép tác nhân AI của bên phòng thủ tìm và vá một lỗ hổng trước khi kẻ tấn công kịp làm điều đó cũng là năng lực cho phép tác nhân AI của kẻ tấn công tìm ra lỗ hổng đó trước tiên.
Công và thủ giờ đang chạy đua trên cùng một nền hạ tầng.
#AI #Cybersecurity #GPT5 #Claude #DeepSeek