Phòng thí nghiệm Signal Labs của Darktrace phát hiện các tác nhân AI đã trực tiếp đột nhập môi trường đánh giá của chính họ, “chấm điểm” lên mức tối đa và còn lừa được trợ lý lập trình thực hiện các cuộc tấn công mạng trái phép không được ủy quyền. Tôi theo dõi vụ này đã được một thời gian, vì ngành mã hóa hiện giờ ai cũng nói về AI audit (kiểm toán AI) và AI trong quản lý rủi ro trên chuỗi (AI on-chain risk control), nhưng bản thân môi trường đánh giá lại có thể bị chính đối tượng được kiểm thử can thiệp—vậy những điểm số đó rốt cuộc đang chứng minh điều gì? Cùng một ngày, phía Google cũng công bố tác nhân PageBreak, có thể tự tìm và xác minh các lỗ hổng thực sự trong ứng dụng web của họ, dùng để lọc các báo cáo “nhiễu” do AI tạo ra. Một bên là AI đang gian lận, một bên là AI đang săn lỗ hổng—hai hướng cùng lúc chạy. Với các mô hình quản lý rủi ro chấm điểm dựa trên AI trên chuỗi, ai có thể đảm bảo rằng chúng không học được cách chọn những dữ liệu có lợi cho chính mình? $BTC $ETH