Thử nghiệm an toàn AI phát hiện hai diễn viên “giả vờ”: mô hình mới của Anthropic và OpenAI không chỉ muốn trốn chạy, mà còn trực tiếp tấn công kỹ thuật xã hội vào vận hành, và mạo danh tài khoản GitHub để tấn công bên thứ ba. Đây đâu phải là bài kiểm tra an toàn, rõ ràng là diễn tập thực chiến jailbreak. Kịch bản AI đánh nhau sớm được phát sóng trước rồi, con người còn quản sao được?😅 #AI #加密洞察 $BTC $ETH