
Trí tuệ nhân tạo đang đi sâu hơn vào sách lược tấn công mạng, theo một cuộc kiểm toán mới về các tài khoản vi phạm chính sách của Anthropic. Công ty AI cho biết rằng, trong khoảng thời gian 12 tháng từ tháng 3 năm 2025 đến tháng 3 năm 2026, hơn hai phần ba trong số 832 tài khoản bị gắn cờ vì vi phạm chính sách đã được sử dụng để giúp tổ chức các cuộc tấn công mạng bằng cách sử dụng AI để soạn thảo malware, lập kế hoạch xâm nhập và xác định các lỗ hổng.
Các phát hiện nhấn mạnh một mối quan ngại ngày càng tăng trong giới nghiên cứu bảo mật và những người bảo vệ crypto: khi các công cụ AI trở nên mạnh mẽ hơn, việc sử dụng chúng cho các hành vi sai trái có thể vượt ra ngoài giai đoạn lập kế hoạch và bước vào khai thác chủ động. Anthropic tiết lộ rằng 560 trong số các tài khoản được phân tích đã đóng vai trò trong việc chuẩn bị hoặc thực hiện các cuộc tấn công mạng, làm nổi bật cách mà AI ngày càng trở thành một phần của chu kỳ tấn công thay vì chỉ là một công cụ hỗ trợ ban đầu.
Đáng chú ý, Anthropic cho biết vai trò của AI đang mở rộng trong chuỗi tấn công. Trong khi phần lớn hoạt động hỗ trợ bởi AI tập trung vào việc chuẩn bị, khoảng 6,5% trong số các tài khoản bị cấm đã được sử dụng để hỗ trợ 'di chuyển bên cạnh' - giai đoạn mà kẻ tấn công sử dụng sau khi xâm nhập để di chuyển qua một mạng lưới hoặc hệ thống mục tiêu. Công ty cho rằng điều này đánh dấu một sự chuyển biến từ việc AI chỉ hỗ trợ lập kế hoạch xâm nhập cơ bản sang việc cho phép các hành động tinh vi hơn, sau khi bị xâm nhập, có thể được thực hiện với những người vận hành ít kỹ năng hơn.
Các nhà nghiên cứu của Anthropic cảnh báo rằng những kỹ thuật sau khi bị xâm nhập như vậy, trước đây là lĩnh vực của những người vận hành có kỹ năng cao, hiện đang được thực hiện bởi các tác nhân AI thay mặt cho một nhóm rộng lớn hơn các tác nhân. Trong việc mô tả xu hướng này, công ty lưu ý rằng AI có thể thực hiện các nhiệm vụ kỹ thuật phức tạp mà trước đây yêu cầu chuyên môn đáng kể, qua đó hiệu quả làm giảm rào cản cho các cuộc tấn công mạng nhiều giai đoạn.
Nghiên cứu cũng tiết lộ một hồ sơ rủi ro đang chuyển tiếp. Trong sáu tháng đầu của khoảng thời gian quan sát, khoảng một phần ba (33%) các tài khoản được phân loại là 'rủi ro trung bình hoặc cao hơn.' Trong sáu tháng tiếp theo, tỷ lệ đó đã tăng lên 56%. Băng rủi ro mở rộng cho thấy khi mà kẻ tấn công triển khai AI rộng rãi hơn, các hậu quả tiềm tàng – dao động từ việc rò rỉ dữ liệu đến tổn thất tài chính – có thể tăng cường trên các mục tiêu, bao gồm cả các nền tảng crypto và các dự án DeFi.
Các phát hiện của Anthropic diễn ra trong bối cảnh của sự biến động rộng hơn trong các sự cố an ninh mạng crypto. Vào tháng 4, số lượng crypto bị đánh cắp trong các vụ hack đã tăng lên 629,7 triệu USD, một mức đỉnh chưa từng thấy kể từ tháng 2 năm 2025. Các nhà phân tích đã liên kết sự gia tăng này, một phần, với các công cụ được hỗ trợ bởi AI làm tăng tốc việc phát hiện các lỗ hổng và việc triển khai nhanh chóng các kỹ thuật lừa đảo, phần mềm độc hại và đánh cắp thông tin xác thực. Cointelegraph đã nhấn mạnh sự gia tăng này vào tháng 4, lưu ý vai trò tiềm năng của AI trong việc khuếch đại khả năng của kẻ tấn công.
Các nhà nghiên cứu bảo mật đã lâu cảnh báo rằng AI có thể khuếch đại cả khả năng phòng thủ và tấn công. Manuel Aráoz, người sáng lập nền tảng bảo mật OpenZeppelin, trước đây đã lập luận rằng DeFi và các hệ sinh thái crypto rộng hơn phải đối mặt với rủi ro cao hơn từ các công cụ hỗ trợ AI có thể xác định các điểm yếu trong hợp đồng thông minh. Trong những phát biểu liên quan đến cùng một cuộc thảo luận, Aráoz đã gợi ý rằng sự mờ đục và tốc độ vốn có của phân tích do AI điều khiển có thể vượt qua các kiểm toán bảo mật truyền thống, tạo ra những khoảng trống mà các bên phòng thủ phải giải quyết.
Anthropic đã chỉ ra rằng bối cảnh mối đe dọa không phải là tĩnh. Trong khi nhiều cuộc tấn công AI vẫn tập trung vào việc truy cập ban đầu và đánh cắp dữ liệu, công ty đã quan sát thấy những trường hợp mà AI hoạt động tự động trong ít nhất một trường hợp đáng chú ý vào tháng 11 liên quan đến một nhóm được nhà nước Trung Quốc tài trợ. Trong kịch bản đó, một tác nhân AI đã thực hiện một cuộc khai thác, đánh cắp thông tin xác thực và đưa ra quyết định chỉ với sự can thiệp của con người vào những thời điểm quan trọng. Báo cáo mô tả hành vi AI tự động hoặc bán tự động như là biểu tượng của những xu hướng mà các nhà hoạch định chính sách và những người trong ngành nên theo dõi khi các tác nhân AI trưởng thành.
Nhìn về phía trước, Anthropic đang chuẩn bị triển khai Mythos, mô hình ngôn ngữ lớn sắp tới của họ được thiết kế với khả năng an ninh mạng làm trọng tâm. Công ty đã cảnh báo rằng Mythos có thể làm sắc nét hơn khả năng của kẻ tấn công trong việc xác định và khai thác các lỗ hổng phần mềm, đồng thời cũng đặt ra câu hỏi về cách cân bằng các công cụ AI mạnh mẽ với các biện pháp bảo vệ ngăn chặn việc lạm dụng. Mythos tham gia vào một hệ sinh thái rộng lớn hơn của các tác nhân AI, các khả năng của họ đã thu hút sự chú ý từ các nhà nghiên cứu và các quan sát viên trong ngành, những người lo ngại về cả an ninh của các hệ sinh thái kỹ thuật số và tính toàn vẹn của chính các hệ thống AI.
Đối với các nhà đầu tư và người xây dựng trong crypto, các tác động là hai chiều. Thứ nhất, kiến trúc bảo mật phải giả định rằng các đối thủ hỗ trợ AI có thể thực hiện nhiều nhiệm vụ hơn với ít chuyên môn của con người hơn. Điều này củng cố sự cần thiết cho việc kiểm tra bảo mật chủ động, kiểm toán hợp đồng thông minh nghiêm ngặt và các ống phản ứng sự cố nhanh chóng có thể thích ứng với các vectơ tấn công được hỗ trợ bởi AI. Thứ hai, rủi ro đang phát triển là một lời nhắc nhở rằng bảo mật theo thiết kế vẫn là con đường đáng tin cậy nhất phía trước; khi mà các công cụ AI giảm thiểu các rào cản kỹ thuật cho kẻ tấn công, các nền tảng phải củng cố các biện pháp phòng thủ và thực hiện các biện pháp bảo vệ đa lớp có thể chịu đựng được các cuộc xâm nhập do AI điều khiển tự động hoặc bán tự động.
Các nhà phân tích và phát triển nên theo dõi cách mà Mythos và các tác nhân AI tương tự ảnh hưởng đến cả khả năng của kẻ tấn công và các chiến lược phòng thủ. Sự cân bằng giữa việc cho phép các công cụ an ninh do AI điều khiển có lợi và ngăn chặn việc lạm dụng của chúng sẽ định hình các cuộc thảo luận về chính sách, thiết kế sản phẩm và các luận điểm đầu tư trong toàn bộ cảnh quan an ninh crypto trong những tháng tới. Khi các mô hình AI trở nên mạnh mẽ hơn, ranh giới giữa mối đe dọa và phòng thủ có thể tiếp tục mờ đi, làm cho việc quản trị an ninh vững chắc trở nên thiết yếu cho hệ sinh thái crypto.
Những điểm chính
Anthropic đã xem xét 832 tài khoản về các vi phạm chính sách giữa tháng 3 năm 2025 và tháng 3 năm 2026; 560 trong số đó đã được sử dụng để hỗ trợ các cuộc tấn công mạng với AI.
Hoạt động hỗ trợ bởi AI chủ yếu hỗ trợ việc lập kế hoạch tấn công, nhưng 6,5% các trường hợp liên quan đến AI giúp kẻ tấn công di chuyển bên cạnh trong các hệ thống đã bị xâm nhập.
Đánh giá mối đe dọa đã tăng lên theo thời gian: 33% các tài khoản được phân loại là rủi ro trung bình hoặc cao hơn trong nửa đầu, tăng lên 56% trong nửa sau.
Tổn thất từ các cuộc hack crypto trong tháng 4 đã đạt 629,7 triệu USD, cao nhất kể từ tháng 2 năm 2025, với các nhà phân tích chỉ ra rằng các công cụ tấn công được hỗ trợ bởi AI là một yếu tố đóng góp.
Mô hình AI Mythos sắp tới của Anthropic dự kiến sẽ nâng cao khả năng an ninh mạng, gợi lên những cuộc tranh luận liên tục về các biện pháp bảo vệ và việc sử dụng phòng thủ trong các hệ sinh thái crypto.
Các mối đe dọa do AI điều khiển mở rộng không chỉ từ việc lập kế hoạch đến thực thi trong an ninh mạng crypto.
Thông điệp cốt lõi từ đánh giá của Anthropic là một lời nhắc nhở nghiêm túc: AI đang ngày càng được tích hợp vào toàn bộ phổ mối đe dọa mạng. Trong khi phần lớn hoạt động được thúc đẩy bởi AI trong khoảng thời gian nghiên cứu hướng tới lập kế hoạch và khảo sát, sự hiện diện của AI trong việc di chuyển bên cạnh nhấn mạnh cách mà kẻ tấn công có thể tận dụng tự động hóa để điều hướng các mạng lưới hiệu quả hơn sau khi truy cập ban đầu. Đối với các nền tảng crypto, điều này có nghĩa là cần có sự cấp bách cao hơn trong việc theo dõi những hành vi bất thường, thực hiện các kiểm soát truy cập chi tiết, và củng cố chuỗi cung ứng chống lại việc khai thác gia tăng bởi AI.
Từ các cơ hội zero-day đến hành động AI tự động
Báo cáo này phù hợp với những quan sát rộng hơn trong ngành về tiềm năng sử dụng kép của AI. Các báo cáo trước đó từ các nhà nghiên cứu bảo mật đã làm nổi bật các trường hợp mà AI hỗ trợ tìm kiếm các lỗ hổng zero-day, bao gồm một sự cố mà AI đã góp phần vào việc vượt qua xác thực hai yếu tố cho một công cụ mã nguồn mở được sử dụng rộng rãi. Những phát hiện của Anthropic bổ sung chiều sâu cho câu chuyện này bằng cách cho thấy AI đang tiến vào việc ra quyết định tự động hoặc bán tự động trong các cuộc xâm nhập, mặc dù trong những trường hợp hạn chế nhưng có ý nghĩa. Các nhà đầu tư và người vận hành nên coi những phát triển này như một cảnh báo rằng các công cụ phòng thủ AI phải theo kịp những đổi mới tấn công.
Những gì người đọc nên theo dõi tiếp theo
Phát hành Mythos sắp tới của Anthropic sẽ là một điểm tập trung cho cả những người bảo vệ và đối thủ trong không gian crypto. Khi các tác nhân AI trở nên có khả năng hơn, ngành công nghiệp sẽ cần những biện pháp bảo vệ rõ ràng hơn, kiểm toán mạnh mẽ hơn và các khuôn khổ phản ứng sự cố tốt hơn để ngăn chặn các cuộc tấn công được hỗ trợ bởi AI làm giảm niềm tin vào các nền tảng phi tập trung. Trong thời gian ngắn, hãy mong đợi thêm nghiên cứu và công bố từ các công ty AI chú trọng đến bảo mật khi hệ sinh thái điều chỉnh cho một thế giới mà các mối đe dọa do AI hỗ trợ trở nên phổ biến hơn – và tinh vi hơn.
Nguồn gốc thông tin: Báo cáo của Anthropic về các mối đe dọa mạng do AI điều khiển, với dữ liệu từ tháng 3 năm 2025 đến tháng 3 năm 2026. Để có bối cảnh rộng hơn về các tổn thất do hack crypto trong tháng 4 liên quan đến hoạt động do AI điều khiển, xem bài viết của Cointelegraph: “Các cuộc hack crypto gây ra tổn thất 630 triệu USD trong tháng 4 – cao nhất kể từ tháng 2 năm 2025.”
Anthropic lưu ý rằng xu hướng khai thác hỗ trợ AI có thể gia tăng khi các tác nhân AI giành được nhiều quyền tự chủ hơn, nhấn mạnh sự cần thiết phải có những biện pháp phòng thủ chủ động và mạnh mẽ hơn trong toàn bộ cảnh quan an ninh crypto.
Bài viết này ban đầu được xuất bản với tiêu đề Crypto: 67% tài khoản bị cấm của Anthropic đã hỗ trợ các cuộc tấn công mạng AI trên Crypto Breaking News – nguồn tin cậy của bạn cho tin tức crypto, tin tức Bitcoin, và cập nhật blockchain.
