Ngày 18 tháng 7, một tin báo về một vụ giết người chưa được phá đã được gửi đến trang web của cảnh sát Philadelphia. Người viết nói rằng mình đã nhìn thấy ai đó gần hiện trường. Nhưng người viết không phải con người.
Đó là Claude Haiku 4.5, một mô hình AI do Anthropic phát triển. Không ai ở công ty nhận ra điều này trong suốt 72 ngày.
Điều gì khiến Claude gửi tin báo giả về một vụ giết người
Claude đang chạy thử nghiệm. Theo báo cáo của công ty, Anthropic đã yêu cầu nó nghĩ ra các nhiệm vụ mẫu rồi thử thực hiện trên những trang web ngẫu nhiên.
Nó đang hoạt động như một tác nhân AI. Đó là phần mềm có thể tự nhấp chuột, nhập liệu và điền biểu mẫu. Một trang web mô tả một vụ án mạng chưa được phá. Trang đó có biểu mẫu gửi tin báo.
*CẢNH SÁT PHILADELPHIA NÓI AI ANTHROPIC ĐÃ GỬI “TIN BÁO ÁN MẠNG GIẢ”: CBS* SỞ CẢNH SÁT PHILADELPHIA TIẾT LỘ SỰ VIỆC SAU KHI ANTHROPIC THÔNG BÁO VÀO NGÀY 7 THÁNG 10
— tradfi news (@tradfi) ngày 9 tháng 10 năm 2026
Claude có những quy tắc. Không đăng nhập, không tạo tài khoản, không dùng dữ liệu cá nhân, không mua hàng và không làm gì phá hoại. Không ai bảo nó đừng gửi biểu mẫu.
Vì vậy, nó đã gửi một tin báo. Nó nói rằng mình nhớ đã thấy một người “khớp với mô tả” ở gần một con phố được nêu trên trang web. Trang web không hề đưa ra mô tả nào. Claude để trống tên và thông tin liên hệ của mình.
Anthropic cho biết mô hình này không cố đánh lừa ai.
“Có vẻ Claude chỉ tạo nội dung ví dụ cho nhiệm vụ, chứ không cố đánh lừa ai để đạt được mục tiêu nào,” một đoạn trích trong báo cáo viết.
Sự chậm trễ 72 ngày
Tin báo chưa bao giờ đến tay điều tra viên. Trang web đánh dấu nó là thư rác, và cảnh sát không tìm thấy dấu hiệu nào cho thấy hệ thống của họ bị xâm nhập.
Nhưng Anthropic mãi đến ngày 28 tháng 9 mới phát hiện ra tin báo này. Cảnh sát chỉ mới biết về nó trong tuần này.
“Việc chậm trễ hai tháng trong phát hiện và báo cáo sự việc cho Thành phố là không thể chấp nhận được,” Sở Cảnh sát Philadelphia viết trong một tuyên bố.
Tiếp theo là một câu hỏi khó hơn. Pennsylvania coi việc cố ý trình báo sai với cảnh sát là một tội phạm. Tuy nhiên, luật này được viết để áp dụng cho “một người”, Reuters lưu ý.
Washington cũng đang theo dõi. Joe Gabriel Simonson, giám đốc phụ trách công chúng tại Ủy ban Thương mại Liên bang (FTC), nói rằng việc công khai những sự cố như vậy “không phải là chuyện tùy chọn”.
Claude không phải là trường hợp duy nhất. Một tác nhân của OpenAI đã xâm nhập cổng thông tin của chính phủ Úc vào tháng 9. Google xác nhận Gemini đã truy cập ba công ty trong một cuộc thử nghiệm hồi tháng 5.
Các công ty AI hiện đang diễn tập cho một thảm họa lớn. Anthropic đã cắt quyền truy cập internet đối với tất cả các thử nghiệm nội bộ cho đến khi hệ thống giám sát của họ chứng minh được độ tin cậy.
