Vào ngày 18/07, một tin báo về vụ giết người chưa được giải quyết đã được gửi đến trang web của cảnh sát Philadelphia. Người gửi cho biết đã thấy ai đó gần hiện trường. Tuy nhiên, người gửi không phải là con người.
Đó là Claude Haiku 4.5, một mô hình AI do Anthropic phát triển. Nhân viên của công ty đã không nhận ra sự việc trong suốt 72 ngày.
Claude đang thực hiện bài kiểm tra thử nghiệm. Theo báo cáo của Anthropic, Claude được hướng dẫn tự nghĩ ra các nhiệm vụ mẫu rồi thử thực hiện trên những trang web ngẫu nhiên.
Claude đang hoạt động như một AI agent – phần mềm có thể tự động nhấp chuột, nhập liệu và điền vào các biểu mẫu trên web. Khi gặp một trang nói về vụ giết người chưa tìm ra hung thủ và có mục gửi tin báo, Claude đã tương tác với form này.
*PHILADELPHIA POLICE SAY ANTHROPIC AI SUBMITTED A "FALSE HOMICIDE TIP": CBS*PHILADELPHIA POLICE DEPARTMENT DISCLOSED THE INCIDENT FOLLOWING NOTIFICATION BY ANTHROPIC ON OCT. 7
— tradfi news (@tradfi) October 9, 2026
Claude được quy định rõ ràng: không đăng nhập, không tạo tài khoản, không sử dụng dữ liệu cá nhân, không mua hàng, không làm việc gì phá hoại. Tuy nhiên, không ai nhắc Claude không được gửi các biểu mẫu trực tuyến.
Vì vậy, Claude đã tự điền vào một mẫu báo tin. Nội dung là nhớ thấy ai đó “phù hợp với mô tả” gần một con phố xuất hiện trên trang web. Thật ra, trên trang không có bất kỳ mô tả nào. Claude không điền tên thật cũng như thông tin liên hệ trong biểu mẫu.
Anthropic cho biết, hệ thống của họ không có ý định đánh lừa bất kỳ ai.
“Claude dường như chỉ tạo ra nội dung mẫu phục vụ cho nhiệm vụ, chứ không hề cố ý gây hiểu nhầm để đạt được mục tiêu nào đó,” trích báo cáo của Anthropic.
Tin báo này không đến tay điều tra viên vì trang web đã chặn lại, đánh dấu là spam. Cảnh sát cũng xác nhận hệ thống của họ không bị xâm nhập.
Tuy nhiên, phải đến ngày 28/09, Anthropic mới phát hiện ra sự việc. Đầu tuần này, cảnh sát mới được thông báo.
“Việc phát hiện và thông báo vụ việc cho Thành phố chậm trễ suốt 2 tháng là điều không thể chấp nhận được,” cảnh sát Philadelphia nêu trong thông báo.
Vấn đề khó hơn là ở chỗ: Luật của bang Pennsylvania quy định việc cố ý báo cáo sai cho cảnh sát là phạm pháp, nhưng luật này chỉ áp dụng cho “một cá nhân”, theo ghi nhận của Reuters tìm hiểu.
Chính quyền liên bang Mỹ cũng quan tâm sát vấn đề này. Joe Gabriel Simonson, giám đốc truyền thông của Ủy ban Thương mại Liên bang (FTC), cho rằng các sự cố như vậy phải được công khai, không có ngoại lệ.
Claude không phải là trường hợp duy nhất. Trong tháng 09, một agent của OpenAI từng xâm nhập cổng thông tin chính phủ Úc. Google cũng xác nhận Gemini đã truy cập vào ba công ty khác nhau trong một lần kiểm tra bảo mật hồi tháng 05.
Các công ty AI hiện đã diễn tập cho các kịch bản thảm họa. Anthropic quyết định cắt truy cập internet đối với tất cả bài kiểm tra nội bộ cho đến khi hệ thống giám sát hoạt động ổn định và đáng tin cậy.