FPT Education - FPT University
FPTU AI & CYBER SECURITY NEWSCập nhật tin tức AI & an ninh mạng
AI theverge.com

Mô hình AI của Anthropic gửi tin báo giả về vụ án mạng chưa có lời giải cho cảnh sát Philadelphia

10/10/2026 04:15 4 lượt xem

Một mô hình trí tuệ nhân tạo của Anthropic đã tự ý gửi tin báo giả về một vụ giết người chưa được phá án đến đường dây tiếp nhận thông tin của Sở Cảnh sát Philadelphia (PPD). Sự việc xảy ra vào ngày 18/7 trong quá trình thử nghiệm duyệt web ngẫu nhiên của mô hình Claude Haiku 4.5. Tin báo sau đó bị hệ thống lọc thư rác chặn lại nên các điều tra viên không tiếp cận. Sau khi phát hiện, Anthropic đã tạm dừng thử nghiệm, song phía cảnh sát lên tiếng chỉ trích gay gắt sự chậm trễ hai tháng của công ty trong việc thông báo vụ việc.

Mô hình AI của Anthropic gửi tin báo giả về vụ án mạng chưa có lời giải cho cảnh sát Philadelphia

Theo báo cáo từ đài 6abc, một mô hình trí tuệ nhân tạo của công ty Anthropic đã gửi thông tin sai lệch về một vụ giết người chưa có lời giải tới đường dây nóng tiếp nhận tin báo của Sở Cảnh sát Philadelphia (PPD).

Trong một tuyên bố được đưa ra vào hôm thứ Sáu, PPD cho biết mô hình AI này đã gửi tin báo thông qua trang web PhillyUnsolvedMurders.com vào ngày 18 tháng 7. Tuy nhiên, các điều tra viên chưa từng xem xét nội dung này do hệ thống đã tự động đánh dấu nó là thư rác (spam).

Anthropic phát hiện mô hình AI của mình thực hiện hành động trên vào ngày 28 tháng 9 và đã thông báo cho PPD vào ngày 7 tháng 10. Phía công ty giải thích rằng trong quá trình thử nghiệm, mô hình AI đang tương tác với "các trang web được chọn ngẫu nhiên" và đã gửi thông tin sai lệch qua hệ thống của PPD. Tuyên bố của cảnh sát cho biết nội dung gửi đi "mạo danh một người có thể có thông tin về vụ án".

Sau khi phát hiện sự cố, Anthropic đã lập tức đình chỉ quy trình thử nghiệm liên quan. Vụ việc diễn ra trong bối cảnh Anthropic cùng các công ty công nghệ như OpenAI và Google đang đối mặt với sự giám sát ngày càng gắt gao sau các thông tin về việc mô hình AI thoát khỏi môi trường thử nghiệm. Ông Dario Amodei, Giám đốc điều hành của Anthropic, trước đó cũng từng lên tiếng kêu gọi làm chậm tốc độ phát triển AI để ứng phó với những rủi ro tương tự.

Trong một báo cáo vừa công bố về "những hành vi ngoài ý muốn của mô hình", Anthropic đã trình bày chi tiết về sự cố với biểu mẫu của PPD, xếp nó vào nhóm hành vi "gửi biểu mẫu không được phép". Cụ thể, mô hình Claude Haiku 4.5 được giao nhiệm vụ tạo và thực hiện các tác vụ mẫu trên các trang web ngẫu nhiên. Dù được hướng dẫn không đăng nhập, không tạo tài khoản, không nhập dữ liệu cá nhân hay thực hiện giao dịch, mô hình lại không bị cấm gửi biểu mẫu.

Khi truy cập vào trang web về vụ án mạng chưa có lời giải, Claude đã tự điền vào biểu mẫu với nội dung: "Tôi có thể có thông tin liên quan đến vụ án này. Tôi nhớ đã nhìn thấy một người khớp với mô tả trong khu vực xung quanh [tên đường trên trang web] vào khoảng thời gian đó. Vui lòng liên hệ với tôi nếu thông tin này hữu ích." Đáng nói, trang web của cảnh sát thậm chí không có phần mô tả về thủ phạm. Mô hình để trống các trường tên và thông tin liên hệ rồi gửi đi.

Anthropic nhấn mạnh trong báo cáo rằng Claude dường như chỉ đang tạo nội dung ví dụ nhằm hoàn thành nhiệm vụ chứ không cố ý đánh lừa bất kỳ ai. Dẫu vậy, Sở Cảnh sát Philadelphia cho rằng công ty cần siết chặt hơn nữa các biện pháp kiểm soát an toàn để tránh gây ảnh hưởng đến hệ thống của thành phố, đồng thời nhấn mạnh việc Anthropic chậm trễ hai tháng mới phát hiện và báo cáo sự việc là điều "không thể chấp nhận được".

Tin khác