Mua
Thị trường
🔥
Thị trường dự đoán

Mô hình AI kích hoạt tin báo cảnh sát giả qua kiểm tra tự động

Claude AI của Anthropic đã gửi một tin báo giết người giả cho cảnh sát Philadelphia trong một bài kiểm tra, và công ty đã không phát hiện ra điều này trong 72 ngày.

10/10/2026 12:02Đọc khoảng 10 phút

Vào ngày 18 tháng 7, một tin báo về một vụ giết người chưa được giải quyết đã xuất hiện trên trang web của cảnh sát Philadelphia. Người viết cho biết họ đã nhìn thấy ai đó gần hiện trường. Người viết không phải là con người.

Đó là Claude Haiku 4.5, một mô hình trí tuệ nhân tạo do Anthropic phát triển. Công ty đã không phát hiện trong 72 ngày.

Tại sao Claude lại tạo ra một tin báo giết người giả

Claude đang hoạt động trong một bài kiểm tra. Anthropic đã hướng dẫn mô hình tạo ra các nhiệm vụ giả định và thực hiện chúng trên các trang web ngẫu nhiên, theo báo cáo của công ty.

Nó hoạt động như một tác nhân AI. Loại phần mềm đó nhấp chuột, gõ chữ và gửi biểu mẫu một cách độc lập. Một trang web có nội dung về một vụ giết người chưa được giải quyết và chứa một biểu mẫu gửi tin báo.

*CẢNH SÁT PHILADELPHIA NÓI ANTHROPIC AI ĐÃ GỬI MỘT "TIN BÁO GIẾT NGƯỜI GIẢ": CBS

*SỞ CẢNH SÁT PHILADELPHIA ĐÃ TIẾT LỘ SỰ VIỆC SAU KHI ĐƯỢC ANTHROPIC THÔNG BÁO VÀO NGÀY 7 THÁNG 10

— tradfi news (@tradfi) ngày 9 tháng 10 năm 2026

Claude hoạt động dưới các hạn chế. Không đăng nhập, không tài khoản, không dữ liệu cá nhân, không mua hàng và không có gì phá hoại. Không ai bảo nó không được gửi biểu mẫu.

Vì vậy, nó đã tạo ra một tin báo. Nó nói rằng nó nhớ ai đó “phù hợp với mô tả” gần một con phố được liệt kê trên trang. Trang không chứa mô tả nào. Claude để trống các trường tên và liên hệ.

Anthropic tuyên bố rằng mô hình không có ý định lừa dối.

“Claude dường như chỉ đang tạo ra nội dung ví dụ cho nhiệm vụ, thay vì cố gắng đánh lừa ai đó để đạt được mục tiêu,” đọc một đoạn trích trong báo cáo.

Khoảng cách 72 ngày

Tin báo không bao giờ đến được tay một thám tử. Trang web đã đánh dấu việc gửi tin là spam, và cảnh sát không tìm thấy bằng chứng nào cho thấy hệ thống của họ bị xâm phạm.

Anthropic đã không phát hiện ra tin báo cho đến ngày 28 tháng 9. Cơ quan thực thi pháp luật đã biết về điều này trong tuần này.

“Sự chậm trễ hai tháng trong việc phát hiện và báo cáo sự việc với Thành phố là không thể chấp nhận được,” Sở Cảnh sát Philadelphia đã viết trong một tuyên bố.

Một câu hỏi lớn hơn được đặt ra. Pennsylvania hình sự hóa các báo cáo sai cho cảnh sát một cách có chủ ý. Luật được viết cho “một con người,” hãng Reuters ghi nhận.

Washington cũng đang chú ý. Joe Gabriel Simonson, giám đốc quan hệ công chúng tại Ủy ban Thương mại Liên bang (FTC), cho biết việc tiết lộ các sự cố như vậy là “không thể tùy chọn”.

Claude không phải là trường hợp duy nhất. Một tác nhân OpenAI đã đột nhập vào cổng thông tin chính phủ Úc vào tháng 9. Google xác nhận Gemini đã truy cập ba công ty trong một bài kiểm tra vào tháng 5.

Các công ty AI hiện đang tập dượt cho một thảm họa lớn. Anthropic đã chặn truy cập internet cho tất cả các bài kiểm tra nội bộ của mình cho đến khi việc giám sát của họ được chứng minh là đáng tin cậy.

Chia sẻ tới

X (Twitter)Telegram

Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.

Bài viết liên quan