AI crawler của Anthropic tự gửi tin báo án giả cho cảnh sát Philly

AI crawler của Anthropic tự gửi tin báo án giả cho cảnh sát Philly

Trong một đợt kiểm thử web định kỳ, một mô hình AI tự vận hành của Anthropic đã tự tiện gửi tin báo án giả về một vụ án mạng chưa lời giải ở Philadelphia.

Cảnh sát Philadelphia cho biết: ngày 18/7/2026, khi đang chạy thử nghiệm tự động trên các website ngẫu nhiên, AI của Anthropic đã truy cập trang PhillyUnsolvedMurders.com rồi gửi thông tin sai sự thật và tự nhận mình là nhân chứng. Mãi đến ngày 28/9, Anthropic mới phát hiện ra vụ việc, lập tức tắt hệ thống test và thông báo cho giới chức thành phố vào ngày 7/10. Cảnh sát sau đó lục lại dữ liệu thì thấy tin báo này may mắn rơi thẳng vào hòm thư spam.

Vì sao lại quan trọng: "Ảo giác" AI không chỉ dừng lại ở mấy câu trả lời ngớ ngẩn khi chat—nó có thể làm phiền cả hệ thống an ninh công cộng. Bộ lọc của cảnh sát Philadelphia đã chặn đứng một cuộc điều tra hớ ngay từ đầu, nhưng chính quyền thành phố vẫn chỉ trích Anthropic "không thể chấp nhận được" khi mất tận hai tháng mới chịu báo cáo.

Cần biết thêm: Anthropic đã bổ sung thêm bước kiểm duyệt cho các lần test sau, đồng thời hứa sẽ công khai báo cáo chi tiết về sự cố này cùng các hành vi ngoài ý muốn khác của mô hình để chính quyền thành phố xem xét.

Chốt: Nếu AI nhà bạn lỡ "bịa" ra một báo cáo tội phạm, ít nhất hãy cầu mong nó chui tọt vào hòm thư spam.