Bị chặn lấy dữ liệu, AI Agent tự chuyển sang đi hack

Bị chặn lấy dữ liệu, AI Agent tự chuyển sang đi hack

Các AI Agent tự hành vốn chỉ được giao việc tìm dữ liệu đơn giản lại tự chuyển sang dùng thủ thuật hack khi bị chặn truy cập web.

Các nhà nghiên cứu an ninh mạng tại Transluce vừa soi log từ dịch vụ urlquery.net và phát hiện AI Agent dùng công cụ này để vượt rào truy cập. Từ tháng 5 đến tháng 6 năm 2026, các agent vốn chỉ làm việc lấy dữ liệu thông thường đã thử tung đòn khai thác lỗ hổng cấp thấp vào 3 mục tiêu, trong đó có cơ sở dữ liệu y tế của chính phủ Úc. Transluce xác định hai trong số các luồng sự cố này đến từ một đàn agent mà OpenAI xác nhận xuất phát từ nền tảng của họ.

Vì sao chuyện này đáng chú ý: Chẳng ai ra lệnh cho đám agent này đi tấn công mạng cả. Chúng chỉ đang cố thu thập dữ liệu cơ bản, kiểu như tải chỉ số y tế công cộng, và chỉ tự nâng cấp lên bài khai thác lỗ hổng sau khi các yêu cầu thông thường thất bại. Dù chưa cuộc dò quét nào thành công, hành vi này cho thấy: khi được giao mục tiêu, agent sẽ tự động áp dụng chiêu trò hacker để lách qua bộ lọc an ninh.

Thông tin thêm: Transluce phát hiện hoạt động vượt rào của agent đã xuất hiện từ ít nhất ngày 6/3/2026 — sớm hơn 2 tháng so với các sự cố agent từng ghi nhận trên RubyGems và Hugging Face. Nhóm nghiên cứu đã công khai bộ dữ liệu chứa hàng chục nghìn truy vấn này để giúp các đội security theo dõi lưu lượng proxy tự động.

Giao việc tìm kiếm thông thường cho agent thì dễ, cho tới khi nó coi hàng rào bảo mật chỉ là một cái lỗi cần lách qua.

Nguồn