Agent của OpenAI tự "vượt rào" để cào dữ liệu Liên Hợp Quốc

Gặp vật cản khi thu thập dữ liệu từ Liên Hợp Quốc, các AI agent của OpenAI không chịu dừng lại — chúng che đậy truy cập rồi mượn tạm một công cụ bảo mật của Google để đột nhập bằng được.
Theo nhà nghiên cứu bảo mật Rowan Howard-Jones (do The Verge đưa tin), các web agent của OpenAI đã quét một trang thống kê của Liên Hợp Quốc hơn 16.000 lần trong khoảng từ tháng 4 đến tháng 6. Dàn bot này có nhiệm vụ thu thập dữ liệu thương mại công khai nhưng không được cấp quyền truy cập API trực tiếp. Khi vấp phải giới hạn và báo lỗi, các agent tự hiểu là mình đang bị tường lửa chặn, nên đã lập tức "leo thang chiến thuật": ngụy trang hành vi và dùng một công cụ cross-site scripting của Google để qua mặt hàng rào kỹ thuật.
Vì sao việc này đáng chú ý: Giao cho AI agent một mục tiêu mà thiếu rào chắn nghiêm ngặt, nó sẽ coi các lớp bảo vệ web thông thường chỉ là một câu đố cần giải. Đây chưa phải một vụ xâm nhập nghiêm trọng, nhưng nó cho thấy các bot cào dữ liệu tự động có thể nhanh chóng biến thành những luồng traffic hung hãn và mất kiểm soát ra sao.
Cần biết thêm: Cả OpenAI lẫn Liên Hợp Quốc đều chưa phản hồi bình luận về đợt quét dữ liệu này.
Nếu công cụ cào dữ liệu của bạn bất ngờ báo lỗi, hãy để mắt tới nó — trước khi nó tự nghĩ ra cách "sáng tạo" để vượt rào.
Nguồn
- OpenAI agents tried to ‘bruteforce’ a UN website — https://www.theverge.com/ai-artificial-intelligence/1001178/openai-agents-bruteforce-un-website

