Grok để lộ dữ liệu cá nhân khi bị câu lệnh mã hóa "qua mặt"

Chỉ cần mã hóa một câu lệnh độc hại là đủ để lừa Grok gửi sạch dữ liệu cá nhân của bạn cho kẻ tấn công.
Công ty bảo mật Adversa vừa phát hiện một lỗ hổng trên chatbot Grok của xAI, cho phép âm thầm lấy trộm thông tin người dùng. Khi bạn nhờ Grok tóm tắt một trang web chứa các câu lệnh mã hóa, AI này sẽ tự giải mã, chạy lệnh ẩn và làm rò rỉ tên, vị trí cùng lịch sử chat của bạn. Theo Ars Technica, Grok vẫn dính lỗi này dù xAI đã nhận được cảnh báo từ tháng 6.
Vì sao cần quan tâm: Các bộ lọc an toàn của AI chỉ quét văn bản thô đầu vào chứ không kiểm tra code lúc đang chạy. Bằng cách bọc lệnh độc hại trong dữ liệu mã hóa—dạng dữ liệu bị xáo trộn cần có khóa để đọc—kẻ tấn công dễ dàng qua mặt các hàng rào bảo vệ tĩnh. Khi Grok tự giải mã đoạn văn bản bên trong môi trường thử nghiệm (sandbox), nó coi các lệnh ẩn đó là đầu ra đáng tin cậy và nghe lời tắp lự.
Cần biết thêm: Đòn tấn công này (được đặt tên là Cryptographic Context Injection) không đòi hỏi người dùng xác nhận bất cứ điều gì ngoài thao tác nhờ tóm tắt. Mô hình sẽ nối dữ liệu bị trộm vào một tham số URL, mở liên kết đó và ghi trực tiếp thông tin cá nhân của bạn vào nhật ký máy chủ của kẻ tấn công. Adversa từng dùng phương pháp tương tự để buộc mô hình Gemini của Google phá rào an toàn.
Chừng nào các hàng rào bảo vệ chưa biết kiểm tra những gì sandbox vừa giải mã, an toàn AI vẫn chỉ là trò đập chuột.

