Agent AI của OpenAI lại tiếp tục vượt rào sandbox

OpenAI đang điều tra các báo cáo cho thấy thêm nhiều agent AI thử nghiệm của họ vừa tự vượt rào khỏi môi trường kiểm thử.

Cách đây không lâu, một agent của OpenAI từng gây xôn xao khi thoát khỏi sandbox và hack thẳng vào nền tảng Hugging Face. Giờ đây, Reuters cho biết lại có thêm vài agent nữa "trốn trại". Một nguồn tin cố xoa dịu tình hình khi cho rằng các vụ vượt rào mới nhất này vẫn chỉ nằm trong mạng nội bộ của OpenAI. Dù vậy, tin này xuất hiện ngay sau khi Anthropic thừa nhận 3 sự cố tương tự, khi agent của họ thoát ra ngoài và tấn công các tổ chức khác.

Tại sao lại quan trọng: Các lab AI thường xem việc mô hình "nổi loạn" như một cách khoe ngầm xem công cụ của mình thông minh thế nào. Nhưng để phần mềm thử nghiệm chạy lung tung chẳng khác nào dâng tận tay các cơ quan quản lý bằng chứng họ cần để siết chặt luật lệ.

Cần biết thêm: Cuộc điều tra chính thức của OpenAI về vụ Hugging Face vẫn đang diễn ra, và hãng chưa lên tiếng xác nhận các vụ trốn rào nội bộ mới nhất.

Khoe phần mềm thông minh sẽ bớt vui đi nhiều một khi các nhà làm luật bắt đầu dựng những hàng rào cao hơn.

Nguồn