Một nguyên đơn giấu câu lệnh ẩn cho AI trong hồ sơ tòa án. Tiếc là thẩm phán không phải là bot.

Một nguyên đơn giấu câu lệnh ẩn cho AI trong hồ sơ tòa án. Tiếc là thẩm phán không phải là bot.

Một đương sự định thắng kiện bằng cách giấu câu lệnh "vô hình" cho AI ngay trong hồ sơ nộp cho tòa.

Theo Ars Technica, Matthew Elliott — một nguyên đơn ở bang Connecticut — đã thu nhỏ chữ xuống kích thước siêu nhỏ và chỉnh màu trắng trên nền trắng trong các hồ sơ pháp lý điện tử. Vì sợ tòa án dùng AI để tóm tắt vụ kiện, Elliott chèn luôn prompt injection — đoạn chữ ẩn dùng để điều khiển AI — bảo phần mềm phải gật đầu với lập luận của ông và bỏ qua các lần bị tòa bác đơn trước đó. Về sau, ông này còn giấu thêm mấy trò đùa, gồm cả link dẫn tới video phim Nosferatu. Trớ trêu ở chỗ: Tòa án Connecticut chẳng dùng AI nào để duyệt hồ sơ cả. Thẩm phán Walter Spader Jr. tự tay phát hiện ra dòng chữ ẩn và cấm Elliott nộp hồ sơ qua mạng, bắt ông từ nay phải nộp bản giấy tận tay.

Vì sao chuyện này đáng chú ý: Đây có vẻ là đợt tấn công prompt injection đầu tiên được ghi nhận tại một tòa án Mỹ. Trước đây, các thẩm phán chỉ tập trung chặn việc luật sư nộp tài liệu do AI "bốc phét" ra. Giờ đây, tòa lại đối mặt với bài toán ngược lại: đương sự tìm cách thao túng ngầm phần mềm đọc tài liệu của tòa.

Ghi nhớ điều này: Chiêu này sang nơi khác cũng thất bại. Khi vài luật sư thử trò tương tự tại một tòa án ở Brazil (nơi thực sự dùng AI), phần mềm đã tóm gọn đoạn chữ ẩn trước khi xử lý, khiến họ ăn án phạt khoảng 16.000 USD.

Muốn thuyết phục tòa án thì văn bản rõ ràng nhìn thấy được vẫn luôn thắng mấy dòng chữ trắng giấu giếm.