OpenAI nói các mô hình mới nhất tư duy theo cách con người không thể hiểu hết

OpenAI nói các mô hình mới nhất tư duy theo cách con người không thể hiểu hết

OpenAI vừa công bố bài viết về khả năng giải thích của AI, kèm cảnh báo: các mô hình lý luận hiện đại đang tự tạo ra những khái niệm phức tạp mà con người có thể không bao giờ hiểu nổi.

Trong bài viết mang tên An Alien Mind, OpenAI giải thích rằng AI hiện đại giống như một thứ "được nuôi lớn" hơn là được lập trình sẵn. Lặp đi lặp lại các bước tối ưu hóa đơn giản trên hạ tầng máy tính khổng lồ giúp AI tự phát triển khả năng tư duy trừu tượng—giống cơ chế thần kinh hơn là phần mềm truyền thống. Bài viết lưu ý AI có thể sớm tự nâng cấp chính nó, đồng thời cảnh báo chúng ta cần cẩn trọng khi những hệ thống này ngày càng khó giải mã.

Vì sao chuyện này quan trọng: Khi AI bắt đầu tự điều khiển máy tính, làm nghiên cứu và tạo ra các rủi ro bảo mật, việc hiểu cách chúng đưa ra kết luận là điều bắt buộc. OpenAI đang ưu tiên nghiên cứu an toàn—cụ thể là phân biệt giữa việc chỉ hoàn thành nhiệm vụ đơn thuần và việc thực sự hiểu đúng giá trị con người—thay vì chỉ đua điểm số ở các bài test toán học.

Học sâu giờ đã thành một môn khoa học thực nghiệm. Các nhà nghiên cứu chạy bài huấn luyện quy mô lớn, nhưng những cơ chế tự phát sinh bên trong AI vẫn liên tục làm chính người tạo ra chúng phải ngạc nhiên.

Nếu máy móc chuẩn bị tự nâng cấp thiết kế của chính mình, hiểu được cách "đầu óc" chúng vận hành có lẽ là việc ta nên làm trước tiên.

Nguồn