OpenAI công bố loạt kết quả toán học mới kèm chứng minh kiểm chứng bằng máy tính

OpenAI vừa công bố một loạt kết quả toán học từ một mô hình nội bộ, bao gồm các bài báo chưa qua phản biện (preprint) tuyên bố thực hiện phép nhân số nguyên vượt qua các giới hạn truyền thống.
Họ đã đăng các phát hiện này lên một kho lưu trữ công khai trên GitHub theo gợi ý từ nhóm cố vấn tại Institute for Advanced Study. Để giới nghiên cứu dễ dàng kiểm tra, OpenAI gửi kèm các chứng minh đã được máy tính kiểm chứng (viết bằng ngôn ngữ Lean), cùng tóm tắt quá trình suy luận và thống kê số lần thử. Để tạo ra một kết quả trung bình, lượng tài nguyên tính toán tốn tương đương khoảng 3 giờ "suy nghĩ" của ChatGPT Pro.
Vì sao lại quan trọng: Các mô hình AI có thể phán rất tự tin ngay cả khi đang "chém gió" (hallucinate) ra đáp án sai. Việc công bố các chứng minh bằng Lean cho phép giới toán học kiểm tra trực tiếp tính đúng đắn, đồng thời thấy rõ chi phí tính toán thực tế đằng sau những bước nhảy suy luận đó.
Cần biết thêm: OpenAI cho biết họ đang chuẩn bị phát hành chính mô hình này một cách an toàn, đồng thời dự định tài trợ cho các hội thảo sắp tới để thảo luận về các phát hiện này với cộng đồng khoa học.
Giờ là lúc chờ xem đoạn hay nhất: liệu các chứng minh này có trụ vững trước sự soi xét từ giới học thuật hay không.
Nguồn
- OpenAI Announcement — https://openai.com/index/sharing-ai-progress-in-mathematics/
- Hacker News Discussion — https://news.ycombinator.com/item?id=49984923

