OpenAI công khai 722 bản thảo toán học do AI tạo

Ngày 6 tháng 10, OpenAI công khai trên GitHub một loạt kết quả nghiên cứu toán học do mô hình tiên phong nội bộ tạo ra, đặt tên kho lưu trữ là openai/math, cấp phép theo Apache 2.0. Kho lưu trữ chứa 722 bản thảo, được phân vào 372 "gia đình" nghiên cứu, trong đó các chứng minh, mở rộng và bản sửa đổi khác nhau của cùng một vấn đề được đặt cạnh nhau.

Theo OpenAI tiết lộ, trong quá trình nghiên cứu mô hình đã được giao tổng cộng khoảng 4000 bài toán. Mỗi kết quả được chấp nhận tiêu tốn trung bình lượng tính toán tương đương với ChatGPT Pro suy luận trong 3 giờ.

Những hướng nghiên cứu nào được bao quát

Các bản thảo trải rộng qua lý thuyết số, độ phức tạp tính toán, vật lý toán học, hình học và khoa học máy tính lý thuyết. Những ví dụ được truyền thông nhắc đến bao gồm: các vấn đề liên quan đến độ đo vô tỷ của số π, một số bài toán NP-khó, giả thuyết Mahler, cấp số cộng, các nhân tử nhóm tự do, cùng với sắt từ Heisenberg lượng tử và phương trình Vlasov-Maxwell tương đối tính.

Không ít chứng minh trong số đó đi kèm phiên bản hình thức hóa bằng Lean. Lean là một ngôn ngữ lập trình cho phép máy tính kiểm tra logic chứng minh từng bước, việc hình thức hóa thành công đồng nghĩa với chuỗi suy luận không có lỗ hổng. Tuy nhiên không phải bản thảo nào cũng có tệp Lean tương ứng, OpenAI viết thẳng trong phần giải thích:

"some of the unformalized results could have issues"

Nghĩa là những kết quả chưa được hình thức hóa có thể tồn tại vấn đề. Công ty cam kết sẽ sửa các lỗi phát hiện được sau này, và dần bổ sung thêm nhiều chứng minh hình thức hóa. Kho lưu trữ cũng kèm theo quy trình sửa đổi bài báo và quy chuẩn trích dẫn, giúp các nhà nghiên cứu theo dõi một kết quả đã được sửa bao nhiêu lần và nên trích dẫn phiên bản nào khi tham chiếu.

Nối các điểm mốc lại với nhau

Lần công bố này cách lần OpenAI gây chú ý lớn gần nhất về toán học hơn bốn tháng. Tháng 5 năm nay, mô hình của OpenAI đã giải được một vấn đề Erdős còn treo lơ lửng khoảng 80 năm, khi đó là một đột phá đơn lẻ, được báo cáo từng bài một. Đến tháng 10, nó trở thành hàng trăm bản thảo được đưa vào kho cùng lúc, và cách công bố tự nó cũng trở thành một phần của tin tức.

Hình thức cũng thay đổi. Trước lần công bố này, OpenAI đã tham vấn "Nhóm cố vấn Toán học và Trí tuệ nhân tạo" độc lập của Viện Nghiên cứu Cao cấp Princeton (IAS). Nhóm cố vấn này vừa công bố một bản khuyến nghị vào ngày 29 tháng 9, sau khi nhận được hơn 600 phản hồi từ giới toán học, yêu cầu các kết quả toán học do AI tạo ra phải công khai tên mô hình, câu lệnh nhắc (prompt), bản tóm tắt quá trình suy luận, chi phí tính toán, và tỷ lệ thất bại của mô hình trên các bài toán cùng loại.

Đối chiếu với danh sách này, lần này OpenAI đã đưa ra chi phí tính toán (trung bình 3 giờ suy luận Pro), tổng số bài toán (khoảng 4000) và một lượng lớn chứng minh Lean; còn mô hình bản thân vẫn chưa được công khai, thông báo chỉ gọi đó là "mô hình nội bộ", và nói đang tiến tới việc mở hơn một cách có trách nhiệm. Trong khoảng 4000 bài toán có bao nhiêu chưa giải được, bài nào bị bỏ giữa đường, hiện không thể biết được từ tài liệu công khai.

Giới toán học đã lo ngại từ lâu về sản lượng kiểu này. Terence Tao đã hai lần công khai nói về chủ đề này vào tháng 8 và tháng 9 năm nay, đại ý là AI sẽ khiến sản lượng chứng minh vượt xa khả năng đọc duyệt của con người, những bài toán khó hay cũng sẽ nhanh chóng bị "khai thác" hết. Áp lực đọc duyệt 722 bản thảo một lúc cụ thể sẽ đổ lên ai, hiện chưa có ai đưa ra cách giải quyết.

Kế hoạch tiếp theo

OpenAI cho biết sẽ tài trợ các hội thảo và dự án chuyên đề liên quan, giúp giới toán học hiểu và tiêu hóa các kết quả do AI tạo ra. Liệu các bản thảo trong kho có thể được đăng trên các tạp chí chính thức, vấn đề ghi tên tác giả sẽ xử lý thế nào, công ty chưa đưa ra phương án cụ thể, kết quả kiểm tra từng bài của các nhà toán học bên ngoài cũng chưa được công bố.

Nguồn tham khảo: blog chính thức của OpenAI, Interesting Engineering, Unite.AI, CocoLoop; số lượng bản thảo, tổng số bài toán và chi phí tính toán căn cứ theo thông báo công khai của OpenAI, nội dung khuyến nghị của nhóm cố vấn căn cứ theo tài liệu công khai của nhóm cố vấn IAS.