OpenAI đã xuất bản 722 bản thảo toán học được tạo ra bởi một mô hình biên giới nội bộ chưa được phát hành, đặt toàn bộ bộ sưu tập vào kho lưu trữ GitHub công khai theo giấy phép Apache-2.0. Bản phát hành, được công bố trong một bài nghiên cứu có tiêu đề "Chia sẻ tiến trình AI trong toán học" vào ngày 6 tháng 10 năm 2026, là một trong những kho kết quả toán học do AI tạo ra lớn nhất cho đến nay và nó đi kèm với các kiểm tra bằng chứng Lean chính thức, tóm tắt lý luận rút gọn và chi tiết bất thường về lượng điện toán mà mỗi kết quả tiêu thụ.
Việc di chuyển sẽ hạ cánh xuống một cánh đồng đã ở rìa. Tờ New York Times đưa tin rằng việc phát hành đã tiếp tục gây chấn động cộng đồng toán học đã dành nhiều tháng vật lộn với các hệ thống AI tạo ra các kết quả nghiên cứu nghiêm túc, trong khi Scientific American mô tả OpenAI là giải phóng "hàng trăm kết quả toán học nữa trên một lĩnh vực đã bị sốc." Đối với độc giả theo dõi những phát triển nghiên cứu AI mới nhất, bản phát hành là một trường hợp thử nghiệm về cách các phòng thí nghiệm ở biên giới chia sẻ khoa học do máy tạo ra mà không gây ra tranh chấp tín dụng.
Bên trong kho lưu trữ có gì
Bộ sưu tập nằm trong kho openai/math trên GitHub. Theo README của nó, nội dung là các bản thảo toán học và các tạo phẩm chứng minh hỗ trợ được tạo ra bởi mô hình OpenAI nội bộ, được tập hợp như một phần của đánh giá phát triển mô hình về các vấn đề nghiên cứu mở. Danh mục hiện tại chứa 722 bản thảo được sắp xếp thành 372 họ, trong đó một họ nhóm các giấy tờ liên quan có thể bao gồm kết quả chính, lập luận đi kèm, hệ quả hoặc bằng chứng thay thế, mỗi nhóm được phân loại theo môn toán học.
Thư mục bản in sẵn chứa các tệp PDF, tệp nguồn cũng như các hướng dẫn xây dựng và trích dẫn trên mỗi bản thảo. Thư viện Lean liệt kê các bằng chứng chính thức cùng với các giấy tờ liên quan và cấu hình xác minh của chúng. Không phải mọi bản thảo đều được chính thức hóa: nhiều kết quả mang theo các công thức hóa kèm theo trong Lean, ngôn ngữ lập trình được sử dụng để cho phép máy tính kiểm tra các bản chứng minh theo từng dòng, nhưng README cảnh báo rằng một số kết quả không chính thức có thể chứa đựng các vấn đề. OpenAI cho biết họ sẽ khắc phục những sự cố như vậy một cách nhanh chóng và cam kết lưu giữ lịch sử phát hành công khai của bộ sưu tập, ghi lại các chỉnh sửa và sửa đổi dưới dạng phiên bản mới trong khi vẫn có thể truy cập được các phiên bản trước đó. Mỗi thư mục bản thảo cũng mang một khối BibTeX để trích dẫn.
Kết quả được tạo ra như thế nào
Phần lớn kết quả đến từ một quy trình cố định, duy nhất sử dụng mô hình OpenAI nội bộ chưa được phát hành. Trong quá trình đánh giá, mô hình đã đặt ra khoảng 4.000 vấn đề. OpenAI báo cáo rằng kết quả được công bố trung bình tiêu tốn tương đương khoảng ba giờ tính toán tư duy ChatGPT Pro, một mức độ minh bạch vẫn còn hiếm trong ngành. Công ty cho biết họ đã mở rộng những đánh giá này sau khi hiệu suất trên các tiêu chuẩn toán học hiện tại đã bão hòa và một số kết quả đầu ra được xây dựng dựa trên các kết quả trước đó do các mô hình của chính họ tạo ra. Yêu cầu mức độ ý nghĩa thích hợp và tổng hợp đầu ra thô vào các họ và bản thảo để tạo ra danh mục được xuất bản.
Hai trường hợp ngoại lệ được đặt tên xuất phát từ quy trình đó: công việc thiết lập vùng tự do bằng 0 cho hàm Riemann zeta, với phần viết bao gồm vùng Re(s) > 11/12 được con người chỉnh sửa để dễ đọc và bằng chứng về Giả thuyết Hodge cho các giống abelian CM. Cả hai đều là toán học chính thống nghiêm túc và giờ đây cả hai sẽ phải đối mặt với sự giám sát của cộng đồng.
Mười bản tóm tắt ngắn gọn về lý luận của mô hình cũng được xuất bản. Chúng bao gồm các kết quả bao gồm số mũ vô tỷ của pi, giả thuyết Mahler đối xứng và tổng quát, đẳng cấu của các thừa số nhóm tự do, giới hạn giả đa thức cho cấp số cộng, phỏng đoán hữu hạn trực tiếp của Kaplansky trong đặc tính hai, công thức Mezard-Parisi cho kính spin pha loãng, từ hóa tự phát trong sắt từ lượng tử Heisenberg và hệ Vlasov-Maxwell tương đối ba chiều.
Nhóm tư vấn đã giúp định hình bản phát hành
OpenAI cho biết họ đã tham khảo ý kiến của Nhóm tư vấn độc lập về Toán học và Trí tuệ nhân tạo tại Viện Nghiên cứu nâng cao trong khi phát triển các phương pháp hay nhất để chia sẻ kết quả. Nhóm đó đã công bố các khuyến nghị về việc phát hành có trách nhiệm vào ngày 29 tháng 9 năm 2026, sau khi nhận được hơn 600 câu trả lời từ cộng đồng toán học. Các khuyến nghị rất thẳng thắn: "chúng tôi không tán thành cách làm này và chúng tôi yêu cầu họ ngừng thử nghiệm các bài toán nâng cao trên các mô hình độc quyền." Nhóm kêu gọi các phòng thí nghiệm gửi kết quả vào kho lưu trữ học thuật mà không có phòng thí nghiệm AI nào kiểm soát, chỉ định các mã định danh có thể trích dẫn liên tục, tiết lộ tên mô hình, lời nhắc được sử dụng và chuỗi lý luận tóm tắt cũng như không coi việc công bố kết quả là phương tiện tiếp thị.
Việc phát hành OpenAI rõ ràng là một nỗ lực nhằm tuân thủ khuôn khổ đó hơn là thách thức nó. Liệu cộng đồng có chấp nhận nó hay không lại là một câu hỏi khác. Cuộc khảo sát của nhóm cố vấn đã hỏi cụ thể về một tình huống trong đó phòng thí nghiệm thông báo sự tồn tại của nhiều kết quả mà không cung cấp thông tin chi tiết và các khuyến nghị xuất hiện phản ánh mối lo ngại sâu sắc về việc thông báo vượt xa quá trình xác minh.
Gánh nặng xác minh chuyển sang các nhà toán học
Thách thức thực tế bây giờ thuộc về các nhà toán học đang làm việc. Bằng chứng Lean chính thức có thể được kiểm tra một cách máy móc và sự hiện diện của chúng làm giảm đáng kể nguy cơ sai sót. Nhưng các bản thảo không có sự chính thức hóa, mà chính README đánh dấu là có khả năng thiếu sót, cần có sự đánh giá ngang hàng theo cách truyền thống và 722 bản thảo vượt xa những gì cộng đồng có thể tiếp thu nhanh chóng. Ngoài ra còn có câu hỏi về mức độ ưu tiên và tín nhiệm: các nhà toán học đã dành nhiều năm liền với những vấn đề này sẽ muốn biết chính xác mô hình đã được yêu cầu, những gì nó đã đưa ra và liệu có kết quả nào của con người được đưa vào hay không. Việc xuất bản các bản tóm tắt lời nhắc và số liệu thống kê tính toán của OpenAI được thiết kế để trả lời trước một số câu hỏi đó.
Bản phát hành cũng đặt ra một khuôn mẫu mà các đối thủ cạnh tranh có thể bị ép phải tuân theo. Anthropic, Google DeepMind và các phòng thí nghiệm khác có mô hình tiên tiến có khả năng toán học ở cấp độ nghiên cứu hiện phải đối mặt với một tiêu chuẩn trên thực tế do nhóm cố vấn nêu rõ rằng các kết quả ẩn trên các mô hình độc quyền phải được công bố với đầy đủ nguồn gốc xuất xứ hoặc hoàn toàn không được tiết lộ.
Hiện tại, kho lưu trữ đang hoạt động, nỗ lực chính thức hóa đang diễn ra và các bản sửa lỗi đang được phiên bản công khai. Liệu điều này có trở thành cẩm nang tiêu chuẩn cho toán học do AI tạo ra hay một điểm sáng khác trong cuộc xung đột ngày càng mở rộng giữa các phòng thí nghiệm và cộng đồng nghiên cứu mà họ dựa vào hay không, sẽ phụ thuộc vào diễn biến giám sát trong vài tuần tới.
Đi trước đường cong AI
Khoa học do AI tạo ra đang chuyển từ thông cáo báo chí sang bình duyệt. Theo dõi tin tức mới nhất về AI trên aibuzzwire.news để biết thông tin về mọi công bố nghiên cứu lớn, ra mắt mô hình và thay đổi chính sách.
Đọc thêm tin tức về AI →