Το OpenAI δημοσίευσε 722 μαθηματικά χειρόγραφα που παράγονται από ένα ακυκλοφόρητο μοντέλο εσωτερικού συνόρων, τοποθετώντας την πλήρη συλλογή σε ένα δημόσιο αποθετήριο GitHub με άδεια Apache-2.0. Η έκδοση, που ανακοινώθηκε σε μια ερευνητική δημοσίευση με τίτλο "Sharing AI progress in mathematics" στις 6 Οκτωβρίου 2026, είναι μεταξύ των μεγαλύτερων μεμονωμένων μαθηματικών αποτελεσμάτων που έχουν δημιουργηθεί από AI μέχρι σήμερα και έρχεται με επίσημους ελέγχους Lean proof, συνοπτικές περιλήψεις συλλογισμών και ασυνήθιστη λεπτομέρεια για τον υπολογισμό του κάθε αποτελέσματος.
Η κίνηση προσγειώνεται σε ένα χωράφι που βρίσκεται ήδη στην άκρη. Οι New York Times ανέφεραν ότι η έκδοση συντάραξε περαιτέρω μια μαθηματική κοινότητα που έχει περάσει μήνες παλεύοντας με συστήματα τεχνητής νοημοσύνης που παράγουν σοβαρά ερευνητικά αποτελέσματα, ενώ το Scientific American περιέγραψε το OpenAI ως απελευθέρωση "εκατοντάδων ακόμη μαθηματικών αποτελεσμάτων σε ένα πεδίο που ήδη έχει σοκαριστεί". Για τους αναγνώστες που παρακολουθούν [τις πιο πρόσφατες ερευνητικές εξελίξεις της τεχνητής νοημοσύνης] (https://aibuzzwire.news), η έκδοση είναι μια δοκιμαστική περίπτωση για τον τρόπο με τον οποίο τα συνοριακά εργαστήρια μοιράζονται την επιστήμη που δημιουργείται από μηχανή χωρίς να πυροδοτούν διαφωνίες για την πίστωση.
Τι υπάρχει μέσα στο αποθετήριο
Η συλλογή βρίσκεται στο αποθετήριο openai/math στο GitHub. Σύμφωνα με το README, τα περιεχόμενα είναι μαθηματικά χειρόγραφα και υποστηρικτικά αποδεικτικά αντικείμενα που παράγονται από ένα εσωτερικό μοντέλο OpenAI, που συγκεντρώθηκαν ως μέρος αξιολογήσεων ανάπτυξης μοντέλων σε προβλήματα ανοιχτής έρευνας. Ο τρέχων κατάλογος περιέχει 722 χειρόγραφα οργανωμένα σε 372 οικογένειες, όπου μια οικογένεια ομαδοποιεί σχετικές εργασίες που μπορεί να περιλαμβάνουν ένα κύριο αποτέλεσμα, συνοδευτικά επιχειρήματα, συνέπειες ή εναλλακτικές αποδείξεις, καθεμία ταξινομημένη ανά μαθηματική πειθαρχία.
Ένας κατάλογος προεκτυπώσεων περιέχει αρχεία PDF, αρχεία πηγής και οδηγίες αναφοράς και κατασκευής ανά χειρόγραφο. Μια Lean βιβλιοθήκη καταγράφει τις επίσημες αποδείξεις μαζί με τα σχετικά έγγραφα και τις διαμορφώσεις επαλήθευσης. Δεν έχουν επισημοποιηθεί όλα τα χειρόγραφα: πολλά αποτελέσματα φέρουν συνοδευτικές επισημοποιήσεις στο Lean, τη γλώσσα προγραμματισμού που χρησιμοποιείται για να επιτρέπει στους υπολογιστές να ελέγχουν τις αποδείξεις γραμμή προς γραμμή, αλλά το README προειδοποιεί ότι ορισμένα μη τυπικά αποτελέσματα ενδέχεται να περιέχουν προβλήματα. Η OpenAI λέει ότι θα διορθώσει τέτοια προβλήματα γρήγορα και δεσμεύεται να διατηρήσει το ιστορικό δημόσιας κυκλοφορίας της συλλογής, να καταγράφει διορθώσεις και αναθεωρήσεις ως νέες εκδόσεις, ενώ παράλληλα διατηρεί προσβάσιμες τις προηγούμενες εκδόσεις. Κάθε κατάλογος χειρογράφων φέρει επίσης ένα μπλοκ BibTeX για αναφορά.
Πώς παρήχθησαν τα αποτελέσματα
Η συντριπτική πλειονότητα των αποτελεσμάτων προήλθε από μια ενιαία, σταθερή διαδικασία χρησιμοποιώντας ένα εσωτερικό μοντέλο OpenAI που δεν έχει κυκλοφορήσει. Κατά τη διάρκεια της αξιολόγησης, το μοντέλο παρουσίασε περίπου 4.000 προβλήματα. Το OpenAI αναφέρει ότι το μέσο δημοσιευμένο αποτέλεσμα κατανάλωσε το ισοδύναμο περίπου τριών ωρών υπολογισμού σκέψης ChatGPT Pro, ένα επίπεδο διαφάνειας που εξακολουθεί να είναι σπάνιο στον κλάδο. Η εταιρεία λέει ότι επέκτεινε αυτές τις αξιολογήσεις μετά την κορεσμένη απόδοση στα υπάρχοντα μαθηματικά σημεία αναφοράς της και ότι ορισμένα αποτελέσματα βασίζονται σε προηγούμενα αποτελέσματα που παρήχθησαν από τα δικά της μοντέλα. Η απαίτηση κατάλληλου επιπέδου σημασίας και η συγκέντρωση ακατέργαστης παραγωγής σε οικογένειες και χειρόγραφα παρήγαγε τον δημοσιευμένο κατάλογο.
Δύο επώνυμες εξαιρέσεις αποχώρησαν από αυτή τη διαδικασία: η εργασία για τη δημιουργία μιας περιοχής χωρίς μηδέν για τη συνάρτηση ζήτα Riemann, με την εγγραφή να καλύπτει την περιοχή Re(s) > 11/12 που έχει επεξεργαστεί από τον άνθρωπο για αναγνωσιμότητα και μια απόδειξη της εικασίας Hodge για τις ποικιλίες CM abelian. Και τα δύο είναι σοβαρά κυρίαρχα μαθηματικά, και τα δύο θα αντιμετωπίσουν τώρα τον κοινοτικό έλεγχο.
Δημοσιεύονται επίσης δέκα συνοπτικές περιλήψεις του συλλογισμού του μοντέλου. Καλύπτουν αποτελέσματα όπως ο εκθέτης παραλογισμού του pi, οι συμμετρικές και γενικές εικασίες του Mahler, ο ισομορφισμός των παραγόντων ελεύθερης ομάδας, τα σχεδόν πολυωνυμικά όρια για αριθμητικές προόδους, η εικασία άμεσης πεπεραστικότητας του Kaplansky στο χαρακτηριστικό δύο, η φόρμουλα Mezard-Parisi για αραιωμένα γυαλιά περιστροφής Herronet, spin the Magnette και spin. τρισδιάστατο σχετικιστικό σύστημα Vlasov-Maxwell.
Μια συμβουλευτική ομάδα βοήθησε στη διαμόρφωση της έκδοσης
Η OpenAI λέει ότι συμβουλεύτηκε την ανεξάρτητη Συμβουλευτική Ομάδα για τα Μαθηματικά και την Τεχνητή Νοημοσύνη στο Ινστιτούτο Προηγμένων Μελετών, ενώ ανέπτυξε βέλτιστες πρακτικές για την ανταλλαγή αποτελεσμάτων. Αυτή η ομάδα δημοσίευσε τις συστάσεις της για υπεύθυνη έκδοση στις 29 Σεπτεμβρίου 2026, αφού έλαβε περισσότερες από 600 απαντήσεις από τη μαθηματική κοινότητα. Οι συστάσεις είναι ξεκάθαρες: «δεν υποστηρίζουμε αυτήν την πρακτική και τους ζητάμε να σταματήσουν να δοκιμάζουν προηγμένα μαθηματικά προβλήματα σε ιδιόκτητα μοντέλα». Η ομάδα προτρέπει τα εργαστήρια να καταθέσουν αποτελέσματα σε επιστημονικά αποθετήρια που κανένα εργαστήριο τεχνητής νοημοσύνης δεν ελέγχει, να εκχωρήσουν μόνιμα αναγνωριστικά αναφοράς, να αποκαλύψουν το όνομα του μοντέλου, τις προτροπές που χρησιμοποιούνται και συνοπτικές αλυσίδες συλλογισμού και να απόσχουν να αντιμετωπίζουν τις εκδόσεις αποτελεσμάτων ως οχήματα μάρκετινγκ.
Η κυκλοφορία του OpenAI είναι ξεκάθαρα μια προσπάθεια συμμόρφωσης με αυτό το πλαίσιο αντί να το αψηφήσουμε. Το αν το αποδέχεται η κοινότητα είναι άλλο ζήτημα. Η έρευνα της συμβουλευτικής ομάδας ρώτησε συγκεκριμένα για ένα σενάριο στο οποίο ένα εργαστήριο ανακοινώνει την ύπαρξη πολλών αποτελεσμάτων χωρίς να παρέχει λεπτομέρειες και οι συστάσεις που προέκυψαν αντικατοπτρίζουν τη βαθιά ανησυχία σχετικά με τις ανακοινώσεις που ξεπερνούν την επαλήθευση.
Το βάρος επαλήθευσης μετατοπίζεται στους μαθηματικούς
Η πρακτική πρόκληση ανήκει πλέον στους εργαζόμενους μαθηματικούς. Τα επίσημα Lean proof μπορούν να ελεγχθούν μηχανικά και η παρουσία τους μειώνει σημαντικά τον κίνδυνο σφάλματος. Ωστόσο, τα χειρόγραφα χωρίς επισημοποιήσεις, τα οποία το ίδιο το README επισημαίνει ως δυνητικά ελαττωματικά, απαιτούν παραδοσιακή αξιολόγηση από ομοτίμους και τα 722 χειρόγραφα είναι πολύ περισσότερα από αυτά που μπορεί να απορροφήσει γρήγορα η κοινότητα. Υπάρχει επίσης το ζήτημα της προτεραιότητας και της πίστωσης: οι μαθηματικοί που πέρασαν χρόνια δίπλα σε αυτά τα προβλήματα θα θέλουν να μάθουν ακριβώς τι ρωτήθηκε το μοντέλο, τι του δόθηκε και αν ενσωματώθηκε κάποιο ανθρώπινο αποτέλεσμα. Η δημοσίευση περιλήψεων προτροπών και υπολογισμού στατιστικών από το OpenAI έχει σχεδιαστεί για να απαντά εκ των προτέρων σε ορισμένες από αυτές τις ερωτήσεις.
Η έκδοση ορίζει επίσης ένα πρότυπο που οι ανταγωνιστές μπορούν να πιεστούν να ακολουθήσουν. Το Anthropic, το Google DeepMind και άλλα εργαστήρια με μοντέλα συνόρων ικανά για μαθηματικά ερευνητικού επιπέδου αντιμετωπίζουν τώρα έναν de facto κανόνα, που διατυπώθηκε από τη συμβουλευτική ομάδα, ότι τα αποτελέσματα που κρύβονται σε ιδιόκτητα μοντέλα πρέπει είτε να κυκλοφορούν με πλήρη προέλευση είτε να μην πειράζονται καθόλου.
Προς το παρόν, το αποθετήριο είναι ζωντανό, η προσπάθεια επισημοποίησης συνεχίζεται και οι διορθώσεις εκδίδονται δημόσια. Το αν αυτό θα γίνει το τυπικό βιβλίο παιχνιδιού για τα μαθηματικά που δημιουργούνται από την τεχνητή νοημοσύνη ή άλλο ένα σημείο ανάφλεξης σε μια διευρυνόμενη σύγκρουση μεταξύ των εργαστηρίων και των ερευνητικών κοινοτήτων στις οποίες βασίζονται, θα εξαρτηθεί από το πώς θα εξελιχθούν οι επόμενες εβδομάδες ελέγχου.
Μείνετε μπροστά από την καμπύλη AI
Η επιστήμη που δημιουργείται από την τεχνητή νοημοσύνη μετακινείται από το δελτίο τύπου στην αξιολόγηση από ομοτίμους. Ακολουθήστε τις έκτακτες ειδήσεις τεχνητής νοημοσύνης στο aibuzzwire.news για κάλυψη κάθε σημαντικής έκδοσης έρευνας, κυκλοφορίας μοντέλου και αλλαγής πολιτικής.
Διαβάστε περισσότερα νέα AI →