Μόλις μία ημέρα αφότου το OpenAI έκανε το πιο ισχυρό μοντέλο του γενικά διαθέσιμο, η εταιρεία λέει ότι το σύστημα έχει παράγει μια πλήρη απόδειξη της Εικασίας Διπλού Εξωφύλλου Κύκλου - ένα διάσημο ανοιχτό πρόβλημα στη θεωρία γραφημάτων που αντιστέκεται στους μαθηματικούς για περίπου μισό αιώνα.
Ο ερευνητής του OpenAI, Ethan Knight, ανακοίνωσε το αποτέλεσμα στις 10 Ιουλίου 2026, δημοσιεύοντας ότι το GPT-5.6 Sol Ultra «παρήγαγε μια απόδειξη της 50χρονης Cycle Double Cover Conjecture χρησιμοποιώντας 64 υποπαράγοντες σε λίγο λιγότερο από μία ώρα». Ο ισχυρισμός ανέβηκε γρήγορα στην κορυφή του Hacker News, προκαλώντας εκατοντάδες σχόλια από μαθηματικούς και μηχανικούς που συζητούσαν εάν η απόδειξη ισχύει.
Για όποιον παρακολουθεί τις τελευταίες εξελίξεις της τεχνητής νοημοσύνης, το αποτέλεσμα είναι μια εντυπωσιακή επίδειξη για το πού κατευθύνονται τα μοντέλα αιχμής - και μια υπενθύμιση ότι οι μαθηματικοί ισχυρισμοί τους πρέπει ακόμα να ελεγχθούν με τον παλιομοδίτικο τρόπο.
Τι είναι η εικασία για το διπλό εξώφυλλο του κύκλου;
Η εικασία βρίσκεται σε έναν κλάδο των μαθηματικών που ονομάζεται θεωρία γραφημάτων. Με απλά λόγια, θέτει μια απατηλά απλή ερώτηση: μπορούν οι άκρες οποιουδήποτε γραφήματος "χωρίς γέφυρα" - ένα χωρίς άκρο του οποίου η αφαίρεση θα το χώριζε - να καλύπτονται πάντα από μια συλλογή κύκλων, έτσι ώστε κάθε μεμονωμένη ακμή να εμφανίζεται ακριβώς δύο φορές;
Το πρόβλημα τέθηκε ανεξάρτητα από αρκετούς μαθηματικούς όλα αυτά τα χρόνια, συμπεριλαμβανομένων των Paul Seymour το 1979 και George Szekeres το 1973, με προηγούμενες ρίζες στο έργο του W. T. Tutte και των Alon Itai και Michael Rodeh. Παρά την απλή του δήλωση, έγινε ένα από τα πιο γνωστά άλυτα προβλήματα στο πεδίο και μερικά αποτελέσματα ήταν γνωστά μόνο για ειδικές κατηγορίες γραφημάτων.
Σύμφωνα με το αποδεικτικό σημείωμα που δημοσιεύτηκε το OpenAI, το επιχείρημα μειώνει το πρόβλημα σε κυβικά γραφήματα χωρίς βρόχο και στη συνέχεια στηρίζεται σε ένα κλασικό αποτέλεσμα - το θεώρημα πουθενά μηδενικής ροής πάνω από την ομάδα F32 (ισοδύναμο με το θεώρημα 8 ροών του Tutte) - και ένα βασικό βήμα γραμμικής άλγεβρας που μετατρέπει μια διπλή σήμανση ακμής για ένα διπλό κάλυμμα κύκλου. Η σύνταξη είναι μόνο μερικές σελίδες και, κυρίως, χρησιμοποιεί "δεν αναπτύχθηκαν μαθηματικά τα τελευταία 30 χρόνια", όπως παρατήρησε ένας σχολιαστής του Hacker News.
Πώς το προσέγγισε το GPT-5.6 Sol Ultra
Αυτό που ξεχωρίζει αυτό το αποτέλεσμα από τις συνηθισμένες απαντήσεις chatbot είναι ο τρόπος με τον οποίο αναπτύχθηκε το μοντέλο. Το GPT-5.6 Sol Ultra έτρεξε στη λειτουργία "multiagent v2" του OpenAI, περιστρέφοντας ένα σύστημα έως και 64 συνεργαζόμενων υποπαραγόντων που εξερεύνησαν διαφορετικές στρατηγικές απόδειξης παράλληλα. Το OpenAI κυκλοφόρησε την πλήρη προτροπή μαζί με την απόδειξη, προσφέροντας μια σπάνια ματιά στις οδηγίες που δίνονται στο σύστημα.
Η προτροπή έδωσε εντολή στο μοντέλο να "χρησιμοποιήσει multiagent v2 επιθετικά και δυναμικά", να διατηρήσει ένα "διαφορετικό χαρτοφυλάκιο προσεγγίσεων" και να αναπτύξει αντιπάλους για να ελέγξει τυχόν υποψήφιες αποδείξεις για κοινές παγίδες - όπως κλειστά μονοπάτια που μεταμφιέζονται σε κύκλους ή τυχαία κυκλική λογική. Είπε μάλιστα στο σύστημα να «δαπανήσει τουλάχιστον 8 ώρες σε αυτό πριν καν σκεφτεί να επιστρέψει ή να τα παρατήσει», αν και η τελική διαδρομή φέρεται να ολοκληρώθηκε σε λιγότερο από μία ώρα.
Στην ενότητα "Δήλωση χρήσης τεχνητής νοημοσύνης" του δοκιμίου, το OpenAI είναι σαφές: "Η απόδειξη σε αυτήν τη σημείωση οφείλεται εξ ολοκλήρου στο GPT 5.6 Sol Ultra και στην εγγραφή με Codex (με GPT 5.6 Sol)."
Δεν είναι όλοι πεπεισμένοι ακόμα
Η μαθηματική κοινότητα αντέδρασε με ένα μείγμα ενθουσιασμού και προσοχής — και αυτός ο σκεπτικισμός είναι καλά τοποθετημένος. Από τη δημοσίευση, η απόδειξη δεν έχει επαληθευτεί επίσημα σε έναν βοηθό απόδειξης όπως ο Lean, ούτε έχει περάσει από την παραδοσιακή αξιολόγηση από ομοτίμους.
Στο Hacker News, αρκετοί σχολιαστές σημείωσαν ότι οι σύντομες, κομψές αποδείξεις διάσημων εικασιών αξίζουν ιδιαίτερα προσεκτικό έλεγχο. «Είναι μια πολύ σύντομη απόδειξη που δεν χρησιμοποιεί μαθηματικά που αναπτύχθηκαν τα τελευταία 30 χρόνια», έγραψε ένας χρήστης. "Κάτι που δεν το κάνει απαραίτητα λάθος, αλλά ελλείψει μηχανοποίησης στο Lean ή σωστής αξιολόγησης από ομοτίμους, νομίζω ότι είναι πρόωρο να το δημοσιεύσω."
Άλλοι επεσήμαναν ότι οι κορυφαίες επίσημες βιβλιοθήκες απόδειξης της θεωρίας γραφημάτων δεν είναι ακόμη αρκετά ώριμες για να ελέγχουν αποτελέσματα αυτού του είδους σε επίπεδο έρευνας, πράγμα που σημαίνει ότι η επαλήθευση μπορεί να χρειαστεί να γίνει από ειδικούς ανθρώπους που διαβάζουν το όρισμα γραμμή προς γραμμή. Το ίδιο το OpenAI πλαισίωσε την ανακοίνωση ως μέρος ενός ευρύτερου μοτίβου: «Ο περισσότερος υπολογισμός του χρόνου δοκιμής οδηγεί σε μεγαλύτερη ευφυΐα», είπε η εταιρεία, σηματοδοτώντας ότι η προσέγγιση πολλαπλών πρακτόρων - όχι αυτό το μεμονωμένο αποτέλεσμα - είναι η πραγματική ιστορία που θέλει να πει.
Γιατί έχει σημασία
Ακόμα κι αν η απόδειξη Cycle Double Cover χρειάζεται τελικά διόρθωση, το επεισόδιο σηματοδοτεί μια ουσιαστική αλλαγή στο τι μπορούν να κάνουν τα μεγάλα γλωσσικά μοντέλα στα καθαρά μαθηματικά. Τα συστήματα Frontier AI έχουν προηγουμένως παραγάγει νέα ερευνητικά αποτελέσματα σε εξειδικευμένους τομείς - συμπεριλαμβανομένων άλλων πρόσφατων ισχυρισμών για λυμένα προβλήματα στη γεωμετρία και τη συνδυαστική - αλλά η επίθεση σε μια επώνυμη εικασία δεκαετιών με ένα συντονισμένο σμήνος συλλογιστικών παραγόντων ανεβάζει σημαντικά τον πήχη.
Για τους ερευνητές, το πακέτο είναι διπλό. Πρώτον, η συνταγή πολλών πρακτόρων - πολλές ανεξάρτητες προσπάθειες, διασταυρούμενη επικονίαση ιδεών και αντίθετος έλεγχος - φαίνεται να είναι ένα πραγματικά χρήσιμο πρότυπο για τη δύσκολη επίλυση προβλημάτων. Δεύτερον, το σημείο συμφόρησης επαλήθευσης είναι πλέον καθαρά στους ανθρώπους: το μοντέλο μπορεί να δημιουργήσει υποψήφιες αποδείξεις πιο γρήγορα από ό,τι μπορεί να τις ελέγξει η κοινότητα.
Αυτή η ένταση είναι πιθανό να καθορίσει την επόμενη φάση των μαθηματικών με τη βοήθεια AI. Όπως το έθεσε ένας σχολιαστής, αν αυτή η απόδειξη ισχύει, "κάποιος πρόκειται να ξεκινήσει μια λίστα" με άλλα μακροχρόνια προβλήματα που θα ρίξει στην επόμενη γενιά μοντέλων.
Προς το παρόν, οι μαθηματικοί θα διαβάζουν προσεκτικά το σημείωμα των τριών σελίδων - με μολύβι στο χέρι - ενώ η υπόλοιπη βιομηχανία τεχνητής νοημοσύνης παρακολουθεί για να δει εάν η ωριαία προσπάθεια του GPT-5.6 γίνεται μέρος του μόνιμου μαθηματικού ρεκόρ.
Μείνετε μπροστά από την τεχνητή νοημοσύνη
Για περισσότερα σχετικά με τις ανακαλύψεις των μοντέλων αιχμής και την κάλυψη της έρευνας σε τεχνητή νοημοσύνη, επισκεφτείτε την [αρχική σελίδα AI Buzz Wire] (https://aibuzzwire.news).
Διαβάστε περισσότερα νέα AI →---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



