Η Anthropic ανακοίνωσε την Πέμπτη, 4 Σεπτεμβρίου 2026, ότι ο Claude δημιούργησε την πρώτη πλήρη απόδειξη του Τελευταίου Θεωρήματος του Fermat, ενός από τα πιο διάσημα αποτελέσματα στα μαθηματικά, που εργάστηκε αυτόνομα σε 11 ημέρες και έγραψε 13 εκατομμύρια γραμμές κώδικα στη γλώσσα προγραμματισμού Lean, σύμφωνα με την επίσημη ανακοίνωση της εταιρείας.
Το ορόσημο τράβηξε αμέσως την προσοχή σε όλη την ερευνητική κοινότητα, ξεπερνώντας το Hacker News μέσα σε λίγες ώρες από τη δημοσίευσή του. Μια επίσημη απόδειξη του θεωρήματος αναμενόταν να απαιτήσει πολυετή κοινοτική προσπάθεια. Αντίθετα, μια ομάδα δεκάδων συνεργαζόμενων πρακτόρων του Claude ολοκλήρωσε τη δουλειά σε λιγότερο από δύο εβδομάδες. Για περισσότερες πληροφορίες σχετικά με το πού βρίσκονται σήμερα οι δυνατότητες τεχνητής νοημοσύνης, ανατρέξτε στις [τελευταίες εξελίξεις AI] (https://aibuzzwire.news).
Τι είναι το τελευταίο θεώρημα του Fermat — και γιατί αντιστάθηκε στην απόδειξη για 350 χρόνια
Το Τελευταίο Θεώρημα του Φερμά δηλώνει ότι κανένας θετικός ακέραιος a, b και c δεν μπορεί να ικανοποιήσει την εξίσωση aⁿ + bⁿ = cⁿ για οποιαδήποτε τιμή του n μεγαλύτερη από 2. Ο Pierre de Fermat σημείωσε τον ισχυρισμό γύρω στο 1637 στο περιθώριο του αντιγράφου του του Διόφαντου Αριθμητική, προσθέτοντας ότι δεν είχε ανακαλυφθεί αξιοσημείωτα. απόδειξη που το περιθώριο ήταν πολύ στενό για να περιέχει.
Για περισσότερους από τρεις αιώνες η εικασία ξεπέρασε κάθε προσπάθεια απόδειξης. Σύμφωνα με την αφήγηση του Anthropic, ένα έπαθλο 100.000 γερμανικών χρυσών μάρκων που ανακοινώθηκε το 1908 συγκέντρωσε 621 λανθασμένες προσπάθειες μόνο τον πρώτο χρόνο. Ο Sir Andrew Wiles παρουσίασε τελικά μια σωστή απόδειξη το 1993 — μόνο για τους αναθεωρητές να αποκαλύψουν ένα κρίσιμο κενό δύο μήνες μετά την επαλήθευση. Ο Γουάιλς πέρασε ένα χρόνο επισκευάζοντας την απόδειξη με τον πρώην μαθητή του Ρίτσαρντ Τέιλορ προτού δημοσιεύσει την οριστική έκδοση των 129 σελίδων τον Μάιο του 1995, η οποία χρειάστηκε μήνες επίπονης εργασίας για να επαληθευτεί.
Πώς ο Claude δημιούργησε μια απόδειξη 13 εκατομμυρίων γραμμών
Το έργο ξεκίνησε από τον Tianyi Peng, έναν Anthropic ερευνητή του οποίου η ομάδα στο Πανεπιστήμιο Κολούμπια κατασκευάζει εργαλεία για την επισημοποίηση της τεχνητής νοημοσύνης, ο οποίος ξεκίνησε να δοκιμάσει εάν ο Claude θα μπορούσε να σημειώσει πρόοδο στη μετατροπή της απόδειξης του Wiles σε μηχανικά ελεγχόμενη μορφή.
Η προσπάθεια πέτυχε μόνο μετά από αλλαγή προσέγγισης. Το Anthropic αναφέρει ότι οι αρχικές προσπάθειες των πρακτόρων απέτυχαν καθώς έχασαν τα ίχνη της κατάστασης του έργου και σταμάτησαν να συνεργάζονται αποτελεσματικά. Η ανακάλυψη ήρθε με το Prove2Me, μια ανοιχτή πλατφόρμα συνεργασίας για την επισημοποίηση των μαθηματικών που σχεδιάστηκε από την Peng και τους συνεργάτες της Columbia. Η πλατφόρμα διατηρεί ένα κατευθυνόμενο άκυκλο γράφημα δηλώσεων θεωρημάτων που χρησιμοποιούν οι πράκτορες για να αποφασίσουν τι θα αποδείξουν στη συνέχεια, επιταχύνει τη σύνταξη Lean διαχωρίζοντας προτάσεις από αποδείξεις και επιτρέπει στους πράκτορες να αναζητούν και να επαναχρησιμοποιούν αποτελέσματα μέσω περιγραφών σε φυσική γλώσσα κάθε θεωρήματος.
Λειτουργώντας σε μια πλεξούδα πολλαπλών πρακτόρων που βασίζεται στον κώδικα Claude, η ομάδα των πρακτόρων κατανάλωσε περίπου έξι δισεκατομμύρια μάρκες εξόδου από ένα μοντέλο εσωτερικής έρευνας που η Anthropic περιγράφει ως περίπου συγκρίσιμο με το Claude Fable 5.1. Η ανθρώπινη συνεισφορά περιοριζόταν σε περιστασιακές οδηγίες υψηλού επιπέδου — ο Anthropic αναφέρει μηνύματα όπως "το Jacobian ως σχήμα ακούγεται υψηλή προτεραιότητα" και ένα αίτημα να προωθηθεί το θεώρημα Mazur να γίνει σύντομα. Η απόδειξη ολοκληρώθηκε στις 02:00 UTC στις 18 Αυγούστου, όταν το θεώρημα ρίζας της πλατφόρμας μετατράπηκε σε Αποδεδειγμένο.
Στην πορεία, ο Claude απέδειξε 30.300 θεωρήματα, χρησιμοποιώντας 29.500 από αυτά στην τελική απόδειξη. Σε 13 εκατομμύρια γραμμές Lean, το αποτέλεσμα είναι περισσότερο από πέντε φορές μεγαλύτερο από το μέγεθος του Mathlib, της κύριας κοινοτικής βιβλιοθήκης των επίσημων μαθηματικών. Η απόδειξη ακολουθεί μια απλοποιημένη έκθεση του επιχειρήματος του Wiles από τους Henri Darmon, Fred Diamond και Richard Taylor και προσαρμόζει κομμάτια του έργου επισημοποίησης του Imperial College του Λονδίνου με επικεφαλής τον Kevin Buzzard.
Γιατί μια λιτή απόδειξη λύνει το ερώτημα
Αυτό που κάνει το αποτέλεσμα καθοριστικό είναι ο διαιτητής. Οι βοηθοί απόδειξης όπως ο Lean επαληθεύουν τη λογική μιας απόδειξης αλγοριθμικά και ο Anthropic δηλώνει ότι η απόδειξη του Claude χρησιμοποιεί μόνο τα τρία τυπικά αξιώματα του Lean, με έναν συγκριτή να επιβεβαιώνει ότι η δήλωση του θεωρήματος ταιριάζει με τη διατύπωση του θεωρήματος του ίδιου του Mathlib. Η εταιρεία δημοσίευσε επίσης την απόδειξη σε δημόσιο αποθετήριο στο GitHub.
Ο Buzzard, ο οποίος εξέτασε το αποτέλεσμα, ήταν ξεκάθαρος: «Αυτό το εξαιρετικό επίτευγμα αυτοτυποποίησης, για το οποίο οι ερευνητές της Anthropic λένε ότι χρειάστηκε μόνο 11 ημέρες, αποδεικνύει το Τελευταίο Θεώρημα του Fermat χωρίς άλλες υποθέσεις εκτός από τα αξιώματα των μαθηματικών».
Η Anthropic φροντίζει να τοποθετεί σωστά την καινοτομία. Σε αντίθεση με την πρόσφατη εργασία που βασίζεται στην τεχνητή νοημοσύνη για την υπόθεση Riemann, η οποία παρήγαγε νέα μαθηματικά, τίποτα εδώ δεν είναι νέα μαθηματικά — το επίτευγμα είναι η επαλήθευση, ο έλεγχος μιας υπάρχουσας απόδειξης με τον τρόπο που μια αριθμομηχανή ελέγχει την αριθμητική. Δεδομένου ότι η Lean — όχι η Anthropic — είναι η τελική αρχή για την ορθότητα, ο ισχυρισμός δεν βασίζεται στην εκτίμηση της ίδιας της εταιρείας για το μοντέλο της.
Τι σημαίνει για τα Μαθηματικά και την Έρευνα AI
Οι συνέπειες κόβουν αμφίδρομα. Για τους μαθηματικούς, η αυτοτυποποίηση θα μπορούσε να εντοπίσει λάθη στο υπάρχον σώμα γνώσης και να ελαφρύνει δραματικά το βάρος της διαιτησίας για νέα αποτελέσματα, μια διαδικασία που μπορεί να πάρει χρόνια. «Εάν η αυτόματη επισημοποίηση του FLT είναι δυνατή τώρα, τότε έχουμε κάνει ένα μεγάλο βήμα προς την αυτόματη επισημοποίηση της σύγχρονης μαθηματικής βιβλιογραφίας», έγραψε ο Buzzard σε μια ακόλουθη ανάρτηση ιστολογίου με τίτλο «Anthropic has beaten to it», αναγνωρίζοντας ότι η δική του προσπάθεια από την κοινότητα, που ξεκίνησε το 2024, είχε ξεπεραστεί.
Για τα εργαστήρια τεχνητής νοημοσύνης, το αποτέλεσμα υποδηλώνει ότι τα επίσημα εργαλεία μπορεί να χαλιναγωγήσουν μια από τις πιο διαβόητες αδυναμίες της τεχνολογίας. Ο Anthropic σημειώνει ότι η γραφή Lean φαίνεται να βοηθά τον Claude να αποδείξει νέα αποτελέσματα, με τους πράκτορες να χρησιμοποιούν μερικές επίσημες αποδείξεις για να ελέγχουν ανεξάρτητα τις υποθέσεις όσο γράφουν αριθμητικές προσομοιώσεις. Η εταιρεία υποστηρίζει επίσης ότι το εμπόδιο στην είσοδο καταρρέει: σε ένα μικρό πείραμα, τρία προσωπικά σχέδια του Claude Max ήταν αρκετά για τους συνεργαζόμενους πράκτορες να επισημοποιήσουν το Θεώρημα των Τριών Πρώτων του Vinogradov σε τρεις ημέρες.
Οι επιφυλάξεις παραμένουν πραγματικές. Η απόδειξη απαιτούσε μια ειδικά σχεδιασμένη πλατφόρμα, δισεκατομμύρια μάρκες και ένα ασυνήθιστα καθαρό κριτήριο επιτυχίας - ο έλεγχος ενός κλειδιού απάντησης που ήδη υπάρχει είναι ευκολότερος από την ανακάλυψη νέων θεωρημάτων. Αλλά ως απόδειξη ότι τα συστήματα τεχνητής νοημοσύνης μπορούν τώρα να επισημοποιήσουν τα μαθηματικά στο σύνορο, 11 ημέρες έναντι ενός προβλήματος 358 ετών καθιστά το θέμα όσο πιο ζωντανά γίνεται.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →