Το OpenAI τράβηξε την αυλαία του Astra, ένα ακυκλοφόρητο σύστημα που αποκαλεί "το επόμενο σημαντικό μας μοντέλο", αφού μια εσωτερική έκδοση έφερε δέκα σημαντικές προόδους στα μαθηματικά και τη θεωρητική επιστήμη των υπολογιστών. Η εταιρεία έβαλε την ανακοίνωση μέσα σε μια ερευνητική ανάρτηση που τεκμηριώνει τα μαθηματικά αποτελέσματα, προκαλώντας ενθουσιασμό και εξονυχιστικό έλεγχο από ερευνητές που παρακολουθούν στενά [έκτακτες ειδήσεις AI] (https://aibuzzwire.news).
Τα προβλήματα που βοήθησε η Astra να λυθούν δεν είχαν δει «καμία πρόοδο στα κεντρικά της αποτελέσματα για τουλάχιστον μια δεκαετία, και στις περισσότερες περιπτώσεις, πολύ περισσότερο», έγραψε το OpenAI. Τα αποτελέσματα καλύπτουν πεδία όπως η γεωμετρία υψηλών διαστάσεων, η θεωρία κωδικοποίησης, η πολυπλοκότητα αριθμητικών κυκλωμάτων, η θεωρία ομάδων, η κβαντική πολυπλοκότητα, η κρυπτογραφία πλέγματος και η ακραία συνδυαστική - περιοχή όπου η πρόοδος μετριέται συνήθως σε χρόνια, όχι μεμονωμένα ερευνητικά τρεξίματα.
Επαληθευμένες αποδείξεις, όχι μόνο απαντήσεις
Αυτό που διαχωρίζει την έξοδο του Astra από ένα chatbot που μαντεύει στα μαθηματικά είναι η επαλήθευση. Το OpenAI είπε ότι οι ανθρώπινοι ερευνητές χρησιμοποίησαν το ίδιο μοντέλο για να προετοιμάσουν επιχειρήματα ως χειρόγραφα, και η Astra στη συνέχεια επισημοποίησε κάθε επιχείρημα ως Λεανό πιστοποιητικό. Ο Lean είναι ένας βοηθός απόδειξης ανοιχτού κώδικα που μπορεί να ελέγχει μηχανικά μαθηματικά επιχειρήματα, πράγμα που σημαίνει ότι οι άλλοι μαθηματικοί δεν χρειάζεται να λαμβάνουν τα αποτελέσματα με βάση την πίστη - μπορούν να επαληθευτούν ανεξάρτητα από το λογισμικό σε δευτερόλεπτα.
Αυτή η διάκριση έχει σημασία. Ένα γλωσσικό μοντέλο μπορεί να παράγει μια εύλογη απόδειξη που περιέχει ένα λεπτό, μοιραίο σφάλμα. Μεταφράζοντας κάθε όρισμα σε Lean, το OpenAI μετέτρεψε μια αξίωση μάρκετινγκ σε ελεγχόμενο τεχνούργημα. Σύμφωνα με την BleepingComputer, η οποία ανέφερε τις λεπτομέρειες, οι συγκεκριμένες εξελίξεις περιλαμβάνουν μια απόδειξη που αποδεικνύει την ύπαρξη μη σοφικών ομάδων, επιλύοντας ένα σημαντικό ανοιχτό ερώτημα στη θεωρία ομάδων. μια απόρριψη της εικασίας της ακαμψίας του Connes. νέα όρια για τη συσκευασία σφαιρών υψηλών διαστάσεων. και τα αποτελέσματα που επιλύουν διάφορα προβλήματα που τέθηκαν αρχικά από τον παραγωγικό μαθηματικό Paul Erdős.
Το OpenAI σημείωσε ότι ο συνολικός αριθμός των tokens που απαιτούνται για την εύρεση αυτών των λύσεων θα κοστίσει περίπου 2.000 $ με τις τρέχουσες τιμές API - ένα εντυπωσιακό σημείο δεδομένων για το υπολογιστικό αποτύπωμα της σύγχρονης μαθηματικής ανακάλυψης και ένα που τοποθετεί την έρευνα αιχμής σε προσιτότητα σε καλά χρηματοδοτούμενες ακαδημαϊκές ομάδες και όχι μόνο στα ίδια τα εργαστήρια.
Μαθηματικοί Αντιδρούν
Ο Thomas Bloom, μαθηματικός στο Πανεπιστήμιο του Μάντσεστερ που διευθύνει τον ιστότοπο αναφοράς Erdős-problem erdosproblems.com, χαρακτήρισε τα αποτελέσματα "μεγάλα νέα" στο X, σύμφωνα με το The Decoder. Τα αξιολόγησε πιο σημαντικά από ένα αντιπαράδειγμα της εικασίας της απόστασης μονάδας που δημοσιεύτηκε τον Μάιο. «Ίσως να μην ήταν μεγαλύτερη από ό,τι θα ήταν μια απόδειξη της απόστασης μονάδας, αλλά όσον αφορά τις κατασκευές, αυτή είναι μεγάλη», έγραψε ο Bloom.
Ο Μπλουμ υποστήριξε επίσης το πλαίσιο ότι η τεχνητή νοημοσύνη αντικαθιστά τους μαθηματικούς, υποστηρίζοντας ότι ο ισχυρισμός δεν έχει νόημα όταν το σύστημα βασίζεται σε περισσότερο από έναν αιώνα θεωρίας, κατασκευάστηκε από μαθηματικούς και εκπαιδεύτηκε σε όλα όσα έγραψαν ποτέ οι μαθηματικοί.
Ο Noam Brown, ένας ερευνητής πίσω από την τεχνολογία συλλογιστικής του χρόνου δοκιμής στην οποία βασίζεται η Astra, ήταν πιο μετρημένος. «Δυστυχώς, δεν υπάρχουν προβλήματα με το Βραβείο Χιλιετίας (ακόμα),» δημοσίευσε στο X, αναφερόμενος στα επτά διάσημα προβλήματα για τα οποία το Ινστιτούτο Μαθηματικών Clay προσφέρει 1 εκατομμύριο δολάρια το καθένα — μόνο ένα έχει λυθεί από τότε που ανακοινώθηκαν τα βραβεία το 2000.
Δεν εντυπωσιάστηκαν όλοι. Ο κριτικός τεχνητής νοημοσύνης, Γκάρι Μάρκους, χαρακτήρισε το μοντέλο «καταπληκτικό — αλλά πολύ υπερπουλημένο» σε μια δημοσίευση του Substack, μια γνωστή γραμμή σκεπτικισμού κάθε φορά που ένα εργαστήριο συνόρων διεκδικεί ένα ορόσημο. Η ένταση μεταξύ του γνήσιου τεχνικού επιτεύγματος και του διαφημιστικού πλαισίου είναι πιθανό να καθορίσει τον τρόπο υποδοχής του Astra.
Ένα νέο μοντέλο οικογένειας για μεγάλες εργασίες
Οι Πληροφορίες επιβεβαίωσαν ανεξάρτητα ότι το Astra είναι μια νέα οικογένεια μοντέλων που έχει κατασκευαστεί για μεγάλους φόρτους εργασίας. Το OpenAI το περιγράφει ως ένα σύστημα που επιτρέπει σε πολλούς πράκτορες τεχνητής νοημοσύνης να συνεργάζονται σε διαφορετικά μέρη ενός μεγαλύτερου προβλήματος - ένα σχέδιο που στοχεύει ακριβώς σε εργασίες που διαρκούν ώρες ή ημέρες και όχι δευτερόλεπτα, όπως η απόδειξη ενός θεωρήματος ή η αναδιαμόρφωση μιας μεγάλης βάσης κώδικα.
Η BleepingComputer ανέφερε ότι το OpenAI δεν έχει αποφασίσει εάν το μοντέλο θα κυκλοφορήσει ως GPT-5.7, GPT-6 ή με άλλο όνομα. Ο Διευθύνων Σύμβουλος Sam Altman έχει ήδη παρουσιάσει το Astra στην Ουάσιγκτον, DC, ανέφερε το The Decoder, σηματοδοτώντας ότι η εταιρεία θεωρεί το σύστημα αρκετά ώριμο για να το βάλει μπροστά στους υπεύθυνους χάραξης πολιτικής.
Ένα εμπόδιο αναθεώρησης της κυβέρνησης
Ίσως η πιο σημαντική λεπτομέρεια είναι η κανονιστική. Σύμφωνα με το The Decoder, το Astra θα είναι μεταξύ των πρώτων μοντέλων που θα περάσουν από μια προγραμματισμένη διαδικασία αναθεώρησης της κυβέρνησης των ΗΠΑ που απαιτεί επίσημη έγκριση πριν από τη δημόσια κυκλοφορία. Αυτό προσθέτει ένα στρώμα πολιτικής αβεβαιότητας στο χρονοδιάγραμμα κυκλοφορίας που δεν αντιμετώπισαν ποτέ τα προηγούμενα ναυαρχικά μοντέλα — και αυξάνει το διακύβευμα για το πώς το OpenAI χαρακτηρίζει τις δυνατότητες του Astra.
Το ντεμπούτο έρχεται επίσης εν μέσω ενός σκληρού αγώνα ανοιχτού βάρους. Μέρες νωρίτερα, το Thinking Machines Lab κυκλοφόρησε το μοντέλο ανοιχτού βάρους Inkling-Small και τα κινεζικά εργαστήρια συνεχίζουν να προωθούν συστήματα ανοιχτού βάρους. Το Astra σηματοδοτεί το στοίχημα του OpenAI ότι η ιδιόκτητη, μεγάλης κλίμακας συλλογιστική — επαληθευμένη από εργαλεία όπως το Lean — παραμένει ο δρόμος για τις μεγαλύτερες ανακαλύψεις.
Προς το παρόν, το Astra παραμένει ακυκλοφόρητο. Όμως, το μαθηματικό του ντεμπούτο έχει ήδη επαναδιατυπώσει τη συζήτηση σχετικά με το ποια συστήματα συνοριακής τεχνητής νοημοσύνης μπορούν να συνεισφέρουν στην καθαρή επιστήμη και πόσο προσεκτικά πρέπει να εξετάσει το κοινό τους ισχυρισμούς που τα συνοδεύουν.
Μείνετε μπροστά από την τεχνητή νοημοσύνη
Θέλετε να παρακολουθείτε τις εξελίξεις όπως το Astra και τον ευρύτερο αγώνα μοντέλων συνόρων; Προσθέστε σελιδοδείκτη στο κέντρο μας για τις [τελευταίες εξελίξεις AI] (https://aibuzzwire.news).
Διαβάστε περισσότερα νέα AI →