Το OpenAI διόρθωσε τρία ελαττώματα, τα οποία εξηγούν μια εβδομάδα παραπόνων χρηστών ότι το GPT-6 Astra, το νεότερο συνοριακό μοντέλο του, είχε γίνει πιο χαζό από την κυκλοφορία - και επαναφέρει τα όρια χρήσης για τους συνδρομητές του Codex ως μια συγγνώμη. Η ενημέρωση προήλθε από τον επικεφαλής προϊόντων της Codex, Tibo Sottiaux, ο οποίος είπε ότι η ομάδα συνεργάστηκε με τους χρήστες για να εντοπίσει τα σφάλματα, στη συνέχεια έστειλε επιδιορθώσεις και μια πλήρη επαναφορά χρήσης πριν από τα μεσάνυχτα τοπική ώρα, σύμφωνα με μια ενημέρωση που δημοσιεύτηκε το Σάββατο.

Η αποδοχή κλείνει μια πρόχειρη έκταση για αυτό που το OpenAI έχει χαρακτηρίσει ως το πιο ικανό μοντέλο του μέχρι σήμερα. Από τότε που το Astra έφτασε σε ευρεία διαθεσιμότητα στις αρχές Σεπτεμβρίου, οι προγραμματιστές στο X έδιναν πανομοιότυπες εντολές για το Astra την ημέρα κυκλοφορίας και την τρέχουσα έκδοση, διατηρώντας κάθε ρύθμιση ίδια και δημοσιεύοντας συγκρίσεις δίπλα-δίπλα που έδειχναν ένα αθόρυβα εξασθενημένο μοντέλο. Για περισσότερα σχετικά με τα μοντέλα που οδηγούν αυτήν τη συζήτηση, ανατρέξτε στην κάλυψη πιο πρόσφατες εξελίξεις AI.

Τα τρία ελαττώματα, με όνομα

Σύμφωνα με τον Sottiaux, ο πρώτος ένοχος ήταν οι δεξιότητες — τα αρχεία προτροπής που γράφτηκαν για προηγούμενα μοντέλα που ενεργοποιούνταν πολύ συχνά στο Astra, εμποδίζοντας μερικές φορές το μοντέλο να ελέγχει τη δουλειά του. Το δεύτερο ήταν ένα προαιρετικό πείραμα διαχείρισης περιβάλλοντος που θα μπορούσε να κάνει το μοντέλο να εγκαταλείψει νωρίς ή να απαντήσει σε μπαγιάτικα μηνύματα. Η OpenAI απενεργοποίησε το πείραμα αφού επηρεάστηκαν περίπου 4.000 έως 5.000 χρήστες, είπε η εταιρεία.

Το τρίτο ελάττωμα αφορούσε την υποδομή και όχι το ίδιο το μοντέλο: ορισμένοι κινητήρες συμπερασμάτων είχαν διαμορφωθεί εσφαλμένα και μετρήσιμα υποβάθμισαν την ποιότητα στην ουρά κυκλοφορία που δρομολογήθηκε μέσω αυτών. Το OpenAI αφαίρεσε αυτούς τους κινητήρες και έκανε αρκετές μικρότερες επισκευές. Ο Sottiaux έγραψε ότι το μοντέλο παρακολουθεί τώρα το τελευταίο μήνυμα ενός χρήστη με μεγαλύτερη ακρίβεια - ένα νεύμα στα παράπονα ότι το Astra απαντούσε σε ερωτήσεις που ο χρήστης είχε ήδη περάσει.

Οι προγραμματιστές είχαν ήδη προχωρήσει

Τα παράπονα δημιουργήθηκαν μέσα στην εβδομάδα. Ο προγραμματιστής Pranjal Paliwal, ο οποίος είχε εγκωμιάσει το Astra μέρες νωρίτερα, επέστρεψε και διάβασε τον κώδικα που του έγραφε και στη συνέχεια χαρακτήρισε το αποτέλεσμα παλινδρόμηση και όχι πρόοδο. Ο Dax Raad, ο οποίος κατασκευάζει το εργαλείο κωδικοποίησης Opencode, μετέφερε την ομάδα του πίσω στο παλαιότερο GPT-5.6 Sol αφού οι δαπάνες στο Astra διπλασιάστηκαν για τα μειονεκτήματα που έκρινε ότι δεν άξιζαν τα χρήματα. Μια αφίσα του φόρουμ περιέγραφε το Astra ως τώρα στο ίδιο επίπεδο με τον Sol σε ίδιες εργασίες, με τις ίδιες επαναλήψεις.

Δεν δέχτηκαν όλοι αυτή την ανάγνωση. Ένας ψευδώνυμος χρήστης που έγραφε ως Αντικύθηρα υποστήριξε ότι το μοντέλο ήταν πάντα τεμπέλης και λάτρευε τις κουκκίδες και ότι οι χρήστες απλώς είχαν σταματήσει να εκθαμβώνονται. Αυτή η διαφωνία καταγράφει πόσο δύσκολο είναι να διευθετηθούν αξιώσεις ποιότητας μοντέλου: πανομοιότυπες προτροπές, διαφορετικές ετυμηγορίες.

Πρόβλημα χωρητικότητας στο παρασκήνιο

Η σειρά ποιότητας προσγειώθηκε ενώ η χωρητικότητα επισκίασε την κυκλοφορία. Το OpenAI μείωσε τα όρια χρήσης του Astra για βαρείς χρήστες ChatGPT σύμφωνα με αναφορές χρηστών και διέκοψε τις νέες συνδρομές Pro $200 — ένα βήμα που επιβεβαίωσε η Sottiaux στις 10 Σεπτεμβρίου, επικαλούμενη ζήτηση. Το μοντέλο εξακολουθεί να κοστίζει 10 $ ανά εκατομμύριο μάρκες εισόδου και 50 $ ανά εκατομμύριο μάρκες εξόδου, το οποίο είναι 2,5 φορές μεγαλύτερο από αυτό που χρέωνε η ​​Sol όταν κυκλοφόρησε.

Υπάρχει επίσης ένα άβολο προηγούμενο: αυτή είναι η δεύτερη ναυαρχίδα του OpenAI μέσα σε δύο μήνες που επισύρει την ίδια κατηγορία από τους χρήστες που πληρώνουν. Τον Ιούλιο, οι χρήστες είπαν ότι η κορυφαία λειτουργία συλλογισμού της Sol είχε γίνει ρηχή κατά τη διάρκεια της νύχτας. Ο Sottiaux αρνήθηκε ότι την αποδυνάμωσε σκόπιμα εκείνη τη στιγμή, ενώ επιβεβαίωσε ότι η εταιρεία πειραματιζόταν με συλλογιστική προσπάθεια. Οι επαναλαμβανόμενοι κύκλοι "το μοντέλο χειροτέρεψε" ακολουθούμενοι από "βρήκαμε ελαττώματα" γίνονται ένα μοτίβο που θα πρέπει να διαχειριστεί η εταιρεία — η διαφάνεια βοηθά, αλλά και η σταθερότητα.

Η δική του συμβουλή του OpenAI: Χρησιμοποιήστε λιγότερα προστατευτικά κιγκλιδώματα

Μαζί με τις επιδιορθώσεις, το OpenAI δημοσίευσε οδηγίες μετάβασης από τον μηχανικό Eric Provencher που ισοδυναμεί με μια αντιδιαισθητική σύσταση: τα πιο ικανά μοντέλα χρειάζονται λιγότερο κράτημα στο χέρι. Οι υπερβολικά μεγάλες περιγραφές δεξιοτήτων, οι γενικές απαιτήσεις ανάγνωσης και οι άκαμπτοι κανόνες έγκρισης μπορούν να παρεμποδίσουν το Astra, λέει η καθοδήγηση. Οδηγίες που έχουν συσσωρευτεί με την πάροδο του χρόνου μπορεί να επηρεάσουν το περιεχόμενο ή να αναγκάσουν το μοντέλο να σταματήσει να λειτουργεί πολύ νωρίς.

Η Provencher συνιστά στις ομάδες να ελέγχουν τις δεξιότητές τους, τα αρχεία AGENTS.md και τις προτροπές εργασιών κάθε φορά που αλλάζουν μοντέλα, να δένουν στενά τις οδηγίες με συγκεκριμένες εργασίες και να ορίζουν με σαφήνεια πότε ολοκληρώνεται μια εργασία — επειδή ακόμη και χωρίς περιορισμούς, το Astra μπορεί να σταματήσει νωρίτερα από το GPT-5.6 Sol. Οι ομάδες που κλείδωσαν τα πράγματα αφού προηγούμενα μοντέλα έγιναν αδίστακτα θα πρέπει να επανεξετάσουν αυτούς τους κανόνες: Το Astra έχει καλύτερη κρίση, υποστηρίζει η ανάρτηση, αλλά μπορεί να ερμηνεύσει τους παλιούς περιορισμούς τόσο κυριολεκτικά που σταματά όταν θέλεις να συνεχίσει.

Τι θα συμβεί στη συνέχεια

Η επαναφορά χρήσης δίνει στους συνδρομητές του Codex ένα καθαρό πλάνο για να επαναξιολογήσουν το μοντέλο και το OpenAI θα παρακολουθεί τις ίδιες δοκιμές δίπλα-δίπλα που εκτελούν οι χρήστες του. Το βαθύτερο ερώτημα είναι η εμπιστοσύνη: οι προγραμματιστές που πληρώνουν που είδαν μια ναυαρχίδα να υποβαθμίζεται μέσα σε μια εβδομάδα από την κυκλοφορία έχουν τώρα μια τεκμηριωμένη εξήγηση, τρία επώνυμα ελαττώματα και μια επαναφορά — αλλά και έναν νέο λόγο για να συγκρίνουν κάθε ενημέρωση μοντέλου με την ημέρα αποστολής του.

Μείνε μπροστά από την τεχνητή νοημοσύνη

Οι εκκινήσεις μοντέλων, οι νεκροψίες ελαττωμάτων και τα εργαλεία που αναδιαμορφώνουν το λογισμικό λειτουργούν — παρακολουθούνται καθημερινά.

Διαβάστε περισσότερα νέα AI →