Το GPT-6 Astra του OpenAI έχει προσθέσει ένα ασυνήθιστο τρόπαιο στο ρεκόρ του: ένα πλήρες playthrough του εμβληματικού παζλ πρώτου προσώπου της Valve, το οποίο ολοκληρώθηκε αυτόνομα σε λιγότερο από 24 ώρες με συνολικό κόστος 571,18 $. Το Verge ανέφερε το ορόσημο στις 6 Σεπτεμβρίου 2026, αποδίδοντας πιστώσεις σε έναν χρήστη γνωστό ως cozyblaze, ο οποίος ενσωμάτωσε το frontier μοντέλο στο παιχνίδι και του άφησε να καταλάβει τα υπόλοιπα.

Το Portal είναι ένα απαιτητικό τεστ για έναν πράκτορα AI παρά την ηλικία του. Κυκλοφόρησε από τη Valve το 2007, το παιχνίδι απαιτεί από τους παίκτες να συλλογιστούν σχετικά με τα χωρικά παζλ χρησιμοποιώντας ένα πιστόλι πύλης — δημιουργώντας συνδεδεμένα ανοίγματα σε τοίχους, δάπεδα και οροφές για να μετακινούνται μέσα σε θαλάμους δοκιμής που αψηφούν συνήθως τη διαίσθηση. Δεν υπάρχει κανένα μαχητικό άλεσμα για να στηριχθείς και κανένας δείκτης αναζήτησης για να ακολουθήσεις. κάθε θάλαμος είναι ουσιαστικά ένας γρίφος της φυσικής. Για τους αναγνώστες που παρακολουθούν τον τρόπο με τον οποίο υποβάλλονται σε δοκιμές ακραίων καταστάσεων τα συνοριακά μοντέλα, αυτή η εκτέλεση είναι μια ζωντανή καταχώριση στην κάλυψη των εξελίξεων AI.

Από τα βίντεο επίδειξης στην πλήρη ολοκλήρωση

Το τρέξιμο δεν ήρθε από το πουθενά. Νωρίτερα, στις 6 Σεπτεμβρίου, ένα βίντεο στο YouTube που δείχνει το GPT-6 Astra να παίζει το Portal κυκλοφόρησε στο Hacker News και μια ανάρτηση που σημειώνει ότι το μοντέλο είχε «ολοκληρώσει αυτόνομα» το παιχνίδι τράβηξε την προσοχή καθώς περνούσε η μέρα. Η αναφορά του The Verge επιβεβαίωσε τις λεπτομέρειες: το πλήρες παιχνίδι, ηττήθηκε σε λιγότερο από 24 ώρες, για λιγότερο από 600 $ σε υπολογισμό — με ένα συμπυκνωμένο βίντεο του τρεξίματος που δημοσιεύτηκε για τους σκεπτικιστές.

Το The Verge δεν μπόρεσε να αντισταθεί στην ποσοτικοποίηση της περιβαλλοντικής πλευράς του λογαριασμού, σημειώνοντας ότι το τρέξιμο πιθανότατα κατανάλωσε περίπου νερό μιας μικρής πισίνας στην ψύξη του κέντρου δεδομένων. Είναι μια σκανδαλώδης υπενθύμιση ότι οι εκδόσεις πρακτόρων παιχνιδιών είναι φθηνές για τον χρήστη αλλά όχι δωρεάν για τον πλανήτη.

Γιατί ένα Puzzler του 2007 είναι ένα σοβαρό σημείο αναφοράς

Το Beating Portal δεν είναι ένα προγραμματισμένο σημείο αναφοράς όπως το ARC-AGI ή το SWE-bench, και γι' αυτό εν μέρει έχει απήχηση. Το παιχνίδι απαιτεί ακριβώς τις δεξιότητες που έχουν διαχωρίσει ιστορικά τους ανθρώπους από τα συστήματα AI:

  • Χωρικός συλλογισμός. Οι λύσεις απαιτούν πρόβλεψη του σημείου που θα εκτοξεύσει το σώμα του παίκτη μια έξοδος πύλης — τρισδιάστατη λογική φυσικής που έχει σκοντάψει τους πράκτορες για χρόνια.
  • Σχεδιασμός μακροπρόθεσμου ορίζοντα. Επιμελητήρια αλυσίδας πολλαπλών βημάτων. Η αποτυχία του τελικού βήματος συνήθως σημαίνει την επανάληψη της ακολουθίας από την αρχή.
  • Μαθαίνουμε από την αποτυχία χωρίς να κρατάμε το χέρι. Δεν υπάρχουν υποδείξεις. Ο πράκτορας πρέπει να συμπεράνει τους κανόνες του παιχνιδιού μέσω δοκιμής και λάθους και, στη συνέχεια, να τους γενικεύσει σε νέα δωμάτια.

Νωρίτερα αυτό το έτος, το GPT-6 Astra του OpenAI ξεπέρασε τα σημεία αναφοράς ARC-AGI-3 που επικεντρώθηκαν στην συλλογιστική των πρακτόρων και το μοντέλο έχει τραβήξει την προσοχή για τις δυνατότητες χρήσης υπολογιστή - την ικανότητα να χειρίζονται διεπαφές λογισμικού με τον τρόπο που θα έκανε ένα άτομο. Το Portal run είναι μια παιχνιδιάρικη αλλά γνήσια επίδειξη του ίδιου συνόλου δεξιοτήτων: αντίληψη, σχεδιασμός και έλεγχος, που ξετυλίγονται για ώρες χωρίς ανθρώπινη παρέμβαση.

Μέρος ενός ευρύτερου κύματος

Το τρέξιμο είναι επίσης ένα σημάδι για το πού έφτασε το gaming AI το 2026. Οι βαθμολογίες συγκριτικής αξιολόγησης μοιράζονται πλέον χώρο με πολιτιστικά ορόσημα: μοντέλα που συνθέτουν χορικά του Μπαχ, νικούν τα τεστ αναγνώρισης χειρόγραφης διόρθωσης και ολοκληρώνουν παιχνίδια που κάποτε ονομάζονταν "οι υπολογιστές δεν θα το κάνουν ποτέ αυτό". Κάθε πέρασμα ανακουφίζει μια παλιά βεβαιότητα και εγείρει το ερώτημα ποιο θα είναι το επόμενο.

Υπάρχουν επίσης πρακτικές συνέπειες. Ο ίδιος βρόχος που επέτρεψε στη ρύθμιση του cozyblaze να κατευθύνει την Πύλη - στιγμιότυπα οθόνης, αποφάσεις, με κόστος μερικές εκατοντάδες δολάρια - είναι ο βρόχος που παράγεται για δοκιμές λογισμικού, ρομποτική και βοηθούς χρήσης υπολογιστή. Ένα μοντέλο που μπορεί να κρατήσει κατά νου τη φυσική ενός παιχνιδιού για ένα πλήρες playthrough είναι ένα μοντέλο που μπορεί, καταρχήν, να αντιμετωπίσει μεγάλες, ακατάστατες εργασίες λογισμικού που νικούν συστήματα συντομότερου περιβάλλοντος.

Προς το παρόν, όμως, το takeaway είναι πιο απλό. Μια τεχνητή νοημοσύνη κέρδισε ένα από τα πιο αγαπημένα παζλ του gaming, από την αρχή μέχρι το τέλος, στην τιμή περίπου της κατάθεσης μιας νέας GPU — και δημοσίευσε το βίντεο. Οι θάλαμοι δοκιμών του Aperture Science σχεδιάστηκαν για να κάνουν τους ανθρώπους να αισθάνονται έξυπνοι. Αυτό το Σαββατοκύριακο έκαναν ένα μοντέλο να δείχνει άπταιστα.

Πώς ελήφθη το Run

Η ανταπόκριση παρακολούθησε το τόξο των ορόσημων gaming AI γενικά: πρώτα η δυσπιστία, μετά το βίντεο και μετά η αποδοχή. Στο Hacker News, η σειρά προσέλκυσε μια σταθερή ροή σχολιαστών που αναλύουν πώς λειτουργούσε η ρύθμιση και τι υπονοούσε για την τεχνητή νοημοσύνη - με αρκετούς να σημειώνουν ότι ο συνολικός λογαριασμός ήταν χαμηλότερος από ό,τι πολλοί υπέθεσαν ότι θα κόστιζε μια τέτοια εκτέλεση. Το συμπυκνωμένο βίντεο της ολοκλήρωσης έδωσε στους σκεπτικιστές έναν τρόπο να επαληθεύσουν οι ίδιοι την αξίωση, κάτι που είναι περισσότερο από ό,τι προσφέρουν τα περισσότερα αποτελέσματα αναφοράς.

Ζητούσε επίσης σύγκριση με τα ορόσημα που προηγήθηκαν. Το gaming έχει χρησιμεύσει για δεκαετίες ως δημόσιος χώρος δοκιμών του πεδίου, από επιτραπέζια παιχνίδια μέχρι στρατηγική σε πραγματικό χρόνο μέχρι sandboxes ανοιχτού τύπου. Κάθε φορά που πέφτει ένα παιχνίδι, το επιχείρημα αλλάζει: οι σημερινοί σκεπτικιστές επιμένουν ότι το κατόρθωμα ήταν στενό, εξειδικευμένο ή εξειδικευμένο κατά κάποιο τρόπο μη γενικεύσιμο. Αυτό που κάνει την Πύλη αξιοσημείωτη σε αυτή την ιστορία είναι το πόσο συνηθισμένη ήταν η εγκατάσταση — ένα εμπορικά διαθέσιμο μοντέλο συνόρων, ένα παιχνίδι για καταναλωτές και μερικές εκατοντάδες δολάρια υπολογισμού, αντί για ένα σύστημα έρευνας κατά παραγγελία που έχει εκπαιδευτεί ειδικά για το παιχνίδι.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →