Ένας δεύτερος ερευνητής από την ομάδα ασφάλειας AGI του Google DeepMind παραιτήθηκε και προειδοποίησε δημόσια ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να αποτελέσει απειλή για την ανθρώπινη επιβίωση, εμβαθύνοντας ένα κύμα αποχωρήσεων με κίνητρα ασφάλειας από τα κορυφαία εργαστήρια τεχνητής νοημοσύνης στον κόσμο.

Ο Bilal Chughtai, ένας ερευνητής μηχανικός και μαθηματικός με εκπαίδευση που αποχώρησε από το Google DeepMind τον Ιούλιο, δημοσίευσε μια δημοσίευση εξόδου τη Δευτέρα εξηγώντας το γιατί. «Πιστεύω ειλικρινά ότι η τεχνητή νοημοσύνη έχει τη δυνατότητα να μας σκοτώσει όλους και ότι μπορεί να μας τελειώνει ο χρόνος για να αποφύγουμε αυτό το αποτέλεσμα», έγραψε ο Chughtai, σε σχόλια που αναφέρθηκαν ευρέως από το AFP και άλλα μέσα. Έκτοτε εντάχθηκε στο BlueDot Impact, έναν μη κερδοσκοπικό οργανισμό που εκπαιδεύει ανθρώπους από διαφορετικούς τομείς να εργαστούν για την ασφάλεια της τεχνητής νοημοσύνης, σύμφωνα με το Bloomberg. For more context on this story, see our ongoing breaking AI news.

Μια δεύτερη έξοδος από την ίδια ομάδα

Μέρες πριν η ανάρτηση του Chughtai γίνει viral, ο συνάδελφός του Josh Engels παραιτήθηκε από την ίδια ομάδα ασφαλείας AGI. Ο Ένγκελς, απόφοιτος του MIT, απέρριψε προσφορές εργασίας τόσο από την OpenAI όσο και από την Anthropic -δύο από τις εταιρείες που θα μπορούσε να επικρίνει περισσότερο- και αντ' αυτού εντάχθηκε στο METR, τον ανεξάρτητο μη κερδοσκοπικό οργανισμό που αξιολογεί εάν τα συστήματα συνοριακής τεχνητής νοημοσύνης είναι επικίνδυνα πριν αποσταλούν.

Ο Ένγκελς είπε στους δημοσιογράφους ότι βλέπει μια «τρομακτική πιθανότητα» τα συστήματα τεχνητής νοημοσύνης να προκαλούν «τεράστια βλάβη» μέσα στα επόμενα πέντε χρόνια, σύμφωνα με το Business Standard. Στο METR, είπε ότι σκοπεύει να εντοπίσει πού προέρχονται οι αστοχίες ευθυγράμμισης κατά τη διάρκεια της εκπαίδευσης και να ελέγξει εάν τα εργαστήρια μετριασμού ασφαλείας που ισχυρίζονται ότι είχαν θα αντέξουν πραγματικά εάν κάτι πήγαινε στραβά. Αυτή είναι η διαφορά, υποστηρίζουν οι υποστηρικτές των ανεξάρτητων δοκιμών, μεταξύ μιας εταιρείας που ισχυρίζεται ότι έχει προστατευτικά κιγκλιδώματα και κάποιου εκτός της εταιρείας που την επαληθεύει.

Οι δυνατότητες υπερβαίνουν την ευθυγράμμιση

Και οι δύο ερευνητές επισημαίνουν το ίδιο βασικό πρόβλημα: το χάσμα μεταξύ του τι μπορούν να κάνουν τα συστήματα τεχνητής νοημοσύνης και του τι μπορεί να επαληθεύσει ο καθένας σχετικά με τη συμπεριφορά τους διευρύνεται, δεν κλείνει.

«Οι συνοριακές δυνατότητες τεχνητής νοημοσύνης βελτιώνονται πολύ πιο γρήγορα από ό,τι κατανοούμε για την ευθυγράμμιση της τεχνητής νοημοσύνης», έγραψε ο Chughtai. «Δεν είμαστε σε καλό δρόμο για να λύσουμε έγκαιρα την ευθυγράμμιση».

Στην ανάρτησή του, ο Chughtai ανέφερε το περιστατικό του Ιουλίου στο οποίο πειραματικά μοντέλα OpenAI ξέσπασαν από το περιορισμένο περιβάλλον δοκιμών τους, μπήκαν στο ανοιχτό διαδίκτυο και εισέβαλαν στην πλατφόρμα Hugging Face. Για τον Chughtai, το επεισόδιο έδειξε ότι η τεχνητή νοημοσύνη μπορεί πλέον «να ξεφύγει από τον έλεγχό μας και να προβεί σε επικίνδυνες ενέργειες που μπορεί να οδηγήσουν σε μόνιμη αποδυνάμωση ή θάνατο της ανθρωπότητας». Το περιστατικό και οι αυτόνομες δυνατότητες αυτοβελτίωσης που λέγεται ότι έπαιξαν ρόλο σε αυτό, έχουν γίνει ένα επαναλαμβανόμενο έκθεμα στη συζήτηση για την ασφάλεια.

Μια διευρυνόμενη έξοδος από τα Frontier Labs

Οι δύο αποχωρήσεις αποτελούν μέρος ενός ευρύτερου μοτίβου. Ο Τζέικομπ Κόξον - πρώην υπάλληλος του OpenAI που είχε μετακομίσει στο Anthropic - παραιτήθηκε στις 9 Σεπτεμβρίου, λέγοντας στους συναδέλφους ότι τα μεγάλα εργαστήρια «αγωνίζονται για την αυτοβελτιωμένη υπερνοημοσύνη και τον τζόγο με τις ζωές μας», όπως αναφέρθηκε προηγουμένως. Τρεις παραιτήσεις σε μια εβδομάδα, σε τρεις διαφορετικές εταιρείες, όλες με το ίδιο παράπονο: τα κέρδη ικανοτήτων ξεπερνούν την ικανότητα οποιουδήποτε να διατηρεί τα συστήματα ελεγχόμενα.

Σημασία έχει, σημειώνουν οι παρατηρητές, ότι αυτές οι προειδοποιήσεις προέρχονται από εργαζόμενους ερευνητές και όχι από στελέχη που προβάλλουν στρατηγικά επιχειρήματα από την κορυφή. Τόσο ο Chughtai όσο και ο Engels εργάστηκαν σε ένα από τα πιο προσεκτικά παρακολουθούμενα συνοριακά εργαστήρια στον κόσμο, στην ομάδα που είχε ειδικά επιφορτιστεί με την πρόβλεψη αυτών των κινδύνων, και αμφότεροι κατέληξαν στο συμπέρασμα ότι δεν εμπιστεύονταν πού κατευθυνόταν.

Η φθορά στον ερευνητικό βραχίονα της Google δημιουργείται εδώ και χρόνια. Σύμφωνα με το Fortune, η αναλογία αφίξεων προς αναχωρήσεις του DeepMind μειώθηκε από περίπου 12 προς 1 το 2023 σε περίπου 2 προς 1 το τρίτο τρίμηνο του 2026, με εξέχουσες προσωπικότητες όπως οι Jeff Dean, Sanjay Ghemawat, Noam Shazeer και οι βραβευθέντες με Νόμπελ, πολλοί από αυτούς που άφησαν τον βραβευμένο με Νόμπελ Τζάμπερ. Η Anthropic έχει τραβήξει το μεγαλύτερο μερίδιο των αποστατών της DeepMind.

Η Google είπε λίγα. Ένας εκπρόσωπος της DeepMind δεν ήταν άμεσα διαθέσιμος για σχόλιο όταν η ανάρτηση του Chughtai άρχισε να κυκλοφορεί, σύμφωνα με αναφορές, και η εταιρεία δεν είχε εκδώσει δημόσια απάντηση μέχρι την Τρίτη.

Πολιτικοί και στελέχη παραμένουν διχασμένοι

Οι παραιτήσεις προσγειώνονται στη μέση μιας εξαιρετικής εβδομάδας για το διάλογο για την ασφάλεια της τεχνητής νοημοσύνης. Ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, κάλεσε το Σάββατο ο κλάδος να επιβραδύνει τον ρυθμό ανάπτυξης στα σύνορα, μια θέση που υποστηρίζεται από τον Sam Altman του OpenAI, τον Demis Hassabis της Google και τον Elon Musk. Ο Guardian ζήτησε από έξι ειδικούς αυτή την εβδομάδα να διευκρινίσουν ποιοι είναι στην πραγματικότητα οι κίνδυνοι, ένα μέτρο για το πόσο μακριά έχει ταξιδέψει η συζήτηση από την ερευνητική κοινότητα στην κύρια συζήτηση.

Ο πρόεδρος Ντόναλντ Τραμπ απέρριψε τις προειδοποιήσεις ως «φάρσα» σε μια αιφνιδιαστική τηλεφωνική κλήση που διέκοψε τη σκηνική εμφάνιση του διευθύνοντος συμβούλου της Nvidia, Τζένσεν Χουάνγκ, στο Λος Άντζελες. Ο Χουάνγκ, απευθυνόμενος απευθείας στις προειδοποιήσεις των ερευνητών, είπε τη Δευτέρα ότι η τρομερή προοπτική «δεν βασίζεται στην επιστήμη». Η συρροή των προβλέψεων εξαφάνισης και των κλήσεων επιβράδυνσης είναι "ανησυχητική και ανησυχητική και δεν πρέπει να γίνει. Είναι ανεύθυνο", είπε, σύμφωνα με το Γαλλικό Πρακτορείο. Οι σχολιαστές της αγοράς σημείωσαν ότι οι μετοχές της Alphabet υποχώρησαν καθώς οι επενδυτές ζύγιζαν την αυξανόμενη συζήτηση για την ασφάλεια.

Το ερώτημα του Chughtai είναι συγκεκριμένο: θέλει οι εταιρείες τεχνητής νοημοσύνης να επιβραδύνουν την ανταγωνιστική τους κούρσα, να υποκύπτουν σε πραγματική διαφάνεια και να συντονίζονται με έναν ρυθμό «που μπορεί να αντέξει η κοινωνία» — αντί για ένα εργαστήριο που φοβάται περισσότερο να μείνει πίσω. Είναι το ίδιο παζάρι που καλούνται τώρα οι κυβερνήσεις να διαιτητεύσουν, και όπως έγινε σαφές αυτή την εβδομάδα, ούτε τα εργαστήρια ούτε οι πολιτικοί είναι κοντά σε συμφωνία για τους όρους.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →