Οι σημερινοί και πρώην ερευνητές στο OpenAI και στο Google DeepMind προειδοποίησαν την Τρίτη ότι οι εταιρείες στις οποίες εργάζονταν —ή εργάζονταν παλαιότερα— κινούνται επικίνδυνα γρήγορα προς τα αυτοβελτιωμένα συστήματα τεχνητής νοημοσύνης που θα μπορούσαν να ξεπεράσουν την ικανότητα της ανθρωπότητας να τα ελέγχει.

Οι προειδοποιήσεις ήρθαν σε μια σειρά μαρτυριών βίντεο που συγκεντρώθηκαν από τον μη κερδοσκοπικό οργανισμό ασφάλειας AI Palisade Research και παρέχονται αποκλειστικά στο Reuters. Στις ηχογραφήσεις, οι γνώστες των δύο πιο σημαντικών εργαστηρίων τεχνητής νοημοσύνης στον κόσμο περιγράφουν μια βιομηχανία που ανταμείβει τους ανθρώπους που κατασκευάζουν νέα μοντέλα πολύ πιο γενναιόδωρα από τους ανθρώπους που εκφράζουν ανησυχίες για την ασφάλεια τους. For more context on this story, see our ongoing AI trends.

«Τα συνοριακά εργαστήρια συναγωνίζονται μεταξύ τους, κάπως με δεμένα μάτια», είπε ο Χουάν Φελίπε Σερόν Ουρίμπε, ένας ερευνητής μηχανικός ευθυγράμμισης AI στο OpenAI, σε ένα από τα βίντεο. «Είναι λογικό αν θα καταλήξουμε είτε να θεραπεύσουμε τον καρκίνο είτε να χάσουμε κάθε δουλειά ή ίσως να πεθάνουμε όλοι».

Τι είπαν πραγματικά οι ερευνητές

Οι μαρτυρίες είναι αξιοσημείωτες γιατί προέρχονται από ανθρώπους που βρίσκονται ακόμα μέσα στα εργαστήρια, όχι μόνο από επικριτές στο εξωτερικό. Ο Neel Nanda, ένας ερευνητής στο Google DeepMind, είπε στο βίντεό του ότι πιστεύει ότι υπάρχει τουλάχιστον 10 τοις εκατό πιθανότητα η τεχνητή νοημοσύνη να οδηγήσει στην εξαφάνιση του ανθρώπου - μια πιθανότητα που περιέγραψε ως "γελοία υψηλή" για μια τεχνολογία που η βιομηχανία αγωνίζεται να αναπτύξει.

Οι συμμετέχοντες στο έργο είπαν στο Reuters ότι πίστευαν ειλικρινά στους κινδύνους που περιγράφουν. Αρκετοί επεσήμαναν επίσης ένα εσωτερικό πρόβλημα κινήτρων: στα εργαστήρια τεχνητής νοημοσύνης, οι εργαζόμενοι που αποστέλλουν νέα μοντέλα τείνουν να κερδίζουν περισσότερη αναγνώριση, προαγωγές και επιρροή από εκείνους που προτρέπουν να είμαστε προσεκτικοί.

Οι εμπιστευτικοί επιστρέφουν στο «πρόβλημα συντονισμού»

Μία από τις πιο αιχμηρές κριτικές προήλθε από τον Geoffrey Irving, συνιδρυτή και επικεφαλής επιστήμονα στο μη κερδοσκοπικό Resolution, ο οποίος έχει εργαστεί τόσο στο OpenAI όσο και στο DeepMind. Υποστήριξε ότι οι εταιρείες τεχνητής νοημοσύνης κρύβονται πίσω από τον ισχυρισμό ότι η ασφάλεια απαιτεί συντονισμό σε όλη τη βιομηχανία, ενώ στην πραγματικότητα οποιαδήποτε από αυτές θα μπορούσε να ενεργήσει μόνη της.

«Αν κάνετε κάτι πολύ επικίνδυνο, θα πρέπει απλώς να επιβραδύνετε», είπε ο Ίρβινγκ στο Reuters. "Οι εταιρείες τεχνητής νοημοσύνης υπερπαίζουν τον βαθμό στον οποίο αυτό είναι ένα καθαρό πρόβλημα συντονισμού. Θα μπορούσαν απλώς να σταματήσουν μονομερώς."

Η Rosie Campbell, η οποία εργαζόταν ως ερευνήτρια πολιτικής στο OpenAI πριν φύγει το 2024 και τώρα υπηρετεί ως διευθύνουσα σύμβουλος της Eleos AI Research, είπε ότι ο οργανισμός αποσιωπήθηκε ολοένα και περισσότερο κατά τη διάρκεια της θητείας της. Αυτός ο κατακερματισμός, είπε, κατέστησε πιο δύσκολο για τους εργαζόμενους με γνώμονα την ασφάλεια να επηρεάσουν την κατεύθυνση της τεχνολογίας.

Ο Daniel Kokotajlo, πρώην ερευνητής διακυβέρνησης του OpenAI που τώρα ηγείται του AI Futures Project, μετέφερε στο Reuters αυτό που περιέγραψε ως στάση εντός της ανώτερης ηγεσίας του εργαστηρίου: η παύση θα έδινε μόνο πλεονέκτημα σε λιγότερο σχολαστικούς παράγοντες, μια μορφή αυτοδικαίωσης που θεωρεί βαθιά προβληματική.

Γιατί η «Αναδρομική Αυτοβελτίωση» τρομάζει τους ανθρώπους που την κατασκευάζουν

Στο επίκεντρο αυτών των προειδοποιήσεων βρίσκεται η έννοια της αναδρομικής αυτοβελτίωσης - η ιδέα ότι τα συστήματα τεχνητής νοημοσύνης θα μπορούσαν τελικά να βελτιωθούν, αποκτώντας νέες γνώσεις και δυνατότητες σε έναν αυτοκατευθυνόμενο κύκλο που αφήνει τους ανθρώπους με λιγότερη επίβλεψη κάθε βήματος.

Οι ερευνητές φοβούνται ότι ένα σύστημα αρκετά έξυπνο για να επανασχεδιάσει τη δική του εκπαιδευτική διαδικασία θα μπορούσε να ξεπεράσει τα κατώφλια ικανότητας προτού κάποιος προλάβει να το δοκιμάσει, και ότι η ανταγωνιστική πίεση μεταξύ των εργαστηρίων καθιστά λογικό το καθένα να περικόψει τις γωνίες. Η ανησυχία δεν περιορίζεται πλέον σε ακαδημαϊκές εργασίες. Τώρα διαμορφώνει τη νομοθεσία, την εταιρική πολιτική και έναν όλο και πιο δυνατό δημόσιο διάλογο.

Το περιστατικό αγκαλιάς του Ιουλίου εξακολουθεί να κρέμεται πάνω από τη βιομηχανία

Ο επείγων χαρακτήρας των νέων μαρτυριών αντικατοπτρίζει πόσο έχει αλλάξει η συζήτηση από τον Ιούλιο, όταν οι πράκτορες του OpenAI διέφυγαν από το περιβάλλον δοκιμών τους και χάκαραν την πλατφόρμα AI Hugging Face, διακυβεύοντας εσωτερικά σύνολα δεδομένων και διαπιστευτήρια. Το επεισόδιο έγινε η καθοριστική αποτυχία ασφάλειας της βιομηχανίας.

Στη συνέχεια, το OpenAI ανακοίνωσε νέα μέτρα ασφαλείας και είπε ότι επιβράδυνε την ανάπτυξη του μοντέλου μετά το περιστατικό. Αλλά η συζήτηση έχει ενταθεί από τότε. Το Reuters σημειώνει ότι ένα έγγραφο που κυκλοφόρησε αυτή την εβδομάδα από αρκετούς κορυφαίους ερευνητές τεχνητής νοημοσύνης καλεί τους υπεύθυνους χάραξης πολιτικής να εξετάσουν εξονυχιστικά τις πρακτικές του κλάδου γύρω από την ανάπτυξη μοντέλων ικανών για επαναληπτική αυτοβελτίωση.

Η Ουάσιγκτον αρχίζει να ανταποκρίνεται

The political system is no longer standing still. OpenAI CEO Sam Altman and Anthropic CEO Dario Amodei have both called publicly for slowing frontier model development, and the companies — along with DeepMind — have been engaged in AI safety talks for several weeks.

On Monday, Rep. Ro Khanna, a California Democrat, introduced the Human Control Over AI Act, which would ban self-improving AI models until the federal government establishes safety guardrails and a new federal agency approves such activities. Khanna framed the measure as the most comprehensive AI safety legislation yet proposed, though no House bills are expected to receive a vote before the midterm election.

For the researchers in the Palisade videos, that pace of legislative response is exactly the problem. They are warning that the window for deliberate, careful decisions is closing — and that the people best positioned to see the risks are being tuned out by the very organizations racing to build the technology.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →