Το Google DeepMind εγκαινίασε ένα νέο ινστιτούτο αφιερωμένο στη διεύρυνση της συζήτησης γύρω από την τεχνητή γενική νοημοσύνη — και τα εναρκτήρια δοκίμιά του περιλαμβάνουν μια συγκεκριμένη πρόταση από τον Demis Hassabis για έναν οργανισμό υπό την ηγεσία των ΗΠΑ που θα αξιολογεί τα μοντέλα τεχνητής νοημοσύνης συνόρων πριν από την ανάπτυξη.
Το Ινστιτούτο DeepMind, που ξεκίνησε την Τετάρτη από ερευνητές της Google και του Google DeepMind, απαριθμεί τον συνιδρυτή του DeepMind Shane Legg ως διευθύνοντα συντάκτη του, μαζί με το στέλεχος της Google, James Manyika και τον πρόεδρο του Google DeepMind, Demis Hassabis, ως διευθυντές, σύμφωνα με το TechCrunch. For more context on this story, see our ongoing more AI stories.
Περιθώριο Διαφωνίας
Ο δηλωμένος σκοπός του ινστιτούτου είναι να αναδείξει πραγματική διαφωνία — συμπεριλαμβανομένης της ίδιας της Google. «Δεν θα συμφωνούν πάντα και πιθανότατα θα αλλάξουν γνώμη, καθώς περισσότερα δεδομένα και πληροφορίες έρχονται στο φως στα σύνορα που κινούνται γρήγορα», αναφέρει η ανακοίνωση.
Η πρώτη του συλλογή περιλαμβάνει τέσσερα δοκίμια που καλύπτουν οικονομικές πολιτικές για τη διαχείριση πιθανών διαταραχών AGI, τη διατήρηση της αναγνώσιμης από τον άνθρωπο συλλογισμού μοντέλων, τις αρχές για την ανθρώπινη άνθηση και ένα πλαίσιο για την αξιολόγηση μοντέλων τεχνητής νοημοσύνης συνόρων.
Η θεσμοθέτηση ανοιχτής διαφωνίας είναι μια ασυνήθιστη κίνηση για ένα εταιρικό εργαστήριο AI, όπου τα δημόσια μηνύματα τείνουν να ελέγχονται αυστηρά. Εκ του σχεδιασμού, το ινστιτούτο δίνει στους ερευνητές της Google έναν χώρο για να διαφωνήσουν θέσεις που ενδέχεται να έρχονται σε σύγκρουση με τα εμπορικά συμφέροντα της εταιρείας — ή μεταξύ τους.
Το δοκίμιο για τη διαφάνεια: Δείτε το "Αδιαφανές σειριακό βάθος"
Ένα από τα τέσσερα δοκίμια, από τους ερευνητές ασφαλείας της DeepMind, Rohin Shah και Anca Dragan, υποστηρίζει ότι το συρρικνούμενο παράθυρο διαφάνειας της τεχνητής νοημοσύνης - η ικανότητα να βλέπεις και να ελέγχεις τη συλλογιστική βήμα προς βήμα ενός μοντέλου - δεν είναι αναπόφευκτη, ακόμη και καθώς οι νέες αρχιτεκτονικές κάνουν τα πιο ισχυρά μοντέλα πιο δύσκολο να παρακολουθούνται.
Οι συγγραφείς λένε ότι οι προγραμματιστές και οι ρυθμιστικές αρχές θα πρέπει να αντιμετωπίσουν άμεσα τους συμβιβασμούς ασφαλείας. Συγκεκριμένα, αυτό θα μπορούσε να σημαίνει περιορισμό αυτού που αποκαλούν "αδιαφανές σειριακό βάθος" - το μέγεθος του διαδοχικού υπολογισμού που μπορεί να εκτελέσει ένα μοντέλο χωρίς να παράγει ένα ευανάγνωστο ίχνος συλλογισμού - ή να απαιτείται από τους προγραμματιστές να αποδείξουν ότι τα λιγότερο διαφανή συστήματα παραμένουν εξίσου παρακολουθήσιμα με τα ερμηνεύσιμα.
Η πρόταση είναι αξιοσημείωτη επειδή αντιμετωπίζει την απώλεια ερμηνείας ως επιλογή σχεδιασμού και πολιτικής παρά ως αναπόφευκτη συνέπεια κλίμακας, ανοίγοντας την πόρτα σε απαιτήσεις που θα μπορούσαν να εγγραφούν σε κανονισμούς.
Η Πρόταση του Χασάμπις: Οργανισμός Προτύπων Συνόρων των ΗΠΑ
Το πιο συνεπακόλουθο δοκίμιο μπορεί να είναι του Χασάμπη. Προτείνει έναν οργανισμό προτύπων τεχνητής νοημοσύνης, υπό την ηγεσία των ΗΠΑ, επιφορτισμένο με την αξιολόγηση των πιο προηγμένων μοντέλων τεχνητής νοημοσύνης. Σύμφωνα με το πλαίσιο, οι προγραμματιστές θα υποβάλουν αρχικά τα μοντέλα εθελοντικά για έλεγχο έως και 30 ημέρες πριν από την κυκλοφορία. Μόλις το σύστημα αξιολόγησης αποδειχθεί αποτελεσματικό, η επιτυχία των δοκιμών του θα μπορούσε να γίνει προϋπόθεση για την ανάπτυξη μοντέλων συνόρων στις Ηνωμένες Πολιτείες.
Το όργανο θα ξεκινούσε σχεδιάζοντας αξιολογήσεις σε συνεννόηση με εταιρείες τεχνητής νοημοσύνης, αλλά τελικά θα αναπτύξει ανεξάρτητες, άγνωστες αξιολογήσεις - αυτό που το δοκίμιο αποκαλεί «κρατημένες» δοκιμές - για να εμποδίσει τα εργαστήρια να προσαρμόσουν τα μοντέλα τους σε γνωστά σημεία αναφοράς, έναν καλά τεκμηριωμένο τρόπο αποτυχίας των καθεστώτων δημόσιας αξιολόγησης.
Ο Χασάμπις άφησε επίσης ανοιχτή την πόρτα στην κλιμάκωση: το πλαίσιο θα μπορούσε να «βελτιωθεί εάν το απαιτεί η σοβαρότητα της κατάστασης», ενδεχομένως συμπεριλαμβανομένης μιας συντονισμένης επιβράδυνσης μεταξύ των συνοριακών προγραμματιστών τεχνητής νοημοσύνης.
Γιατί έχουν σημασία τα άλλα δύο δοκίμια
Τα υπόλοιπα δύο δοκίμια — σχετικά με τις οικονομικές πολιτικές για τη διαχείριση της διαταραχής του AGI και τις αρχές για την ανθρώπινη άνθηση — ολοκληρώνουν μια συλλογή που αντιμετωπίζει το AGI ως πρόβλημα σε ολόκληρη την κοινωνία και όχι ως καθαρά τεχνικό. Ο οικονομικός εκτοπισμός είναι εδώ και καιρό η πιο απτή ανησυχία του κοινού σχετικά με την προηγμένη τεχνητή νοημοσύνη και η πλαισίωση της παράλληλα με την πολιτική αξιολόγησης και την ερμηνευτικότητα υποδηλώνει ότι το ινστιτούτο θέλει οι υπεύθυνοι χάραξης πολιτικής να βλέπουν τα κομμάτια ως μια ατζέντα αντί για χωριστές συζητήσεις.
Αυτό το εύρος είναι επίσης ένα σημάδι για την τοποθέτηση της Google. Η εταιρεία ανταγωνίζεται για εταιρικούς πελάτες και κρατικές συμβάσεις, ενώ ταυτόχρονα υποστηρίζει ότι τα συνοριακά συστήματα χρειάζονται εξωτερικό έλεγχο. Η δημοσίευση της έντασης, αντί να την εξομαλύνει, είναι η βασική προϋπόθεση του ινστιτούτου.
Από την ανησυχία στις συγκεκριμένες προτάσεις
Τα δοκίμια φτάνουν καθώς η συζήτηση για την ασφάλεια του κλάδου μετατοπίζεται από τις ευρείες δηλώσεις ανησυχίας προς συγκεκριμένους μηχανισμούς: απαιτήσεις γνωστοποίησης, εξωτερικός έλεγχος και — εάν οι διασφαλίσεις υπολείπονται — συντονισμένες επιβραδύνσεις. Αυτή η αλλαγή επιταχύνθηκε αυτή την εβδομάδα, καθώς οι ηγέτες του κλάδου ενέκριναν στοιχεία της έκκλησης του CEO της Anthropic, Dario Amodei, να «επιταχύνει» την ανάπτυξη αιχμής AI, σύμφωνα με το TechCrunch.
Σημασία έχει ο χρόνος. Οι κυβερνήσεις και στις δύο πλευρές του Ατλαντικού σταθμίζουν τον τρόπο επίβλεψης συστημάτων των οποίων οι δυνατότητες προχωρούν ταχύτερα από την υποδομή αξιολόγησης. Μια πρόταση που προέρχεται από ένα κορυφαίο εργαστήριο τεχνητής νοημοσύνης - και περιλαμβάνει ανασκόπηση πριν από την κυκλοφορία - δίνει στους διαμορφωτές πολιτικής ένα πρότυπο που ο ίδιος ο κλάδος έχει υποστηρίξει ονομαστικά, το οποίο ήταν ιστορικά προϋπόθεση για ουσιαστική ρύθμιση της τεχνητής νοημοσύνης.
Τι να παρακολουθήσετε
Η συντακτική ανεξαρτησία του ινστιτούτου από την Google θα είναι η πρώτη δοκιμή. Εάν τα δοκίμια συνεχίσουν να περιλαμβάνουν θέσεις που έρχονται σε αντίθεση με τον εμπορικό οδικό χάρτη της Google - όπως αναμφισβήτητα κάνει το δοκίμιο για τη διαφάνεια - ο χώρος θα μπορούσε να συμβάλει σοβαρά στη συζήτηση για την πολιτική AGI. Εάν κινηθεί προς την εταιρική ανταλλαγή μηνυμάτων, θα είναι ένα ακόμη κανάλι δημοσίων σχέσεων σε ένα πολυσύχναστο πεδίο.
Είτε έτσι είτε αλλιώς, η ουσία είναι τώρα στο τραπέζι: οι απαιτήσεις αξιολόγησης πριν από την κυκλοφορία, οι καθυστερημένες δοκιμές, ακόμη και μια συντονισμένη επιβράδυνση υποστηρίζονται δημόσια από μια από τις πιο ισχυρές προσωπικότητες της τεχνητής νοημοσύνης. Το ερώτημα δεν είναι πλέον εάν τα μοντέλα συνόρων θα πρέπει να αξιολογούνται ανεξάρτητα, αλλά ποιος κάνει την αξιολόγηση — και σε ποιο χρονοδιάγραμμα.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →