Το Anthropic δημοσίευσε ένα λεπτομερές σύνολο αυτομετρήσεων το Σάββατο με σκοπό να αφήσει το κοινό, τους δημοσιογράφους και τις κυβερνήσεις να παρακολουθούν πόσο γρήγορα αναπτύσσεται η συνοριακή τεχνητή νοημοσύνη - συμπεριλαμβανομένου ενός πρώτου στο είδος του ευρετηρίου του πόσο μεγάλο μέρος της έρευνας της εταιρείας εκτελείται τώρα από την τεχνητή νοημοσύνη και η αποκάλυψη ότι περίπου 30.000 πράκτορες τεχνητής νοημοσύνης εργάζονται ανά πάσα στιγμή στην εταιρεία έρευνα και μηχανή.
Η ανάρτηση, με τίτλο "Μετρήσεις για την κατανόηση του ρυθμού ανάπτυξης τεχνητής νοημοσύνης εντός των συνοριακών εργαστηρίων", έρχεται στο επίκεντρο του πιο συνεπαγόμενου επιχειρήματος στον κλάδο: εάν η ανάπτυξη των συνόρων πρέπει να επιβραδυνθεί σκόπιμα. Ο Dario Amodei ζήτησε συντονισμό για «βηματισμό στα σύνορα», μια πρόταση που έχει κλονίσει τις αγορές, έχει προκαλέσει μήνυση καταναλωτών ισχυριζόμενη συμπαιγνία βηματοδότησης μεταξύ μεγάλων εργαστηρίων και ώθησε τον Πρόεδρο Τραμπ να ανακοινώσει μια «Δύναμη AI» αφιερωμένη στην αποτροπή οποιασδήποτε επιβράδυνσης. Το πλαίσιο της Anthropic είναι σαφές σχετικά με αυτό το πλαίσιο: "Καθώς ο κόσμος εξετάζει το ενδεχόμενο να επιβραδύνει τον ρυθμό ανάπτυξης της συνοριακής τεχνητής νοημοσύνης, το κοινό χρειάζεται περισσότερες πληροφορίες."
Τρεις μετρήσεις για την παρακολούθηση της προόδου της τεχνητής νοημοσύνης
Η εταιρεία καθόρισε τρεις περιοχές μέτρησης που υποστηρίζει ότι κάθε συνοριακό εργαστήριο θα μπορούσε να δημοσιεύει τακτικά:
1. Πόσο μεγάλο μέρος της Ε&Α της τεχνητής νοημοσύνης εκτελείται από την ίδια την τεχνητή νοημοσύνη. Η Anthropic δημιούργησε ένα πρωτότυπο "Anthropic R&D Automation Index" καταγράφοντας κάθε είδους εργασία έρευνας και ανάπτυξης τεχνητής νοημοσύνης που γίνεται στην εταιρεία, αξιολογώντας πόσο αυτοματοποιημένη είναι αυτή τη στιγμή κάθε εργασία και συγκεντρώνοντας τα αποτελέσματα. Οι αξιολογήσεις χρησιμοποιούν τη δημόσια κλίμακα "Automation Level" της Epoch AI, η οποία εκτείνεται από AL0 (χωρίς εμπλοκή AI) έως AL5 (το AI λειτουργεί πλήρως αυτόνομα χωρίς άνθρωπο στο βρόχο). Σε αυτήν την κλίμακα, το AL3 σημαίνει ότι η τεχνητή νοημοσύνη «συνεργάζεται» — κάνοντας μεγάλα κομμάτια εργασίας υπό στενή ανθρώπινη καθοδήγηση — ενώ AL4 σημαίνει τεχνητή νοημοσύνη «ηγείται», ολοκληρώνοντας το μεγαλύτερο μέρος μιας εργασίας από άκρο σε άκρο από μια προτροπή υψηλού επιπέδου ενώ ένας άνθρωπος επιβλέπει.Ο στόχος του δείκτη είναι να μετρήσει πόσο πλησιάζει ένα εργαστήριο στην αναδρομική αυτοβελτίωση - ένα μοντέλο που δημιουργεί πλήρως αυτόνομα τον δικό του διάδοχο. Η Anthropic σημειώνει ότι τα μοντέλα που επιταχύνουν την ανάπτυξη της τεχνητής νοημοσύνης «θα μπορούσαν να κάνουν πιο δύσκολο για τους ανθρώπους να κατανοήσουν ή να ελέγξουν αυτά τα συστήματα».
2. Πόσο καλά επιβλέπονται οι ενέργειες των πρακτόρων τεχνητής νοημοσύνης. Εδώ εμφανίζεται ο αριθμός των 30.000. Από τον Αύγουστο του 2026, περίπου 30.000 πράκτορες εκτελούσαν εργασίες έρευνας και μηχανικής ανά πάσα στιγμή μέσα στην πιο χρησιμοποιούμενη εσωτερική πλατφόρμα του Anthropic, αναθέτοντας καθήκοντα ο ένας στον άλλο και εργάζονταν ημιαυτόνομα για μεγάλες εκτάσεις. Η εταιρεία μετρά τρία πράγματα σχετικά με την επίβλεψη αυτών των πρακτόρων: κάλυψη (το μερίδιο ενεργειών αντιπροσώπων που περνούν από μια οθόνη πριν ή μετά την εκτέλεση), καθυστέρηση αναθεώρησης (πόσο γρήγορα ελέγχονται οι επισημασμένες ενέργειες, πρώτα από μια αυτοματοποιημένη οθόνη και μετά από έναν άνθρωπο) και ποσοστό κλιμάκωσης (το μερίδιο δραστηριοτήτων που αποκλείονται, ανακατευθύνονται ή επισημαίνονται για έλεγχο).Τα μέχρι στιγμής δεδομένα παρακολούθησης της Anthropic υποδηλώνουν ότι οι μεμονωμένοι πράκτορες σπάνια συμπεριφέρονται άσχημα — αλλά η εταιρεία προειδοποιεί ότι «όταν υπάρχουν εκατομμύρια ή δισεκατομμύρια πράκτορες που δραστηριοποιούνται στην οικονομία, ακόμη και σπάνια συμβάντα μπορεί να συμβαίνουν τακτικά».
3. Πώς κατανέμεται ο υπολογισμός. Η τρίτη μέτρηση παρακολουθεί τον τρόπο κατανομής των υπολογιστικών πόρων του εργαστηρίου — την ακατέργαστη είσοδο που συσχετίζεται με τις δυνατότητες του μοντέλου. Μαζί με τις άλλες δύο μετρήσεις, η Anthropic υποστηρίζει ότι αυτό δίνει στους ξένους έναν τρόπο να συσχετίσουν τις εισροές μοντέλων με τις εκροές μοντέλων, συμπληρώνοντας τις αξιολογήσεις δυνατοτήτων που η εταιρεία δημοσιεύει ήδη μέσω των εκθέσεων κινδύνου της Πολιτικής Υπεύθυνης Κλιμάκωσης.Οι αριθμοί θα κινούνταν κάτω από μια επιβράδυνση
Η πιο πολιτικά αιχμηρή γραμμή της ανάρτησης στοχεύει άμεσα στη συζήτηση με ρυθμό: η Anthropic δηλώνει ότι "θα περίμενε ότι αυτοί οι αριθμοί θα αλλάξουν εάν υπήρχε συντονισμός για τη βηματοδότηση στα σύνορα, όπως ζήτησε ο διευθύνων σύμβουλος της Anthropic, Dario Amodei". Με άλλα λόγια, εάν ο κλάδος επιβραδύνει πραγματικά, αυτές οι μετρήσεις είναι πώς το κοινό θα μπορούσε να το επαληθεύσει - και εάν οι εταιρείες ισχυρίζονται ότι βαδίζουν ενώ ο αριθμός τους συνεχίζει να αυξάνεται, οι μετρήσεις θα το αποκάλυπταν επίσης.
Η ανεξάρτητη επαλήθευση είναι το κομμάτι που λείπει
Η Anthropic αναγνωρίζει την κεντρική αδυναμία των αυτοαναφερόμενων μετρήσεων: χρησιμοποιεί τα δικά της μοντέλα για να αξιολογήσει τα δικά της συστήματα, πράγμα που σημαίνει ότι το μοντέλο "κριτής" θα μπορούσε να μοιραστεί τα τυφλά σημεία του μοντέλου που ελέγχεται. Η εταιρεία σημειώνει επίσης την έλλειψη κοινής μεθοδολογίας σε όλα τα εργαστήρια, γεγονός που καθιστά τις συγκρίσεις δύσκολες.
Η προτεινόμενη λύση είναι η ενσωμάτωση ανεξάρτητων τρίτων αξιολογητών από πολλούς οργανισμούς στο Anthropic, παρέχοντάς τους πρόσβαση σε εσωτερικές διαδικασίες, συστήματα και δεδομένα συγκρίσιμα με αυτά που βλέπουν οι εσωτερικές ομάδες αξιολόγησης κινδύνου. Αυτά τα τρίτα μέρη θα επαληθεύουν τις πρακτικές ασφαλείας, θα αναφέρουν περιστατικά και θα παρακολουθούν τις νέες μετρήσεις. Η εταιρεία λέει ότι η METR, ο μη κερδοσκοπικός οργανισμός αξιολόγησης, έχει προηγουμένως συνεργαστεί από ανεξάρτητη πλατφόρμα παρακολούθησης εκτός σύνδεσης και ότι σχεδιάζει να δημοσιεύει αυτές τις μετρήσεις τακτικά σε μορφή που μπορούν να επαληθεύσουν άλλοι.
Οι μετρήσεις συνδέονται με την ευρύτερη πρόταση του Anthropic Advanced AI Framework, η οποία καθορίζει τους «κανόνες του δρόμου» για τις εκδόσεις μοντέλων στα σύνορα, συμπεριλαμβανομένων των υποχρεώσεων διαφάνειας που θα μπορούσαν να απαιτήσουν οι κυβερνήσεις — όπως τυποποιημένες αναφορές κινδύνου.
Μια δοκιμή για ολόκληρη τη βιομηχανία
Η βαθύτερη σημασία της θέσης μπορεί να είναι ανταγωνιστική. Η Anthropic προκαλεί ουσιαστικά κάθε συνοριακό εργαστήριο να δημοσιεύσει τους ίδιους αριθμούς, υποστηρίζοντας ότι «κάθε συνοριακός προγραμματιστής θα μπορούσε να δημοσιεύει αυτά τα μέτρα τακτικά, χρησιμοποιώντας μια δημόσια μεθοδολογία». Εάν οι αντίπαλοι υποχωρήσουν, η αντίθεση γίνεται το δικό της σημείο δεδομένων στη συζήτηση για την ασφάλεια. Εάν συμφωνούν, ο κλάδος αποκτά το πρώτο κοινό κριτήριο για το πόσο γρήγορα προχωρά η τεχνητή νοημοσύνη.
Προς το παρόν, οι αριθμοί αναφέρονται από μόνη της από μια εταιρεία με προφανές ενδιαφέρον για τη συνομιλία με ρυθμό. Αλλά αντιπροσωπεύουν κάτι που έλειπε από τη συζήτηση: συγκεκριμένες, επαναλαμβανόμενες μετρήσεις που θα έδειχναν εάν τα σύνορα επιταχύνονται, παραμένουν σταθερά ή όντως επιβραδύνονται.
Μείνετε μπροστά από την τεχνητή νοημοσύνη
Οι αποκαλύψεις του Frontier lab όπως αυτή προσγειώνονται κάθε εβδομάδα. Για περισσότερη πρωτοποριακή έρευνα για την τεχνητή νοημοσύνη και κάλυψη του κλάδου, ακολουθήστε το AI Buzz Wire.
Διαβάστε τις τελευταίες ειδήσεις AI →