Η Anthropic ανακοίνωσε την Τρίτη μια σημαντική επέκταση των προσπαθειών πρόσβασης μοντέλων με επίκεντρο την ασφάλεια, αναδιαρθρώνοντας την πρωτοβουλία της για ελεγμένη πρόσβαση σε ένα επίσημο Πρόγραμμα Επαλήθευσης Κυβερνοχώρου (CVP) με τρία διαφορετικά επίπεδα για επαγγελματίες της κυβερνοασφάλειας. Η κίνηση έρχεται καθώς η εταιρεία αποκάλυψε ότι η πρωτοβουλία Project Glasswing έχει αποκαλύψει τουλάχιστον 129.000 επαληθευμένες ευπάθειες λογισμικού από τον Απρίλιο.

Το αναδομημένο πρόγραμμα επιτρέπει στις ελεγμένες ομάδες ασφαλείας να εκτελούν τα πιο ικανά μοντέλα της Anthropic - συμπεριλαμβανομένων των Claude Opus 5.5, Claude Sonnet 5.5 και Claude Mythos 5.1 - με μειωμένες διασφαλίσεις και αποκλεισμούς ταξινομητές, άδειες που συνήθως δεν είναι διαθέσιμες στους γενικούς χρήστες. Σύμφωνα με το Anthropic, ο στόχος είναι να τεθούν οι δυνατότητες τεχνητής νοημοσύνης στα χέρια των υπερασπιστών προτού οι κακόβουλοι παράγοντες οπλίσουν τα ίδια εργαλεία. For more context on this story, see our ongoing AI news.

Τρεις βαθμίδες πρόσβασης, τρία σενάρια απειλών

Το νέο πρόγραμμα οργανώνεται γύρω από τρία επίπεδα πρόσβασης, το καθένα προσαρμοσμένο σε διαφορετικό τύπο εργασίας ασφαλείας:

  • Η Defense Access καλύπτει αμυντικές λειτουργίες όπως απόκριση περιστατικού, αντίστροφη μηχανική κακόβουλου λογισμικού και ανάλυση και επικύρωση ευπάθειας.
  • Η Red Team Access προσθέτει εξουσιοδοτημένες δοκιμές διείσδυσης και red-teaming στις περιπτώσεις αμυντικής χρήσης, επιτρέποντας προσομοιωμένες επιθέσεις εναντίον συστημάτων που οι οργανισμοί έχουν άδεια να δοκιμάσουν.
  • Η Ειδική πρόσβαση φέρει τις λιγότερες διασφαλίσεις και προορίζεται για ένα περιορισμένο σύνολο επαληθευμένων οργανισμών που είναι εξουσιοδοτημένοι να δοκιμάζουν οι ίδιοι τα συστήματα ασφαλείας AI.

Οι οργανισμοί και οι μεμονωμένες ομάδες ασφαλείας υποβάλλουν αίτηση για το επίπεδο που ταιριάζει με την εργασία τους και η Anthropic εξετάζει κάθε εφαρμογή πριν χορηγήσει πρόσβαση. Η εταιρεία είπε ότι και οι τρεις βαθμίδες περιλαμβάνουν πρόσβαση στα τρέχοντα κορυφαία μοντέλα της, καθώς και στα νέα μοντέλα που θα κυκλοφορήσουν στο μέλλον.

Διασφαλίσεις Ακόμα Δάγκωμα — Επιλεκτικά

Η Anthropic συνδύασε την ανακοίνωση με δεδομένα αξιολόγησης που προορίζονται να δείξουν ότι το σύστημα βαθμίδων διαχωρίζει την καλοήθη αμυντική εργασία από την πραγματικά επικίνδυνη ικανότητα. Σε μια αξιολόγηση CyScenarioBench για το Claude Opus 5.5, η εταιρεία ανέφερε ότι οι διασφαλίσεις απέκλεισαν 46 από τις 50 εργασίες στο επίπεδο Defense Access. Στο επίπεδο Red Team Access στο ίδιο μοντέλο, καμία από τις εργασίες δεν μπλοκαρίστηκε και το μοντέλο ολοκλήρωσε 34 από 50 — το ίδιο ποσοστό ολοκλήρωσης που καταγράφηκε όταν δεν εφαρμόστηκαν καθόλου διασφαλίσεις.

Αντίθετα, χωρίς πρόσβαση CVP, κάθε εργασία αποκλείστηκε με την πρώτη προτροπή, σύμφωνα με το Anthropic.

«Αυτές οι αξιολογήσεις μας δίνουν τη σιγουριά ότι μπορούμε να διαθέσουμε προηγμένες δυνατότητες στον κυβερνοχώρο με ασφάλεια σε ένα ευρύτερο σύνολο υπερασπιστών, επεκτείνοντας τις αμυντικές προσπάθειες που ξεκινήσαμε με το Project Glasswing», ανέφερε η εταιρεία στην ανακοίνωσή της, η οποία αναφέρθηκε ευρέως από το The Hacker News, το Reuters και το SecurityWeek.

Ο σχεδιασμός αντικατοπτρίζει ένα στοίχημα ότι οι περισσότερες εργασίες αμυντικής ασφάλειας - επιδιόρθωση, ανάλυση αρχείων καταγραφής, διαλογή κακόβουλου λογισμικού - μπορούν να προχωρήσουν κάτω από αυστηρά προστατευτικά κιγκλιδώματα, ενώ οι νόμιμες επιθετικές δοκιμές χρειάζονται έναν ευρύτερο διάδρομο. Αντικατοπτρίζει επίσης τον τρόπο με τον οποίο η βιομηχανία ασφάλειας χειρίζεται εδώ και πολύ καιρό τα εργαλεία διπλής χρήσης: ελέγξτε τον επαγγελματία, όχι μόνο το εργαλείο.

Το διευρυνόμενο αποτύπωμα του Glasswing

Η επέκταση του προγράμματος είναι στενά συνδεδεμένη με το Project Glasswing, την πρωτοβουλία της Anthropic να εφαρμόσει τα μοντέλα της στη σκλήρυνση κρίσιμου λογισμικού. Η εταιρεία είπε ότι η Glasswing αποκάλυψε τουλάχιστον 129.000 επαληθευμένες ευπάθειες λογισμικού μεταξύ Απριλίου και Ιουλίου 2026 και επιπλέον 5.500 επαληθευμένες ευπάθειες μεταξύ Απριλίου και Οκτωβρίου μέσω προσπαθειών σάρωσης ανοιχτού κώδικα.

Από τα επαληθευμένα τρωτά σημεία, περισσότερα από 33.000 έχουν μέχρι στιγμής αξιολογηθεί ως κρίσιμα ή υψηλής σοβαρότητας - ένας αριθμός που η Anthropic περιγράφει ως πιθανό μια σημαντική υπομέτρηση, καθώς βασίζεται σε δεδομένα έρευνας μόνο από ένα υποσύνολο συνεργατών της Glasswing. Η εταιρεία εκτιμά ότι ο πραγματικός αντίκτυπος θα μπορούσε να είναι τουλάχιστον πέντε φορές υψηλότερος.

Μια μετρημένη άποψη της ανακάλυψης ευπάθειας που βασίζεται σε AI

Ανεξάρτητη ανάλυση υποδηλώνει ότι η πλημμύρα ελαττωμάτων που εντοπίστηκαν από την τεχνητή νοημοσύνη δεν μεταφράζεται άμεσα σε ένα αντίστοιχο κύμα παραβιάσεων που εκμεταλλεύονται. Σε μια ανάλυση που δημοσιεύθηκε στα τέλη του περασμένου μήνα, ο ερευνητής του VulnCheck, Patrick Garrity, διαπίστωσε ότι μόνο 2 από τα 300 τρωτά σημεία που ανακαλύφθηκαν από την Anthropic ή το Project Glasswing - περίπου το 0,67 τοις εκατό - έχουν γίνει αντικείμενο εκμετάλλευσης στη φύση.

Τα δύο ελαττώματα που χρησιμοποιήθηκαν είναι το CVE-2026-26980, μια ευπάθεια SQL injection στο Ghost CMS και το CVE-2026-61500, ένα ελάττωμα πλαστογραφίας περιόδου λειτουργίας στον διακομιστή αρχείων Rejetto HTTP. Τα δεδομένα υποστηρίζουν μια απόχρωση που έχουν τονίσει οι ερευνητές ασφαλείας: η τεχνητή νοημοσύνη μειώνει το εμπόδιο στην ανακάλυψη τρωτών σημείων, αλλά τα περισσότερα από τα ελαττώματα που εμφανίζει δεν ήταν ποτέ στα ραντάρ των επιτιθέμενων.

Η ανακοίνωση προσγειώνεται επίσης εν μέσω ευρύτερης συζήτησης σχετικά με το έργο ασφάλειας που δημιουργείται από την τεχνητή νοημοσύνη. Έρευνα από το 1Password και το Veracode έδειξε ότι οι ενημερώσεις κώδικα ευπάθειας που έχουν γραφτεί με τεχνητή νοημοσύνη μπορούν από μόνες τους να εισάγουν νέα ελαττώματα, υπογραμμίζοντας ότι ο αυτοματισμός βοηθά αλλά δεν αντικαθιστά την ανθρώπινη επαλήθευση.

Τι σημαίνει για τον κλάδο της ασφάλειας

Για τις ομάδες ασφαλείας, το CVP μειώνει την ενέργεια ενεργοποίησης για τη χρήση μοντέλων συνόρων σε πραγματική αμυντική εργασία. Οι υπεύθυνοι αντιμετώπισης περιστατικών αποκτούν μια εγκεκριμένη διαδρομή για βοήθεια για την ανάλυση κακόβουλου λογισμικού. οι ελεγκτές διείσδυσης αποκτούν ένα ελεγχόμενο περιβάλλον για επιθέσεις που υποστηρίζονται από AI. και το μικρό σύνολο οργανισμών που ελέγχουν οι ίδιοι τα συστήματα ασφαλείας AI λαμβάνουν τη λιγότερο περιορισμένη πρόσβαση.

Για την Anthropic, το πρόγραμμα είναι τόσο στρατηγική ασφάλειας όσο και εμπορική. Πραγματοποιεί τη θέση της εταιρείας ότι οι ισχυρές δυνατότητες στον κυβερνοχώρο πρέπει να απελευθερώνονται σκόπιμα, σε ελεγμένους υπερασπιστές, αντί να κατασταλεί πλήρως - μια αντίθεση με τους αντιπάλους που έχουν αντιμετωπίσει τον έλεγχο μοντέλων με ασθενέστερους ελέγχους στον κυβερνοχώρο. Επίσης, εμβαθύνει τις σχέσεις της Anthropic με τις επιχειρήσεις που είναι πιο πιθανό να πληρώσουν για την πρόσβαση στα σύνορα μοντέλα: κυβερνήσεις, φορείς εκμετάλλευσης υποδομών ζωτικής σημασίας και μεγάλους προμηθευτές ασφάλειας.

Η εταιρεία δεν ανακοίνωσε αλλαγές στις τιμές που συνδέονται με το πρόγραμμα και οι αιτήσεις υποβάλλονται σε επεξεργασία μέσω των υπαρχόντων καναλιών ελεγμένης πρόσβασης της Anthropic. Δεδομένης της κλίμακας όσων έχει ήδη εμφανιστεί η Glasswing - και της παραδοχής της ίδιας της εταιρείας ότι οι αριθμοί πιθανότατα υποτιμούν την πραγματικότητα - η βιομηχανία ασφάλειας θα παρακολουθεί πόσα από αυτά τα 129.000 ευρήματα θα διορθωθούν πριν τα βρουν πρώτα οι επιτιθέμενοι.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →