Η Nvidia ανακοίνωσε τη Δευτέρα την Open Agent Safety Platform, μια ανοιχτή πλατφόρμα λογισμικού και σχεδιασμό συστήματος αναφοράς που η εταιρεία λέει ότι θα δώσει στους οργανισμούς αναγκαστικό έλεγχο σε αυτόνομους πράκτορες AI από τη δοκιμή έως την ανάπτυξη. Η εκτόξευση καλύπτει ολόκληρη τη στοίβα πρακτόρων: το λογισμικό που εκτελεί τους πράκτορες, τα επίπεδα υλικού και υπολογισμού που τους τροφοδοτούν και τα συστήματα ρομποτικής που εκτελούν τις οδηγίες τους στον φυσικό κόσμο.

Η ανακοίνωση φτάνει σε μια δύσκολη στιγμή για τον κλάδο. Τις τελευταίες εβδομάδες πολλά συνοριακά εργαστήρια ανέφεραν εκδόσεις της ίδιας ιστορίας — πράκτορες τεχνητής νοημοσύνης ξέσπασαν από τα περιβάλλοντα αξιολόγησης που προορίζονταν να τα περιορίσουν και έφτασαν σε συστήματα στα οποία δεν έπρεπε ποτέ να έχουν πρόσβαση και σε ορισμένες περιπτώσεις ανέφεραν λάθος τι είχαν κάνει. Για τους αναγνώστες που παρακολουθούν την κάλυψη της βιομηχανίας AI, η κίνηση της Nvidia σηματοδοτεί την πρώτη απάντηση επιβολής πλήρους στοίβας από έναν μεγάλο κατασκευαστή chip, και έχει ήδη προσελκύσει περισσότερους από 100 συνεργαζόμενους οργανισμούς.

Τι κάνει στην πραγματικότητα η πλατφόρμα

Ο σχεδιασμός αναφοράς συνδυάζει δύο στοιχεία. Το πρώτο, το OpenShell, είναι ένας ασφαλής χρόνος εκτέλεσης ανοιχτού κώδικα — που κυκλοφορεί με την άδεια Apache 2.0 — που εκτελεί αυτόνομους πράκτορες σε περιβάλλοντα sandbox με απομόνωση σε επίπεδο πυρήνα. Οι χειριστές ορίζουν σε ποια αρχεία, δίκτυα, εργαλεία, διεργασίες και διαπιστευτήρια μπορεί να έχει πρόσβαση ένας πράκτορας και το OpenShell ελέγχει αυτά τα όρια πριν εκτελεστεί ο πράκτορας και τα επιβάλλει συνεχώς καθώς λειτουργεί. Η Nvidia λέει ότι το OpenShell προσθέτει ελάχιστη επιβάρυνση στη Vera CPU της, την οποία η εταιρεία περιγράφει ως τον πρώτο επεξεργαστή που έχει κατασκευαστεί ειδικά για agent AI, και ότι το λογισμικό μπορεί να επεκταθεί σε πλατφόρμες τρίτων από την Arm και την Intel.

Το δεύτερο συστατικό, το Sentry, απομακρύνει την επιβολή εντελώς από την εμβέλεια του πράκτορα. Λειτουργεί ως φύλακας εκτός ζώνης στις μονάδες επεξεργασίας δεδομένων BlueField-4 της Nvidia, παρακολουθώντας τη συμπεριφορά των πρακτόρων από έναν απομονωμένο τομέα εμπιστοσύνης που η εταιρεία λέει ότι είναι αόρατος τόσο σε πράκτορες όσο και σε εισβολείς. Εάν ένας πράκτορας επιχειρήσει να μετακινηθεί εκτός των ορίων λογισμικού του, ο Sentry θέτει σε καραντίνα και τον σταματά σε χιλιοστά του δευτερολέπτου. Το Sentry βασίζεται στο πλαίσιο λογισμικού DOCA της Nvidia, το οποίο επιθεωρεί αιτήματα και απαντήσεις πρακτόρων, επαληθεύει την ταυτότητα πρακτόρων και επιβάλλει πολιτικές πρόσβασης μηδενικής εμπιστοσύνης για δεδομένα, εργαλεία, API και υπηρεσίες.

"Η ασφάλεια και η ασφάλεια απαιτούν πλήρη στοίβα μηχανική"

Ο ιδρυτής και διευθύνων σύμβουλος της Nvidia, Jensen Huang, πλαισίωσε την κυκλοφορία ως απάντηση στη συζήτηση για την ασφάλεια που καταναλώνει τώρα τη βιομηχανία. «Οι εκπληκτικές δυνατότητες της τεχνητής νοημοσύνης για την κοινωνία θα πραγματοποιηθούν μόνο εάν λύσουμε την ασφάλεια της τεχνητής νοημοσύνης», είπε ο Χουάνγκ στην ανακοίνωση. "Καθώς συνεχίζουμε να ανακαλύπτουμε τα όρια των δυνατοτήτων τεχνητής νοημοσύνης, πρέπει να επιταχύνουμε την ανακάλυψη στα σύνορα της ασφάλειας της τεχνητής νοημοσύνης. Η ασφάλεια και η ασφάλεια απαιτούν πλήρη στοίβα μηχανική."

Στο δικό της τεχνικό blog, η Nvidia ήταν ωμή σχετικά με το μοτίβο πίσω από τα πρόσφατα περιστατικά: δεν ήταν μια νέα δυνατότητα που επέτρεπε στους πράκτορες να διαφύγουν, αλλά "ένας συνδυασμός εργαλείων, χρόνου και διφορούμενων οδηγιών". Η εταιρεία έκανε μια αναλογία με τον πρώιμο ιστό, υποστηρίζοντας ότι το διαδίκτυο έγινε ασφαλές όχι επειδή οι ιστότοποι υποσχέθηκαν να συμπεριφέρονται αλλά επειδή τα προγράμματα περιήγησης σταμάτησαν να εμπιστεύονται τον κώδικα στις ιστοσελίδες και απομόνωσαν κάθε σελίδα στο δικό της sandbox. "Η ασφάλεια των πρακτόρων απαιτεί ανεξάρτητους ελέγχους ασφαλείας", ανέφερε η ανάρτηση.

Η βιομηχανία συνενώνεται γύρω από την επιβολή

Η λίστα εταίρων θεωρείται ως τομή της οικονομίας της τεχνητής νοημοσύνης. Η Anthropic έχει συνεργαστεί με τη Nvidia, έτσι ώστε οι επιχειρήσεις να μπορούν να επιβάλλουν τον έλεγχο των Claude Managed Agents μέσω ενσωματώσεων OpenShell και BlueField. «Οι εταιρείες δίνουν στους πράκτορες τεχνητής νοημοσύνης περισσότερο από το πιο σημαντικό έργο τους και πρέπει να κατευθύνουν και να επαληθεύσουν τι κάνουν αυτοί οι πράκτορες, ειδικά σε ευαίσθητα περιβάλλοντα», δήλωσε ο Paul Smith, επικεφαλής εμπορικός διευθυντής της Anthropic.

Η SpaceXAI χρησιμοποιεί την πλατφόρμα για τους πράκτορες κωδικοποίησης Cursor και τα μοντέλα Grok, με τον πρόεδρο Mike Nicolls να υποστηρίζει ότι "η ασφάλεια θα πρέπει να επιβάλλεται εκτός του μοντέλου με πρόσθετους ελέγχους που δεν μπορεί να ξεπεράσει ο πράκτορας". Η Scale AI ενσωματώνει το σχέδιο αναφοράς στο επίπεδο υποδομής του χαρτοφυλακίου GenAI για εταιρικούς και κυβερνητικούς πελάτες, σύμφωνα με τον CEO Francis deSouza.

Η Salesforce έχει ενσωματώσει το OpenShell με το Slack, ώστε οι ομάδες να μπορούν να βλέπουν τη δραστηριότητα των πρακτόρων και να εγκρίνουν ή να απορρίπτουν αιτήματα άδειας απευθείας από τη συνομιλία. Η SAP ενσωματώνει το OpenShell με τον χρόνο εκτέλεσης του Joule Studio και συνεισφέρει σε μηχανολογικό έργο. Πέρα από τα ονόματα των επικεφαλίδων, η Nvidia απαριθμεί τους CrowdStrike, Cisco, IBM, Microsoft, Palantir, Palo Alto Networks, Hugging Face, Perplexity, Cognition, Accenture, Deloitte και EY μεταξύ περισσότερων από 100 οργανισμών που εργάζονται με τις τεχνολογίες της πλατφόρμας, μαζί με τις εταιρείες ρομποτικής Figure και Gecki, χρηματοοικονομικές εταιρείες Figure και Geck. JPMorganChase.

Το έργο τροφοδοτεί επίσης το Open Secure AI Alliance, μια προσπάθεια που ξεκίνησε από τη Nvidia μαζί με περισσότερους από 120 οργανισμούς και διοικείται από το Linux Foundation, το οποίο εκτελεί ένα κοινό έργο που ονομάζεται SAFE - το Shared AI Findings Exchange - για τη συγκέντρωση ευρημάτων ασφάλειας σε ολόκληρο τον κλάδο.

Γιατί η επιβολή υλικού έχει σημασία τώρα

Το κεντρικό στοίχημα της πλατφόρμας είναι ότι οι έλεγχοι επιπέδου εφαρμογής δεν επαρκούν πλέον. Η ανακοίνωση της Nvidia σημείωσε ότι σε όλα τα πρόσφατα περιστατικά το μοτίβο ήταν το ίδιο: ο πράκτορας παρέκαμψε τους ελέγχους ασφαλείας στο επίπεδο εφαρμογής για να ολοκληρώσει την εργασία που του είχε ανατεθεί. Μεταφέροντας την παρακολούθηση σε πυρίτιο σε μια ξεχωριστή DPU - και σε έναν ξεχωριστό χρόνο εκτέλεσης απομονωμένο από τον πυρήνα - η εταιρεία υποστηρίζει ότι το όριο επιβολής πρέπει να βρίσκεται εκεί όπου ένας πράκτορας δεν μπορεί να το επεξεργαστεί, να απενεργοποιήσει ή να μιλήσει.

Το αν αυτό ισχύει στην πράξη θα εξαρτηθεί από την υιοθεσία. Το λογισμικό, συμπεριλαμβανομένου του OpenShell, είναι τώρα διαθέσιμο μέσω της σελίδας πόρων προγραμματιστών της Nvidia και του GitHub, και τα ψιλά γράμματα της εταιρείας προειδοποιούν ότι ορισμένες λειτουργίες που περιγράφονται παραμένουν σε διάφορα στάδια και θα προσφέρονται όταν είναι διαθέσιμες. Αλλά η κατεύθυνση είναι ξεκάθαρη: μετά από έναν μήνα κατά τον οποίο τα ξεσπάσματα των πρακτόρων κυριάρχησαν στη συζήτηση για την ασφάλεια, το στρώμα της υποδομής δεν περιμένει πλέον τα μοντέλα να αστυνομευτούν.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →