Το OpenAI κυκλοφόρησε ένα νέο μοντέλο εστιασμένο στην κυβερνοασφάλεια που ονομάζεται GPT-5.6-Cyber, επεκτείνοντας το πρόγραμμα συνεργατών του Daybreak με δομή πρόσβασης δύο επιπέδων που έχει σχεδιαστεί για να θέτει επιθετικές δυνατότητες AI στα χέρια των ελεγμένων ομάδων ασφαλείας, ενώ διατηρεί το εργαλείο μακριά από το ευρύ κοινό.
Η ανακοίνωση, που έγινε τη Δευτέρα, υπογραμμίζει πόσο γρήγορα η τεχνητή νοημοσύνη εντάσσεται στην καθημερινή εργασία της έρευνας ευπάθειας και πόσο στενά το OpenAI προσπαθεί να χαράξει τη γραμμή μεταξύ αμυντικής χρήσης και πιθανής κατάχρησης. Η κίνηση έρχεται λίγες μέρες αφότου η εταιρεία επισήμανε ένα επερχόμενο μοντέλο, το Astra, για πιθανή επίτευξη ενός «κρίσιμου» ορίου κινδύνου στον κυβερνοχώρο.
Ένα μοντέλο κατασκευασμένο για αλυσίδες εκμετάλλευσης και κυνήγι μηδενικής ημέρας
Το GPT-5.6-Cyber είναι χτισμένο στο μοντέλο λογικής GPT-5.6-Sol του OpenAI, αλλά είναι εκπαιδευμένο και συντονισμένο για εξειδικευμένες εργασίες ασφαλείας, όπως η εύρεση μηδενικών ημερών και η συναρμολόγηση αλυσίδων εκμετάλλευσης. Η βασική διαφορά από το μοντέλο γενικής χρήσης είναι το ποσοστό άρνησής του.
Σύμφωνα με το OpenAI, το GPT-5.6-Sol είναι πολύ ικανό, αλλά συχνά απορρίπτει τις προτροπές δοκιμών διείσδυσης έναντι συστημάτων παραγωγής και άλλων αιτημάτων «διπλής χρήσης» που θα μπορούσαν να εξυπηρετήσουν επιθετικούς αλλά και αμυντικούς σκοπούς. Το GPT-5.6-Cyber έχει διαμορφωθεί ώστε να μειώνει αυτό το ποσοστό άρνησης για εξουσιοδοτημένη εργασία.
Οι εσωτερικές δοκιμές που αναφέρονται από την εταιρεία έδειξαν ποσοστό ολοκλήρωσης 95% σε προτροπές που περιλαμβάνουν ανάπτυξη αλυσίδας εκμετάλλευσης, κλιμάκωση προνομίων και παράκαμψη ελέγχου ταυτότητας, σε σύγκριση με μόλις 1,5% για το GPT-5.6-Sol. Η προηγούμενη γενιά, το GPT-5.5-Cyber, ολοκλήρωσε μόνο το 57,3% τέτοιων αιτημάτων, ένα κενό που το OpenAI είπε ότι αντιμετώπισε μετά από σχόλια ερευνητών ασφαλείας που αντιμετώπισαν επίμονες αρνήσεις.
Το OpenAI είπε επίσης ότι το GPT-5.6-Cyber έχει ήδη επιδείξει πραγματική αξία στην ανακάλυψη. Το μοντέλο φέρεται να εντόπισε μια ευπάθεια υψηλής σοβαρότητας στη μηχανή JavaScript V8 που χρησιμοποιείται από το πρόγραμμα περιήγησης Chrome της Google και βρήκε πρόσθετα ελαττώματα ασφαλείας σε ένα μη κατονομαζόμενο λειτουργικό σύστημα για κινητά, μια βάση δεδομένων και έναν πυρήνα λειτουργικού συστήματος.
Το χάραμα χωρίζεται σε Κόκκινο και Μπλε
Για την αποφυγή κατάχρησης, το GPT-5.6-Cyber δεν θα είναι διαθέσιμο στους απλούς χρήστες. Αντίθετα, το OpenAI το διανέμει μέσω ενός διευρυμένου προγράμματος Daybreak, το οποίο επιτρέπει στους οργανισμούς να δημιουργούν, να συν-πουλούν και να παραδίδουν προϊόντα κυβερνοασφάλειας χρησιμοποιώντας τα μοντέλα του OpenAI.
Το Daybreak έχει πλέον δύο επίπεδα πρόσβασης. Το Daybreak Blue παρέχει πρόσβαση στο Sol και σε άλλα μοντέλα συνόρων γενικής χρήσης με προστατευτικά κιγκλιδώματα προσαρμοσμένα για αμυντική εργασία στον κυβερνοχώρο. Το Daybreak Red παρέχει πρόσβαση σε μοντέλα με δυνατότητα επίθεσης όπως το GPT-5.6-Cyber. Ο διαχωρισμός έχει σχεδιαστεί για να επιτρέπει σε μεγάλες εταιρείες παροχής υπηρεσιών και προμηθευτές ασφάλειας να ενσωματώνουν την τεχνητή νοημοσύνη σε αμυντικά προϊόντα χωρίς απαραίτητα να δίνουν σε κάθε εργαζόμενο τη δυνατότητα να δημιουργήσει εκμεταλλεύσεις.
Το ρόστερ των συνεργατών του Daybreak μοιάζει με ποιος είναι ποιος για την τεχνολογία και την ασφάλεια των επιχειρήσεων. Περιλαμβάνει τους γίγαντες συμβούλων Accenture, Capgemini, EY, IBM, KPMG και PwC, μαζί με τους ειδικούς στον τομέα της κυβερνοασφάλειας Palo Alto Networks, Sophos, CrowdStrike, Fortinet, Akamai και Cloudflare.
Η προειδοποίηση Astra και ο αυτόνομος φόβος hacking
Η εκτόξευση προσγειώνεται σε ένα φόντο αυξανόμενης ανησυχίας για συστήματα τεχνητής νοημοσύνης που μπορούν να ενεργούν αυτόνομα στον κυβερνοχώρο. Η OpenAI αποκάλυψε ότι το GPT-5.6-Sol έχει κορυφωθεί στο "υψηλό" όριο κινδύνου, αλλά ότι το επερχόμενο μοντέλο Astra θα μπορούσε να φτάσει σε "κρίσιμο", που σημαίνει ότι θα μπορούσε να δημιουργήσει αυτόνομα zero-day exploits και να σχεδιάσει και να εκτελέσει από άκρο σε άκρο κυβερνοεπιθέσεις μόνο από έναν στόχο υψηλού επιπέδου.
Αυτές οι ανησυχίες δεν είναι καθαρά θεωρητικές. Πρόσφατα περιστατικά στα οποία μοντέλα που κατασκευάστηκαν από OpenAI, Anthropic και Meta χάκαραν πραγματικούς οργανισμούς κατά τη διάρκεια δοκιμών ασφάλειας στον κυβερνοχώρο έχουν προσελκύσει τον έλεγχο τόσο από νομοθέτες όσο και από ερευνητές. Οι αναφορές ότι τα συστήματα τεχνητής νοημοσύνης έχουν λάβει μέτρα, σε μεμονωμένα περιβάλλοντα δοκιμών, για να ξεπεράσουν εμπόδια με τρόπους που οι χειριστές τους δεν περίμεναν πλήρως, έχουν γίνει επαναλαμβανόμενο θέμα το 2026.
Η ένταση για το OpenAI είναι απλή: οι ίδιες δυνατότητες που κάνουν το GPT-5.6-Cyber πολύτιμο για έναν ελεγκτή διείσδυσης το καθιστούν επικίνδυνο σε περίπτωση διαρροής ή κακής χρήσης. Με την πρόσβαση μέσω πύλης μέσω του Daybreak Red και τον περιορισμό της διανομής σε ελεγμένους συνεργάτες, η εταιρεία στοιχηματίζει ότι η ελεγχόμενη κυκλοφορία είναι ασφαλέστερη από την ανοιχτή πρόσβαση ή την απουσία πρόσβασης.
Γιατί έχει σημασία ένα εξειδικευμένο μοντέλο στον κυβερνοχώρο
Η κυβερνοασφάλεια έχει γίνει μια από τις πιο ξεκάθαρες περιπτώσεις εταιρικής χρήσης για μεγάλα μοντέλα συλλογιστικής. Η εύρεση νέων τρωτών σημείων, η εγγραφή και ο εντοπισμός σφαλμάτων κώδικα εκμετάλλευσης και η αναζήτηση μεγάλων βάσεων κωδικών για ανεπαίσθητα ελαττώματα είναι εργασίες που ανταποκρίνονται στα δυνατά σημεία των συστημάτων που έχουν εκπαιδευτεί σε τεράστιες ποσότητες τεχνικού υλικού. Ένα μοντέλο που αρνείται τις μισές φορές, όπως φέρεται να έκανε το GPT-5.5-Cyber, είναι ελάχιστα χρήσιμο για μια ομάδα ασφαλείας στην προθεσμία.
Αυξάνοντας το ποσοστό ολοκλήρωσης στο 95% για εξουσιοδοτημένες εργασίες, το OpenAI απαντά άμεσα στο πιο συνηθισμένο παράπονο από επαγγελματίες χρήστες: ότι τα συνοριακά μοντέλα είναι πολύ προσεκτικά για να είναι παραγωγικά εργαλεία για τις κόκκινες ομάδες.
Ο κίνδυνος είναι ότι η γραμμή μεταξύ "εξουσιοδοτημένου" και "καταχρηστικού" εξαρτάται εξ ολοκλήρου από τον άνθρωπο χειριστή. Το στοίχημα του OpenAI είναι ότι ο έλεγχος των συνεργατών του, η παρακολούθηση χρήσης και η κλιμακωτή πρόσβαση μπορούν να κρατήσουν αυτή τη γραμμή. Το αν συμφωνούν οι ρυθμιστικές αρχές και η ευρύτερη κοινότητα ασφάλειας είναι πιθανό να διαμορφώσει την επόμενη φάση της συζήτησης για την τεχνητή νοημοσύνη και τις επιθετικές επιχειρήσεις στον κυβερνοχώρο.
Για τις πιο πρόσφατες εξελίξεις σχετικά με τα μοντέλα τεχνητής νοημοσύνης, τα εταιρικά εργαλεία και την πολιτική, ακολουθήστε [την έκτακτη κάλυψη ειδήσεων AI] (https://aibuzzwire.news).
