Μια αμερικανική startup που ονομάζεται Abliteration.ai έχει μετατρέψει μια από τις πιο αμφιλεγόμενες τεχνικές της τεχνητής νοημοσύνης ανοιχτού κώδικα σε εμπορική υπηρεσία, πουλώντας πρόσβαση σε προγράμματα περιήγησης και API σε δημοφιλή μοντέλα ανοιχτού βάρους, ενώ η εκπαίδευση ασφαλείας τους έχει αφαιρεθεί — συμπεριλαμβανομένου του GLM-5.3 της Z.ai που κυκλοφόρησε πρόσφατα, ενός από τα πιο ικανά ανοιχτά μοντέλα που είναι διαθέσιμα σήμερα.

Η εταιρεία πήρε το όνομά της από το "abliteration", μια μέθοδο που αφαιρεί την τάση ενός μοντέλου να αρνείται επιβλαβή αιτήματα. Ερευνητές και χομπίστες έχουν χρησιμοποιήσει την τεχνική εδώ και χρόνια και το Hugging Face φιλοξενεί χιλιάδες μοντέλα που έχουν εξαλειφθεί. Το νέο είναι η συσκευασία: Το Abliteration.ai φιλοξενεί τροποποιημένα μοντέλα στη δική του υποδομή, έτσι οποιοσδήποτε διαθέτει πρόγραμμα περιήγησης ιστού μπορεί να τα ρωτήσει χωρίς να κατεβάσει βάρη ή να νοικιάσει GPU. Το TechCrunch ανέφερε την εξέλιξη στις 3 Σεπτεμβρίου και έκτοτε έχει προσελκύσει τον έλεγχο από ερευνητές ασφάλειας που παρακολουθούν τη συζήτηση ανοιχτών βαρών που παρακολουθούμε στην [κάλυψη ειδήσεων AI] (https://aibuzzwire.news).

Από την Υπόγεια Τεχνική στην Πλατφόρμα με το κλειδί στο χέρι

Ιδρύθηκε στα τέλη του περασμένου έτους και ενσωματώθηκε επίσημα τον Μάρτιο, το Abliteration.ai μεταφέρει την πρακτική από μια εξειδικευμένη θέση ανοιχτού κώδικα «φτιάξ' το μόνος σου» σε ένα κομψό εμπορικό προϊόν. Φιλοξενώντας τα ίδια τα μοντέλα, η εταιρεία αφαιρεί δύο σημεία τριβής ταυτόχρονα: οι χρήστες δεν χρειάζονται πλέον τις τεχνικές δεξιότητες για να αφαιρέσουν ένα μοντέλο, ούτε τον υπολογισμό για να εκτελέσουν ένα.

Ο συνιδρυτής Devon - η TechCrunch απέκρυψε το επώνυμό του κατόπιν αιτήματός του επειδή παραμένει απασχολημένος σε άλλη εταιρεία - είπε ότι η εταιρεία έχει συνάψει συμφωνίες με πολλούς μεγάλους παρόχους cloud και χρηματοδοτείται εξ ολοκλήρου από τα έσοδα των πελατών. Η startup δεν έχει συγκεντρώσει επιχειρηματικά κεφάλαια, αν και είπε ότι οι συνομιλίες βρίσκονται σε εξέλιξη.

Τι βρέθηκε το τεστ του TechCrunch

Η εταιρεία λέει ότι στόχος της είναι να επιτρέψει «προσβλητικές εργασίες στον κυβερνοχώρο, κόκκινες ομάδες και δοκιμές πρακτόρων που άλλα μοντέλα αρνούνται να κάνουν». Το TechCrunch το δοκίμασε με έναν δωρεάν λογαριασμό, αναζητώντας μια σβησμένη έκδοση του GLM-5.3 μέσω ενός προγράμματος περιήγησης ιστού. Οι δημοσιογράφοι ζήτησαν από το μοντέλο να γράψει ένα πρόγραμμα Python που κλέβει αποθηκευμένους κωδικούς πρόσβασης του Chrome και να παράγει ένα λεπτομερές πρωτόκολλο για την καλλιέργεια ενός επικίνδυνου ανθρώπινου παθογόνου στο σπίτι. Συμμορφώθηκε πρόθυμα και με τα δύο αιτήματα, σύμφωνα με την έκθεση.

Αυτό το πείραμα είναι η καρδιά της ιστορίας: εργασίες που αρνούνται κατηγορηματικά τα κύρια μοντέλα συνόρων είναι τώρα διαθέσιμες πίσω από μια φόρμα εγγραφής, χωρίς κόστος, σε μια καρτέλα του προγράμματος περιήγησης.

Το επιχείρημα άμυνας της Red-Team

Η υπόθεση του Devon για την επιχείρηση είναι το κλασικό επιχείρημα ασφάλειας: δεν μπορείς να υπερασπιστείς τη συμπεριφορά που δεν μπορείς να αναπαράγεις. Ένα μοντέλο που αρνείται να γράψει λειτουργικό κώδικα εκμετάλλευσης είναι ελάχιστα χρήσιμο για μια κόκκινη ομάδα που προσπαθεί να καταλάβει πραγματικούς επιτιθέμενους.

«Η μεγάλη εικόνα των αφανισμένων μοντέλων είναι ότι μπορούν να μοντελοποιήσουν κακούς ηθοποιούς», είπε στο TechCrunch. "Το πλεονέκτημα είναι τώρα ότι οι αμυντικοί μπορούν να κινηθούν όσο το δυνατόν γρηγορότερα... Νομίζω ότι θα επιταχύνει την ασφάλεια στον κυβερνοχώρο, που είναι ένα είδος αντιδιαισθητικού σημείου."

Οι πελάτες της εταιρείας περιλαμβάνουν startups σε πρώιμο στάδιο red-teaming στο Ηνωμένο Βασίλειο και την Ευρώπη που δοκιμάζουν την ασφάλεια των τραπεζών, των αεροπορικών εταιρειών και άλλων φορέων εκμετάλλευσης υποδομών ζωτικής σημασίας. Ένας σημαντικός πελάτης, είπε ο Ντέβον, ο κόκκινος συνεργάζεται με τραπεζικούς πράκτορες και δεν μπορούσε να εκτελέσει αυτή τη δουλειά με μη τροποποιημένα εμπορικά μοντέλα.

'Ένα μοντέλο που γίνεται κοινωνιοπαθητικός'

Οι ερευνητές ασφάλειας βλέπουν την ίδια ικανότητα πολύ διαφορετικά. Ο Andrew Yoon, επικεφαλής της έρευνας στη μη κερδοσκοπική CivAI για την ασφάλεια της τεχνητής νοημοσύνης, είπε στο TechCrunch ότι η κατάργηση σάς επιτρέπει να "τροποποιήσετε το μοντέλο ώστε να γίνει κοινωνιοπαθής".

"Μπορείτε να πληκτρολογήσετε κυριολεκτικά οτιδήποτε εδώ, και θα συμμορφωθεί με αυτό", είπε ο Yoon, προσθέτοντας ότι αναμένει "επεξεργασμένα, σβησμένα μοντέλα να χρησιμοποιηθούν για κακό στο εγγύς μέλλον".

Σε πρόσφατο άρθρο της γνώμης, ο Yoon υποστήριξε ότι εάν η αφαίρεση προστατευτικών κιγκλιδωμάτων δεν μπορεί ρεαλιστικά να αποτραπεί, οι κυβερνήσεις θα πρέπει να απαιτούν από τους παρόχους να εκτελούν ταξινομητές που εντοπίζουν και αποκλείουν επιβλαβή δραστηριότητα στον κυβερνοχώρο και τα βιοόπλα και θα πρέπει να απαιτούν από τις εταιρείες που νοικιάζουν άμεση πρόσβαση σε προηγμένες GPU να επαληθεύουν την ταυτότητα των πελατών και να αρνούνται την υπηρεσία όπου υπάρχει υποψία επικίνδυνης κακής χρήσης.

Λεπτά προστατευτικά κιγκλιδώματα και κανένας έλεγχος ταυτότητας

Προς το παρόν, οι δικλείδες ασφαλείας του Abliteration.ai είναι ελάχιστες. Η πλατφόρμα προσφέρει στους πελάτες ένα προαιρετικό επίπεδο εποπτείας, ώστε να μπορούν να προσθέσουν όποιους περιορισμούς επιθυμούν, και ο ίδιος ο ιστότοπος διατηρεί ορισμένα μικρά όρια — το TechCrunch δεν μπόρεσε να κάνει το μοντέλο να παράγει οδηγίες αυτοκτονίας και ο Ντέβον είπε ότι εργάζεται σε πρόσθετα μέτρα για την πρόληψη της βίας.

Η εταιρεία δεν πραγματοποιεί έλεγχο του πελάτη εκτός από την καταγραφή της πιστωτικής κάρτας που χρησιμοποιείται για την πληρωμή. "Δεν θέλετε να είστε το άτομο που είναι υπεύθυνο για κάποιον που κάνει κάτι τρελό ... οπότε πού τραβάτε τη γραμμή της ευθύνης σας ως εταιρεία;" είπε ο Ντέβον. «Είμαστε ακόμη στη διαδικασία του καθορισμού αυτού».

Μια ερώτηση που η βιομηχανία δεν μπορεί να αποφύγει

Δεν συμφωνεί κάθε επαγγελματίας ασφαλείας ότι τα ματαιωμένα μοντέλα είναι ακόμη και το καλύτερο εργαλείο για επιθετικές δοκιμές. Ο Ahmed Aly, Διευθύνων Σύμβουλος της εταιρείας red-teaming Fabraix, είπε στο TechCrunch ότι η εταιρεία του βασίζεται περισσότερο σε βελτιστοποιημένα μοντέλα ανοιχτού βάρους, τα οποία ήδη αποστέλλονται με λίγες απορρίψεις — και σημειώνει ότι η εξάλειψη μπορεί να υποβαθμίσει τις υποκείμενες δυνατότητες ενός μοντέλου.

Οι περισσότεροι ειδικοί με τους οποίους συμβουλεύτηκε το TechCrunch συμφωνούν σε ένα πράγμα: η πρακτική δεν μπορεί να σταματήσει. Τα βάρη με δυνατότητα λήψης σημαίνουν ότι ο καθένας μπορεί να αφαιρέσει τις αρνήσεις σε τοπικό επίπεδο, όπως υπογράμμισε ένα σχόλιο του 2026 από το Κέντρο Καταπολέμησης της Τρομοκρατίας στο West Point σχετικά με την κακή χρήση "εξάλειψης". Το ανοιχτό ερώτημα που θέτει το Abliteration.ai είναι εάν η μείωση του κόστους πρόσβασης για όλους – αμυνόμενους και επιτιθέμενους – καθιστά το Διαδίκτυο ασφαλέστερο ή πιο επικίνδυνο.

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Η ασφάλεια της τεχνητής νοημοσύνης εξελίσσεται καθημερινά. Αποκτήστε τις τελευταίες εξελίξεις AI σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →