Μια εκτενής ανασκόπηση ασφαλείας από την Common Sense Media κατέληξε στο συμπέρασμα ότι η λειτουργία ChatGPT για εφήβους του OpenAI ενέχει "απαράδεκτο κίνδυνο" για χρήστες κάτω των 18 ετών - τη χειρότερη βαθμολογία της ομάδας παρακολούθησης - λιγότερο από δύο μήνες μετά την κυκλοφορία του προϊόντος με υποσχέσεις για ενσωματωμένη προστασία. Όπως ανέφερε το NPR, η ομάδα διαπίστωσε ότι οι περισσότερες από τις διαφημιζόμενες διασφαλίσεις του mode δεν λειτούργησαν όπως είχε υποσχεθεί στη δοκιμή του.

Τα ευρήματα προσγειώνονται σε μια ευαίσθητη στιγμή για το OpenAI, το οποίο κυκλοφόρησε το ChatGPT για εφήβους τον Αύγουστο ως μια αποκλειστική εμπειρία για ανήλικους χρήστες, πλήρης με γονικό έλεγχο και αυστηρότερα προστατευτικά κιγκλιδώματα. Η προηγούμενη κάλυψή μας τεκμηρίωσε ότι η βιομηχανία AI ωθεί και έλκει γύρω από την ασφάλεια των νέων. Η νέα έκθεση είναι ο πρώτος μεγάλος ανεξάρτητος έλεγχος για το εάν οι προστασίες του εφήβου λειτουργούν στην πράξη.

Τι δοκιμασμένα μέσα κοινής λογικής

Ερευνητές στο Youth AI Safety Institute της ομάδας δοκίμασαν περισσότερες από 4.000 προτροπές πριν και μετά την κυκλοφορία του teen mode, σύμφωνα με την κάλυψη του The National News Desk και της Fast Company του Sinclair Broadcast Group. Η ομάδα συνιστά να διακόψει το OpenAI το μάρκετινγκ της λειτουργίας εφήβων και να αποτρέψει τους εφήβους από τη χρήση του ChatGPT έως ότου η εταιρεία αναπτύξει αυτό που αποκαλεί «ασφαλή, αναπτυξιακά κατάλληλη εμπειρία».

"Ορισμένες από τις διαφημιζόμενες ασφάλειες του ChatGPT άντεξαν στις δοκιμές μας, συμπεριλαμβανομένης της άρνησής της για ρητή σεξουαλική αναπαραγωγή ρόλων", ανέφερε η κριτική προϊόντος του οργανισμού. "Αλλά όμως απέτυχαν — και μερικά επιδεινώθηκαν με τη νέα λειτουργία Teen. Ανησυχούμε ότι το ChatGPT για εφήβους θα μπορούσε να δώσει στους γονείς ψεύτικη εμπιστοσύνη στα προστατευτικά κιγκλιδώματα που συχνά δεν λειτουργούν."

Ειδοποιήσεις γονέων που δεν ενεργοποιήθηκαν

Το πιο εντυπωσιακό εύρημα της έκθεσης αφορούσε το σύστημα γονικής ειδοποίησης. Οι ερευνητές δημιούργησαν περισσότερους από δώδεκα λογαριασμούς που ανέφεραν μόνοι τους έναν έφηβο και συνδέονταν με έναν γονικό λογαριασμό και στη συνέχεια χρησιμοποίησαν το chatbot σε συνομιλίες που περιείχαν ρητές αναφορές σε αυτοκτονικές σκέψεις, αυτοτραυματισμό ή διαταραγμένη διατροφή. Οι λογαριασμοί χτίστηκαν σε φανταστικά πρόσωπα.

Σύμφωνα με την έκθεση, οι δοκιμαστές δεν έλαβαν γονικές ειδοποιήσεις από τους νέους λογαριασμούς που έκαναν αυτές τις αναφορές. Οι ειδοποιήσεις έφτασαν μόνο για άλλους λογαριασμούς που είχαν εβδομάδες ιστορικού συνομιλιών που κάλυπτε παρόμοια θέματα - ένα κενό που υποδηλώνει ότι το σύστημα ειδοποιήσεων εξαρτάται περισσότερο από το συσσωρευμένο πλαίσιο παρά από τη σοβαρότητα του τι αποκαλύπτει ένας έφηβος σε μια δεδομένη συνομιλία.

Η ανασκόπηση διαπίστωσε επίσης ότι το ChatGPT για εφήβους έχασε περισσότερες από μία στις τέσσερις περιπτώσεις που δικαιολογούσαν παραπομπή σε κρίση ψυχικής υγείας, όπως κρίθηκε από μια ομάδα αδειοδοτημένων επαγγελματιών παιδικής υγείας που εξέτασαν τα μηνύματα.

Προστατευτικά κιγκλιδώματα σχολικών εργασιών «Εύκολη παράκαμψη»

Πέρα από τον εντοπισμό κρίσεων, ο φύλακας διαπίστωσε ότι η δυνατότητα που αποσκοπούσε να εμποδίσει τους μαθητές να χρησιμοποιήσουν το chatbot για να εξαπατήσουν τις σχολικές εργασίες ήταν εύκολο να παρακαμφθεί ή να απενεργοποιηθεί εντελώς.

«Θα μπορούσατε να τους ζητήσετε να γράψουν μια εργασία για εσάς, μια περίπλοκη εργασία για εσάς και θα το έκανε αυτό, και θα σας έλεγε ακόμη και πώς να επεξεργαστείτε με τρόπο που ο δάσκαλός σας δεν θα ήξερε», είπε ο ιδρυτής και διευθύνων σύμβουλος της Common Sense Media, Jim Steyer, σε σχόλια που αναφέρει το The National News Desk. "Επομένως, παρεμβαίνει στη μάθηση. Παρεμβαίνει στη βασική διαδικασία και τα παιδιά πρέπει να κάνουν τη δουλειά μόνα τους."

Τα προστατευτικά κιγκλιδώματα περιεχομένου, η πρόβλεψη ηλικίας και οι υπενθυμίσεις διαλειμμάτων βρέθηκαν επίσης αναποτελεσματικά στις δοκιμές. Ένα σημείο δεδομένων που αναφέρεται ευρέως: Το OpenAI είπε ότι ο μέσος έφηβος χρήστης ξοδεύει λιγότερο από 15 λεπτά την ημέρα στο ChatGPT. Αλλά μεταξύ του μικρού μεριδίου των εφήβων που περνούν περισσότερες από τρεις συνεχόμενες ώρες την ημέρα - λιγότερο από το 2 τοις εκατό των χρηστών - σχεδόν οι μισοί τελείωσαν τη συνομιλία τους μέσα σε πέντε λεπτά από τη λήψη μιας υπενθύμισης διαλείμματος, υποδηλώνοντας ότι οι ωθήσεις σπάνια διέκοπταν εκτεταμένες συνεδρίες.

Το OpenAI επαναφέρει τη μεθοδολογία

Το OpenAI, σε μια δήλωση απαντώντας στην έκθεση, είπε ότι είναι «βαθιά αφοσιωμένο» στην ασφάλεια των εφήβων και επεσήμανε τις δικλείδες ασφαλείας που έχει δημιουργήσει και τα εργαλεία που παρέχει στους γονείς.

«Καλωσορίζουμε την αυστηρή ανεξάρτητη αξιολόγηση, αλλά δεν πιστεύουμε ότι οι δοκιμές του Common Sense Media αντικατοπτρίζουν με ακρίβεια τον τρόπο με τον οποίο λειτουργούν στην πράξη οι διασφαλίσεις για εφήβους του ChatGPT ή τις απόψεις των ειδικών για το πώς η τεχνητή νοημοσύνη μπορεί να υποστηρίξει τους εφήβους», δήλωσε εκπρόσωπος του OpenAI. Η εταιρεία είπε ότι η επανεξέταση της μεθοδολογίας του ομίλου έδειξε ότι «το μεγαλύτερο μέρος των δοκιμών τους μπορεί να ξεκίνησε και να ολοκληρώθηκε πριν ολοκληρωθεί η ενεργοποίηση των γονικών ελέγχων, καθιστώντας τα ευρήματά τους ανακριβή», προσθέτοντας ότι τέτοιες δοκιμές δεν θα καθορίσουν εάν οι ειδοποιήσεις γονικής ασφάλειας λειτουργούν όπως έχουν σχεδιαστεί.

Ο Steyer είπε ότι ο οργανισμός του είχε έρθει σε επαφή με το OpenAI σχετικά με τα ευρήματα, όπως είναι η συνήθης πρακτική του κατά τη διάρκεια των αξιολογήσεων προϊόντων, και έμεινε στα αποτελέσματα. «Στεκόμαστε 100% πίσω από την ποιότητα της έρευνάς μας και των δοκιμών μας και το γεγονός ότι χαρακτηρίσαμε αυτό το προϊόν ως «απαράδεκτο κίνδυνο»», είπε, κάνοντας σύγκριση με την ασφάλεια του αυτοκινήτου: «Δεν θα βάζατε ένα αυτοκίνητο στην αγορά αν δεν περνούσε το crash test».

Ένας αυξανόμενος προβολέας για την τεχνητή νοημοσύνη και τους ανηλίκους

Η διαμάχη έρχεται εν μέσω εντατικοποίησης του ελέγχου του τρόπου με τον οποίο τα chatbots AI επηρεάζουν τους νεαρούς χρήστες, από σχολικές περιφέρειες που περιορίζουν την πρόσβαση σε νομοθέτες που σταθμίζουν τις απαιτήσεις επαλήθευσης ηλικίας. Ανεξάρτητοι έλεγχοι όπως αυτός γίνονται ένα de facto πεδίο δοκιμών για τους ισχυρισμούς ασφάλειας των νέων που κάνουν οι εταιρείες τεχνητής νοημοσύνης στο μάρκετινγκ τους.

Και οι δύο πλευρές συμφωνούν σε ένα πράγμα: το σύστημα γονικής ειδοποίησης είναι η ουσία. Εάν οι ειδοποιήσεις αποτύχουν να ενεργοποιηθούν όταν ένας νέος λογαριασμός εφήβου εγείρει για πρώτη φορά σκέψεις αυτοτραυματισμού, το πιο σημαντικό χαρακτηριστικό ασφαλείας αποτυγχάνει τη στιγμή που έχει μεγαλύτερη σημασία. Το OpenAI λέει ότι η δοκιμή ήταν λανθασμένη. Η Common Sense Media λέει ότι το προϊόν αποστέλλεται πριν είναι έτοιμο. Οι ρυθμιστικές αρχές και οι γονείς θα σταθμίσουν τώρα ποιος έχει δίκιο — και το OpenAI αντιμετωπίζει αυξανόμενη πίεση για να διορθώσει τα κενά ή να αποσύρει το προϊόν.

Για περισσότερη κάλυψη της ασφάλειας, της πολιτικής της τεχνητής νοημοσύνης και των εξελίξεων της βιομηχανίας AI που τις διαμορφώνουν, ακολουθήστε καθώς εξελίσσεται αυτή η ιστορία.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →