Một đánh giá an toàn rộng rãi của Common Sense Media đã kết luận rằng chế độ ChatGPT dành cho thanh thiếu niên của OpenAI gây ra "rủi ro không thể chấp nhận được" đối với người dùng dưới 18 tuổi - xếp hạng tồi tệ nhất của nhóm giám sát - chưa đầy hai tháng sau khi sản phẩm ra mắt với lời hứa về các biện pháp bảo vệ tích hợp. Như NPR đã báo cáo, nhóm nhận thấy rằng hầu hết các biện pháp bảo vệ được quảng cáo của chế độ này không hoạt động như đã hứa trong quá trình thử nghiệm.

Những phát hiện này đến vào thời điểm nhạy cảm đối với OpenAI, công ty đã ra mắt ChatGPT dành cho thanh thiếu niên vào tháng 8 như một trải nghiệm dành riêng cho người dùng chưa đủ tuổi, hoàn chỉnh với sự kiểm soát của phụ huynh và các biện pháp bảo vệ chặt chẽ hơn. Tin tức trước đây của chúng tôi đã ghi lại rằng ngành AI thúc đẩy sự an toàn của thanh thiếu niên; báo cáo mới là cuộc kiểm tra độc lập lớn đầu tiên về việc liệu các biện pháp bảo vệ của chế độ thanh thiếu niên có được áp dụng trên thực tế hay không.

Những gì Common Sense Media đã được thử nghiệm

Các nhà nghiên cứu tại Viện An toàn AI dành cho Thanh thiếu niên của nhóm đã thử nghiệm hơn 4.000 lời nhắc trước và sau khi ra mắt chế độ dành cho thanh thiếu niên, theo báo cáo của The National News Desk và Fast Company của Sinclair Broadcast Group. Nhóm khuyến nghị OpenAI tạm dừng tiếp thị chế độ dành cho thanh thiếu niên và ngăn thanh thiếu niên sử dụng ChatGPT cho đến khi công ty phát triển cái mà họ gọi là "trải nghiệm an toàn, phù hợp với sự phát triển".

Đánh giá sản phẩm của tổ chức cho biết: “Một số biện pháp bảo vệ được quảng cáo của ChatGPT đã phù hợp với thử nghiệm của chúng tôi, bao gồm cả việc từ chối nhập vai tình dục rõ ràng”. "Nhưng một số khác đã thất bại - và một số trở nên tồi tệ hơn với chế độ Thanh thiếu niên mới. Chúng tôi lo ngại rằng ChatGPT dành cho Thanh thiếu niên có thể khiến các bậc cha mẹ tin tưởng sai lầm vào các rào chắn thường không hoạt động."

Cảnh báo của phụ huynh không kích hoạt

Phát hiện nổi bật nhất của báo cáo liên quan đến hệ thống thông báo của phụ huynh. Các nhà nghiên cứu đã tạo hơn chục tài khoản tự báo cáo về độ tuổi thanh thiếu niên và được liên kết với tài khoản phụ huynh, sau đó đưa chatbot vào các cuộc trò chuyện có chứa các đề cập rõ ràng đến ý nghĩ tự tử, tự làm hại bản thân hoặc rối loạn ăn uống. Các tài khoản được xây dựng trên các nhân vật hư cấu.

Theo báo cáo, những người thử nghiệm không nhận được cảnh báo nào từ phụ huynh từ các tài khoản mới tạo ra những tài liệu tham khảo này. Cảnh báo chỉ đến với các tài khoản khác có lịch sử trò chuyện hàng tuần về các chủ đề tương tự - một lỗ hổng cho thấy hệ thống thông báo phụ thuộc nhiều vào ngữ cảnh tích lũy hơn là mức độ nghiêm trọng của những gì thanh thiếu niên tiết lộ trong một cuộc trò chuyện nhất định.

Đánh giá cũng cho thấy ChatGPT dành cho thanh thiếu niên đã bỏ lỡ hơn một trong bốn trường hợp cần được giới thiệu về khủng hoảng sức khỏe tâm thần, theo đánh giá của một hội đồng gồm các chuyên gia sức khỏe tâm thần trẻ em được cấp phép đã xem xét các lời nhắc.

Rào chắn bài tập ở trường 'Dễ dàng vượt qua'

Ngoài việc phát hiện khủng hoảng, cơ quan giám sát còn phát hiện ra rằng tính năng nhằm ngăn học sinh sử dụng chatbot để gian lận trong bài tập ở trường rất dễ bị bỏ qua hoặc vô hiệu hóa hoàn toàn.

"Bạn có thể yêu cầu họ viết một bài báo cho bạn, một bài báo phức tạp cho bạn và nó sẽ làm được điều đó, thậm chí nó còn cho bạn biết cách chỉnh sửa theo cách mà giáo viên của bạn không biết", người sáng lập và Giám đốc điều hành Common Sense Media Jim Steyer nói trong bình luận được The National News Desk đưa tin. "Do đó, nó cản trở việc học tập. Nó cản trở quá trình cơ bản và việc trẻ phải tự làm việc."

Các biện pháp bảo vệ nội dung, dự đoán độ tuổi và lời nhắc nghỉ giải lao cũng được cho là không hiệu quả trong quá trình thử nghiệm. Một điểm dữ liệu được trích dẫn rộng rãi: OpenAI cho biết người dùng tuổi teen trung bình dành ít hơn 15 phút mỗi ngày cho ChatGPT. Nhưng trong số một phần nhỏ thanh thiếu niên dành hơn ba giờ liên tục mỗi ngày - ít hơn 2% người dùng - gần một nửa đã kết thúc cuộc trò chuyện của họ trong vòng năm phút sau khi nhận được lời nhắc nghỉ giải lao, cho thấy những cú huých hiếm khi làm gián đoạn các phiên kéo dài.

OpenAI đẩy lùi phương pháp luận

OpenAI, trong một tuyên bố phản hồi báo cáo, cho biết họ "cam kết sâu sắc" với sự an toàn của thanh thiếu niên và chỉ ra các biện pháp bảo vệ mà họ đã xây dựng cũng như các công cụ mà họ cung cấp cho phụ huynh.

Người phát ngôn của OpenAI cho biết: “Chúng tôi hoan nghênh đánh giá độc lập nghiêm ngặt, nhưng chúng tôi không tin rằng thử nghiệm của Common Sense Media phản ánh chính xác cách hoạt động của các biện pháp bảo vệ thanh thiếu niên của ChatGPT trong thực tế hoặc quan điểm của chuyên gia về cách AI có thể hỗ trợ thanh thiếu niên”. Công ty cho biết việc xem xét phương pháp của nhóm cho thấy "phần lớn thử nghiệm của họ có thể đã bắt đầu và kết thúc trước khi hoàn tất kích hoạt kiểm soát của phụ huynh, khiến kết quả của họ không chính xác", đồng thời nói thêm rằng các thử nghiệm như vậy sẽ không xác định liệu thông báo an toàn của phụ huynh có hoạt động như thiết kế hay không.

Steyer cho biết tổ chức của ông đã liên hệ với OpenAI về những phát hiện này, cũng như thông lệ tiêu chuẩn của tổ chức này trong quá trình đánh giá sản phẩm và ủng hộ kết quả. Ông nói: “Chúng tôi 100% ủng hộ chất lượng nghiên cứu và thử nghiệm của mình cũng như việc chúng tôi dán nhãn sản phẩm này là 'rủi ro không thể chấp nhận được'", ông đưa ra so sánh với sự an toàn của ô tô: "Bạn sẽ không đưa một chiếc ô tô ra thị trường nếu nó không vượt qua bài kiểm tra va chạm."

Tiêu điểm ngày càng tăng về AI và trẻ vị thành niên

Tranh chấp xảy ra trong bối cảnh ngày càng có nhiều sự giám sát chặt chẽ về cách các chatbot AI ảnh hưởng đến người dùng trẻ tuổi, từ việc các khu học chánh hạn chế quyền truy cập cho đến các nhà lập pháp cân nhắc các yêu cầu xác minh độ tuổi. Các cuộc kiểm toán độc lập như thế này đang trở thành nơi thử nghiệm trên thực tế cho những tuyên bố về an toàn cho giới trẻ mà các công ty AI đưa ra trong hoạt động tiếp thị của họ.

Cả hai bên đều đồng ý về một điều: hệ thống thông báo của phụ huynh là mấu chốt. Nếu cảnh báo không kích hoạt khi tài khoản thanh thiếu niên mới lần đầu nảy sinh ý nghĩ tự làm hại bản thân thì tính năng an toàn quan trọng nhất sẽ không hoạt động vào thời điểm quan trọng nhất. OpenAI cho biết quá trình thử nghiệm có sai sót; Common Sense Media cho biết sản phẩm đã được vận chuyển trước khi sẵn sàng. Các cơ quan quản lý và phụ huynh giờ đây sẽ cân nhắc xem ai đúng - và OpenAI phải đối mặt với áp lực ngày càng lớn trong việc khắc phục các lỗ hổng hoặc thu hồi sản phẩm.

Để biết thêm thông tin về an toàn AI, chính sách và sự phát triển của ngành AI đã định hình nên chúng, hãy theo dõi câu chuyện này phát triển.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →