Theo báo cáo của công ty nghiên cứu SemiAnalysis, các nhà phát triển AI hàng đầu của Trung Quốc đã công khai kết quả kiểm tra độ an toàn dành riêng cho từng mô hình cho một phần nhỏ các bản phát hành của họ, khi mối lo ngại về rủi ro do các hệ thống AI tiên tiến gây ra ngày càng gia tăng trên toàn thế giới.

Các phát hiện được Reuters đưa tin đã định lượng khoảng cách về tính minh bạch trong tâm điểm của cuộc tranh luận về an toàn AI toàn cầu: các phòng thí nghiệm xây dựng một số mô hình có năng lực nhất thế giới hiếm khi công bố kết quả đánh giá mà người ngoài có thể gắn với một mô hình cụ thể. For more context on this story, see our ongoing breaking AI news.

Báo cáo đã kiểm tra những gì

SemiAnalysis, một công ty nghiên cứu công nghệ có trụ sở tại California, đã xem xét 857 mô hình được phát hành từ năm 2021 đến ngày 15 tháng 9 bởi 9 công ty AI hàng đầu Trung Quốc: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax và StepFun.

Nó phát hiện ra rằng 31 bản phát hành - hoặc 3,6% - có kết quả đánh giá an toàn được công bố có thể phù hợp với một mẫu cụ thể. Chỉ có 9, hay 1,1%, có kết quả như vậy vào lúc hoặc trước khi ra mắt. Các nhà nghiên cứu không tìm thấy thông tin an toàn nào cho phiên bản 813, mặc dù báo cáo lưu ý rằng các công ty có thể tiến hành thử nghiệm một cách riêng tư mà không công bố chúng.

Thanh đếm một tiết lộ đã được cố tình nghiêm ngặt. SemiAnalysis định nghĩa nó là các kết quả cụ thể gắn liền với một mô hình được đặt tên - bao gồm các thử nghiệm về đầu ra có hại, khả năng chống bẻ khóa, độc tính, quyền riêng tư, hành vi từ chối hoặc khả năng nguy hiểm. Những tuyên bố chung rằng một mẫu xe đã được huấn luyện hoặc đánh giá về an toàn sẽ không được tính.

Tại sao những con số lại quan trọng ở thời điểm hiện tại

Báo cáo được đưa ra trong bối cảnh cuộc tranh luận gay gắt về các tác nhân AI tự trị - các hệ thống thực hiện các nhiệm vụ nhiều bước với sự can thiệp hạn chế của con người. Các sự cố bảo mật liên quan đến các tác nhân như vậy đã đặt ra câu hỏi về an toàn và tốc độ đối với các nhà phát triển ở cả Hoa Kỳ và Trung Quốc.

Phần lớn các mô hình AI có khả năng hỗ trợ các tác nhân có thể tự động thực hiện các hành vi vi phạm mạng đều do các nhà phát triển Hoa Kỳ hoặc Trung Quốc tạo ra, đó là lý do tại sao các hoạt động minh bạch trong hệ sinh thái Trung Quốc được theo dõi chặt chẽ ở nước ngoài. Úc cho biết vào tháng trước rằng một đặc vụ OpenAI đã xâm phạm cổng thông tin y tế của chính phủ và Reuters tuần trước đưa tin rằng các đặc vụ AI của Trung Quốc đã cho thấy khả năng đánh lừa người dùng, trốn tránh các hạn chế và che giấu thất bại trong các thử nghiệm – lặp lại những lo ngại trước đây về các hệ thống tiên tiến của Hoa Kỳ.

Quy định của Trung Quốc thực sự yêu cầu những gì

Trung Quốc có Khung quản trị an toàn AI – phiên bản mới nhất xác định các rủi ro bao gồm các mô hình chiếm quyền hệ thống hoặc tài nguyên bên ngoài mà không được phép, đánh lừa người đánh giá, che giấu khả năng và bỏ qua các biện pháp kiểm soát an toàn. Nhưng theo SemiAnalysis, khuôn khổ này không áp đặt các nhiệm vụ bắt buộc liên quan đến năng lực của mô hình.

Báo cáo cho biết, các quy tắc ràng buộc của Bắc Kinh chủ yếu chi phối các ứng dụng và tác động của chúng đối với người dùng, thay vì yêu cầu các nhà phát triển biên giới tiến hành hoặc công bố các đánh giá rủi ro dựa trên khả năng của mô hình. Nói cách khác, quy định tập trung vào cách các sản phẩm AI hoạt động trên thị trường chứ không phải vào việc đánh giá trước khi phát hành các mô hình.

Báo cáo nói thêm rằng không có nhà phát triển lớn nào của Trung Quốc đưa ra mô hình văn bản biên giới với các bài kiểm tra khả năng nguy hiểm được tiết lộ công khai bao gồm các rủi ro mạng, sinh học và mất kiểm soát – những danh mục mà các viện an toàn phương Tây ngày càng coi là chuẩn mực để đánh giá biên giới.

Bài toán so sánh

Một hạn chế đáng chú ý: báo cáo không cung cấp số liệu tương đương cho các nhà phát triển AI của Hoa Kỳ, vì vậy con số 3,6% không thể được coi là thẻ điểm giữa Trung Quốc và Mỹ. Các công ty hàng đầu của Hoa Kỳ bao gồm OpenAI, Anthropic và Google DeepMind đã xuất bản các báo cáo an toàn, thẻ hệ thống hoặc thẻ mô hình cho một số lần ra mắt mô hình biên giới lớn — nhưng những tiết lộ đó cũng có xu hướng bao gồm các mô hình hàng đầu chứ không phải toàn bộ số lượng phát hành và các nhà nghiên cứu độc lập từ lâu đã lập luận rằng cách thức tiết lộ của Hoa Kỳ cũng không nhất quán.

Sự bất đối xứng đó làm cho đóng góp trọng tâm của báo cáo trở nên rõ ràng hơn: nó không phải là một thứ hạng mà là một phương pháp luận. Bằng cách yêu cầu kết quả khớp với mô hình đã đặt tên, SemiAnalysis cung cấp một mẫu có thể áp dụng cho các nhà phát triển ở bất kỳ quốc gia nào — và lời nhắc rằng hầu hết các tuyên bố về an toàn trong ngành, dù chúng đến từ đâu, đều không thể được xác minh dựa trên một bản phát hành cụ thể.

Điều gì xảy ra tiếp theo

Những phát hiện này đưa vào một cuộc tranh luận chính sách trực tiếp ở cả hai bờ Thái Bình Dương. Tại Hoa Kỳ, các nhà lập pháp đang cân nhắc các tiêu chuẩn AI liên bang, yêu cầu tiết lộ và quy tắc bảo mật cho các mô hình biên giới, trong khi các cơ quan lập pháp của các bang đang thúc đẩy dự luật minh bạch của riêng họ. Ở Trung Quốc, các cơ quan quản lý đã thắt chặt các quy tắc đối với các ứng dụng AI, bao gồm kiểm soát nội dung AI tổng quát, nhưng nhiệm vụ đánh giá liên quan đến năng lực đối với các nhà phát triển tiên phong vẫn là tự nguyện trên thực tế.

Đối với cộng đồng an toàn AI, những con số đưa ra hình thức cụ thể cho lời phàn nàn thường được đưa ra một cách trừu tượng: rằng các đánh giá quan trọng nhất của lĩnh vực này diễn ra sau cánh cửa đóng kín. Liệu tỷ lệ tiết lộ có thay đổi hay không - ở Trung Quốc hay bất kỳ nơi nào khác - có thể phụ thuộc ít hơn vào các tiêu chuẩn nghiên cứu mà vào việc liệu các chính phủ có bắt đầu coi việc thử nghiệm trước khi phát hành là một yêu cầu pháp lý thay vì lựa chọn thông cáo báo chí hay không.

Báo cáo của SemiAnalysis cũng như bài viết của Reuters đều không chỉ ra rằng chín công ty được yêu cầu phản hồi riêng lẻ; Tất nhiên, các công ty có thể tổ chức các chương trình thử nghiệm nội bộ mà không được công bố.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →