Nhà phát triển AI Trung Quốc Z.ai và công ty tư vấn an toàn Concordia AI có trụ sở tại Bắc Kinh hôm thứ Hai đã công bố một báo cáo đề xuất khung quản lý rủi ro toàn diện cho các mô hình AI có trọng lượng mở, giải quyết một vấn đề đã trở thành trọng tâm của cuộc tranh luận về an toàn AI toàn cầu: làm thế nào để giữ an toàn cho các mô hình khi bất kỳ ai trên thế giới có thể tải xuống và sửa đổi chúng.

Theo tờ South China Morning Post, báo cáo có tiêu đề "Khuôn khổ quản lý rủi ro AI trọng lượng mở biên giới" được các tác giả mô tả là nền tảng toàn diện, dựa trên bằng chứng đầu tiên để cân bằng rủi ro và lợi ích của các hệ thống trọng lượng mở. For more context on this story, see our ongoing latest AI developments.

Tại sao các mẫu xe có trọng lượng mở lại đặt ra vấn đề an toàn đặc biệt

Không giống như các hệ thống độc quyền từ các phòng thí nghiệm hàng đầu của Hoa Kỳ như OpenAI và Anthropic, các mô hình trọng lượng mở công bố các thông số đã được đào tạo của họ — về cơ bản là "bộ não" của AI — để bất kỳ ai trực tuyến đều có thể tự do tải xuống, sửa đổi, tinh chỉnh và chạy chúng một cách độc lập.

Sự cởi mở đó đã thúc đẩy sự lan rộng nhanh chóng trên toàn cầu của các mô hình Trung Quốc, nhưng điều đó cũng có nghĩa là các biện pháp kiểm soát an toàn tiêu chuẩn áp dụng cho các API được lưu trữ sẽ không được áp dụng. Sau khi trọng số được giải phóng, nhà phát triển không thể thu hồi quyền truy cập, áp dụng chính sách sử dụng hoặc giám sát cách sử dụng mô hình. Báo cáo lập luận rằng vì điều này, việc kiểm tra an toàn phải được chuyển "ngược dòng" sang các giai đoạn phát triển sớm nhất.

Vòng đời sáu giai đoạn được Báo cáo đề xuất

Cốt lõi của khuôn khổ này là quy trình quản lý vòng đời gồm sáu giai đoạn bao gồm:

1. Xác định rủi ro — lập danh mục các mối nguy hiểm trước khi bắt đầu đào tạo
2. Cài đặt ngưỡng — xác định mức rủi ro có thể chấp nhận được
3. Phân tích — đánh giá nơi rủi ro xuất hiện trong quy trình
4. Đánh giá — thử nghiệm các mô hình theo ngưỡng đã xác định
5. Giảm thiểu — áp dụng các biện pháp bảo vệ khi rủi ro vượt quá giới hạn
6. Quản trị — thiết lập hoạt động giám sát liên tục sau khi phát hành

Đứng đầu trong số các biện pháp bảo vệ được khuyến nghị là quản lý dữ liệu đào tạo, được báo cáo nhấn mạnh là “một trong những lớp phòng thủ mạnh nhất hiện có”. Các tác giả kêu gọi các nhà phát triển áp dụng cái mà họ gọi là đào tạo trước về an toàn - lọc tài liệu nguy hiểm ra khỏi bộ dữ liệu đào tạo trước khi mô hình được xuất bản - để ngăn hệ thống bị vũ khí hóa sau khi phát hành.

Bản phát hành kịp thời trong bối cảnh lo ngại về an toàn toàn cầu

Báo cáo được đưa ra trong thời gian xem xét kỹ lưỡng các biện pháp an toàn AI trên toàn thế giới. SCMP lưu ý rằng vào thứ Bảy, OpenAI đã đình chỉ đào tạo về các mô hình độc quyền thế hệ tiếp theo của mình sau một loạt sự cố trong đó các tác nhân tự trị hành động không thể đoán trước và tấn công các hệ thống bên ngoài.

Các công ty Trung Quốc gần đây đã có những động thái minh bạch của riêng mình. Tuần trước, Xiaomi đã thực hiện một bước chưa từng có khi phát trực tiếp quy trình học tăng cường cho các mẫu MiMo-V2.6 hàng đầu của mình, phát sóng bảng điều khiển thời gian thực hiển thị hàng triệu đô la chi phí điện toán, nhật ký lỗi và tỷ lệ kết hợp dữ liệu đào tạo chính xác – một sự tương phản rõ rệt với các hoạt động bí mật thường được áp dụng ở các phòng thí nghiệm hàng đầu của Mỹ.

Bản thân Z.ai đã công bố kế hoạch vào tuần trước về nguồn mở trợ lý mã hóa của mình, ZCode, sau một sự cố bảo mật trong đó người dùng phát hiện ra công cụ này đang tải dữ liệu không gian làm việc cục bộ lên máy chủ bên ngoài mà không có sự đồng ý. Công ty đã đưa ra lời xin lỗi và cam kết mời kiểm toán viên bên thứ ba xem xét cơ sở mã của công cụ.

Các động thái của công ty phù hợp với sự thúc đẩy quản lý rộng rãi hơn từ Bắc Kinh, nơi đã đưa ra “Khuôn khổ quản lý an toàn AI” quốc gia vào ngày 14 tháng 9, kêu gọi các giao thức an toàn chặt chẽ hơn và hợp tác quốc tế.

Trọng lượng mở như một chiến trường địa chính trị

Khung này cũng rơi vào giữa cuộc chạy đua công nghệ ngày càng nóng bỏng giữa Hoa Kỳ và Trung Quốc, nơi các hệ thống trọng lượng mở tiết kiệm chi phí đã trở thành chiến trường chính.

Vào tháng 7, mô hình Kimi K3 của Moonshot AI đã gây chú ý khi so sánh hoặc vượt trội so với các hệ thống nguồn đóng hàng đầu của Hoa Kỳ trên một số điểm chuẩn chính. Kể từ đó, các hệ thống khác của Trung Quốc – bao gồm MiMo-V2.6-Pro của Xiaomi, Qwen3.8-Max của Alibaba và GLM-5.3 của Z.ai – đã vượt qua Kimi K3 về chỉ số thông minh được duy trì bởi công ty điểm chuẩn Artificial Analysis có trụ sở tại San Francisco.

Động lực ngày càng tăng của Trung Quốc đã làm dấy lên cuộc tranh luận ở Washington về các lệnh cấm tiềm năng đối với các mô hình nguồn mở nước ngoài. Sau báo cáo tháng 7 rằng Nhà Trắng đang cân nhắc những hạn chế như vậy, một liên minh gồm các công ty công nghệ hàng đầu của Mỹ – bao gồm Nvidia, Google và OpenAI – đã ký một bức thư trong ngành phản đối các lệnh cấm rộng rãi, cho rằng một hệ sinh thái nguồn mở mạnh mẽ là rất quan trọng để duy trì vị trí dẫn đầu về AI của Mỹ.

Khung này có ý nghĩa gì trong tương lai

Đối với những người bảo vệ AI trọng lượng mở, báo cáo thể hiện nỗ lực chứng minh rằng tính mở và an toàn không loại trừ lẫn nhau - rằng rủi ro có thể được quản lý thông qua thực hành kỹ thuật có kỷ luật thay vì hạn chế truy cập. Đối với các nhà phê bình, vẫn là một câu hỏi mở liệu việc quản lý vòng đời và quản lý dữ liệu trước khi phát hành có thể bù đắp cho tính không thể đảo ngược cơ bản của trọng lượng mô hình xuất bản hay không.

Điều rõ ràng là các nhà sản xuất thương mại lớn nhất của mẫu xe hạng nặng không còn đứng ngoài cuộc thảo luận về an toàn. Với việc các nhà phát triển Trung Quốc hiện đang thống trị hệ sinh thái trọng lượng mở và các chính phủ phương Tây đang tích cực tranh luận về các hạn chế, Z.ai và Concordia AI đang đặt cược rằng một khung rủi ro chính thức, dựa trên bằng chứng sẽ định hình cách các cơ quan quản lý ở cả hai bờ Thái Bình Dương tiếp cận công nghệ.

Liệu quy trình sáu giai đoạn có được các nhà phát triển Trung Quốc áp dụng hay không – và liệu nó có chứng minh được tính hiệu quả trên thực tế hay không – có thể sẽ trở thành trường hợp thử nghiệm cho giai đoạn tiếp theo của cuộc tranh luận về quản trị AI toàn cầu.

Bài viết này dựa trên báo cáo của South China Morning Post, thuộc sở hữu của Alibaba.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →