Cơ quan An ninh Quốc gia, Cơ quan An ninh mạng và Cơ sở hạ tầng và FBI cùng cáo buộc sáu công ty AI có trụ sở tại Trung Quốc thực hiện các chiến dịch chưng cất quy mô công nghiệp chống lại các mô hình biên giới của Hoa Kỳ, trong một cố vấn được công bố hôm thứ Ba. Các cơ quan cho biết DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.AI đã trích xuất hàng tỷ token trên hàng triệu sàn giao dịch và yêu cầu từ các mô hình AI biên giới của Hoa Kỳ – bao gồm các biến thể của Claude, GPT, Gemini và Grok – ít nhất là từ cuối năm 2024, một hoạt động mà tư vấn cho biết có thể đã xảy ra với nhận thức của chính phủ Trung Quốc.

Lời khuyên, được chỉ định là AA26-251A, lưu ý cẩn thận rằng chưng cất là một kỹ thuật hợp pháp và được sử dụng rộng rãi trong nghiên cứu AI, trong đó một mô hình nhỏ hơn được đào tạo để tái tạo kết quả đầu ra của một mô hình lớn hơn. Những gì ba cơ quan mô tả là khác nhau về bản chất: quá trình chắt lọc mạnh mẽ, độc hại và có chủ đích được tiến hành ở quy mô công nghiệp, tạo thành thứ mà tài liệu gọi là cốt lõi - không chỉ đơn thuần là phần bổ sung - cho chiến lược phát triển AI của các công ty mục tiêu. Để biết tin tức mới nhất về chính sách AI, hãy theo dõi tin tức liên tục của AI Buzz Wire về chương trình pháp lý của Washington. tin tức chính sách AI mới nhất

Ai được nêu tên và họ bị cáo buộc đã lấy gì

Việc tư vấn phân bổ các chiến dịch cụ thể cho các công ty cụ thể. DeepSeek được cho là đã chạy các chiến dịch chắt lọc có tổ chức kể từ ít nhất năm 2024 nhắm mục tiêu vào các khả năng suy luận, tối ưu hóa chuyên biệt và các chức năng dành riêng cho miền được sử dụng để đào tạo các mô hình R1 và V3 của nó. Alibaba bị cáo buộc tận dụng quá trình chưng cất ở quy mô công nghiệp để cải tiến dòng mô hình Qwen của mình, vốn đã trở thành một trong những dòng mô hình có trọng lượng mở được tải xuống nhiều nhất trên thế giới.

Moonshot AI, MiniMax, StepFun và Z.AI cũng bị cáo buộc tham gia vào việc chắt lọc dữ liệu độc hại của các thương hiệu Hoa Kỳ, mặc dù cơ quan tư vấn công bố ít thông tin chi tiết cụ thể hơn về công ty cho bốn thương hiệu này. Tất cả sáu công ty đều đã xây dựng những mẫu xe hiện đang cạnh tranh trực tiếp với các hệ thống tiên phong của Mỹ về tiêu chuẩn và giá cả.

Chiến dịch được cho là đã hoạt động như thế nào

Theo tài liệu, các công ty đã chuyển các yêu cầu chưng cất qua nhiều con đường để có được quyền truy cập trái phép đồng thời vi phạm điều khoản sử dụng của các công ty Hoa Kỳ. Chúng bao gồm giao diện lập trình ứng dụng gốc của mô hình, nhà cung cấp đám mây từ xa và trình tổng hợp của bên thứ ba tự động làm xáo trộn siêu dữ liệu của người dùng để tránh bị phát hiện.

Các cơ quan cũng mô tả một thị trường ủy quyền màu xám được gọi là "trạm trung chuyển" được sử dụng để vượt qua các hạn chế về địa lý của các nhà cung cấp Hoa Kỳ, vi phạm điều khoản dịch vụ, trốn tránh các biện pháp bảo vệ và làm suy yếu khả năng truy xuất nguồn gốc. Để giảm chi phí trong các chiến dịch ở quy mô này, tư vấn cho biết các công ty đã tham gia mua sắm số lượng lớn các gói đăng ký trả phí, sau đó được chia sẻ giữa các nhóm nhà phát triển.

Các chiến thuật nâng cao hơn bao gồm trích xuất lý luận theo chuỗi suy nghĩ, chuyển đổi dự phòng tự động giữa các đường truy cập trong các nỗ lực chặn và các khung đánh giá chất lượng phức tạp được thiết kế để phát hiện khi nhà cung cấp triển khai các biện pháp đối phó phòng thủ. Các cơ quan viết rằng lợi ích là các công ty tiến hành chưng cất ở quy mô công nghiệp nhận thấy thời gian phát triển AI ngắn hơn đáng kể và giảm chi tiêu tài chính khi đào tạo một mô hình tiên phong.

Ba khuyến nghị dành cho các công ty AI của Hoa Kỳ

Lời khuyên kết thúc với ba hành động ngay lập tức dành cho các nhà cung cấp AI của Mỹ. Đầu tiên, triển khai tính năng phát hiện và giảm thiểu toàn diện: giám sát các lời nhắc, tài khoản, mạng và hành vi bất thường và độc hại, đồng thời theo dõi tỷ lệ đăng ký trên mức sử dụng, mức sử dụng tối đa ngay lập tức từ các tài khoản mới và mô hình thông lượng ở quy mô doanh nghiệp.

Thứ hai, triển khai các thay đổi phản hồi có mục tiêu. Các cơ quan khuyến nghị thay đổi một cách tinh vi các phản ứng đối với các nỗ lực chưng cất bị nghi ngờ có mục đích xấu nhằm giảm bớt lợi ích của các chiến dịch - một hình thức biện pháp đối phó làm giảm giá trị của đầu ra bị đánh cắp mà không thông báo cho nhà chưng cất.

Thứ ba, thiết lập tính năng chia sẻ thông tin giữa các tổ chức để tương quan hoạt động giữa các nhà cung cấp mô hình, nền tảng đám mây và bộ tổng hợp API, để các chiến dịch được phân phối có chủ ý trên nhiều nhà cung cấp nhằm tránh bị phát hiện tại một điểm duy nhất có thể được coi là một hoạt động duy nhất.

Giai đoạn mới trong tranh chấp AI Mỹ-Trung

Ấn phẩm này xuất hiện trong bối cảnh những lời lẽ hoa mỹ của Washington về sự phát triển AI của Trung Quốc đang leo thang rộng rãi hơn. Reuters đưa tin rằng Hoa Kỳ đã cáo buộc các công ty AI của Trung Quốc sao chép độc hại công nghệ AI của Mỹ và lời khuyên này đã được CyberScoop, Nextgov và các cơ quan khác theo dõi cộng đồng tình báo đưa tin hôm thứ Ba. Tài liệu này trình bày các vấn đề theo các thuật ngữ chiến lược rõ ràng, mô tả hoạt động này là việc khai thác một cách có hệ thống các chức năng và khả năng độc quyền đe dọa đến vị thế dẫn đầu về công nghệ của Hoa Kỳ.

Đối với sáu công ty được nêu tên, lời khuyên này làm tăng chi phí thương mại và danh tiếng khi phục vụ khách hàng phương Tây. Đặc biệt, Alibaba và DeepSeek đã phát triển hệ sinh thái nhà phát triển bên ngoài Trung Quốc và cả hai đều đã xuất hiện trong các cuộc trò chuyện mua sắm của doanh nghiệp mà giờ đây sẽ đưa ra một câu hỏi bổ sung về tuân thủ. Không ai trong số sáu công ty phải tuân theo khuyến nghị trực tiếp của lời khuyên - tài liệu đề cập đến các công ty AI của Hoa Kỳ - nhưng tác dụng của nó là chính thức hóa những gì các phòng thí nghiệm của Mỹ đã tuyên bố riêng tư trong hai năm: rằng các mô hình của họ đã được sao chép một cách có hệ thống trên quy mô lớn.

Lời khuyên này cũng đặt ra giữa một cuộc tranh luận chưa được giải quyết trong ngành AI về nơi kết thúc việc học tập hợp pháp và hành vi trộm cắp bắt đầu. Chắt lọc từ các mô hình trọng lượng mở, nghiên cứu đã công bố và kết quả đầu ra công cộng là thông lệ tiêu chuẩn; các tác giả của lời khuyên đã vạch ra ranh giới trong việc khai thác chức năng độc quyền bị hạn chế thông qua hành vi lừa dối, trốn tránh các biện pháp kiểm soát truy cập và vi phạm các điều khoản sử dụng. Đường ranh giới đó được thực thi như thế nào - thông qua các biện pháp đối phó kỹ thuật, luật hợp đồng hoặc chính sách xuất khẩu - hiện là câu hỏi mà ngành và các cơ quan quản lý sẽ phải trả lời.

Đi trước AI

Theo dõi những phát triển AI mới nhất và tin tức nóng hổi về trí tuệ nhân tạo khi cuộc chiến chính sách về bảo mật mô hình ngày càng gia tăng.

Đọc thêm tin tức về AI →