Bloomberg đưa tin vào ngày 15 tháng 8 năm 2026, dòng mô hình AI Qwen của Alibaba đã vượt qua 3 tỷ lượt tải xuống, vượt qua các dịch vụ mô hình mở của Meta và Google để trở thành mô hình AI mở được tải xuống nhiều nhất trên thế giới.
Cột mốc quan trọng này đánh dấu một chặng đường đáng chú ý cho chiến lược mở rộng của gã khổng lồ thương mại điện tử Trung Quốc, chiến lược đã chứng kiến các bản phát hành Qwen tích lũy được sự chấp nhận với tốc độ hiện vượt xa các đối thủ phương Tây. Đối với các nhà phát triển và doanh nghiệp đang theo dõi cuộc đua AI nguồn mở, sự thay đổi này đánh dấu một trong những sự đảo ngược rõ ràng nhất có thể đo lường được trong bối cảnh AI toàn cầu.
Những con số cho thấy điều gì
Báo cáo của Bloomberg, do Business Standard và BusinessLine chọn ra, đưa số lượt tải xuống tích lũy của Qwen trên 3 tỷ trên các trung tâm mô hình, vượt xa dòng Llama của Meta và các mô hình Gemma của Google. Dữ liệu nền tảng được AI Buzz Wire xem xét nhấn mạnh tốc độ hiện tại: chỉ riêng trên Hugging Face, 100 kho lưu trữ Qwen hàng đầu đã ghi nhận khoảng 330 triệu lượt tải xuống trong 30 ngày qua, trong đó Qwen3-0.6B nhỏ gọn dẫn đầu với hơn 30 triệu lượt tải xuống hàng tháng.
Vương miện tải xuống rất quan trọng vì các mô hình trọng lượng mở cạnh tranh chủ yếu về việc áp dụng. Các nhà phát triển xây dựng trên một gia đình kiểu mẫu tạo ra một hệ sinh thái gồm các tinh chỉnh, công cụ và sản phẩm phái sinh từ đó thu hút nhiều người dùng hơn — một chiếc bánh đà mà Meta đi tiên phong với Llama và Qwen hiện đã tuyên bố một cách dứt khoát.
Số lượt tải xuống là một đại diện không hoàn hảo cho việc sử dụng — một nhà phát triển có thể lấy nhiều mô hình và số lượng triển khai sản xuất là vô hình — nhưng chúng vẫn là thước đo tiêu chuẩn của ngành cho lực kéo trọng lượng mở. Đặc biệt, lượt tải xuống Ôm sát đã trở thành một tiêu chuẩn mà chính Meta đã trích dẫn khi Llama thống trị danh mục này, khiến việc Qwen vượt qua nó về mặt biểu tượng khó có thể bị bác bỏ.
Bản phát hành Qwen 3.8 thúc đẩy sự đột biến
Theo The Decode, cột mốc quan trọng mới nhất đạt được chỉ vài ngày sau khi nhóm Qwen của Alibaba phát hành phiên bản mở rộng cho Qwen 3.8 theo giấy phép Apache 2.0.
Bản phát hành cốt lõi, Qwen3.8-27B, là một mô hình dày đặc đa phương thức với 27 tỷ tham số mà Qwen cho biết vượt trội so với Qwen3.7-Plus lớn hơn về mã hóa và các tác vụ văn phòng. Nhóm nhấn mạnh những khả năng được cải thiện của tổng đài viên, với mô hình lập kế hoạch độc lập hơn và hoàn thành nhiệm vụ một cách đáng tin cậy hơn. Về cơ bản, nó xử lý tới 262.000 mã thông báo ngữ cảnh và có thể mở rộng quy mô lên một triệu bằng phương pháp YaRN, đồng thời xử lý hình ảnh và video — bao gồm sơ đồ, tài liệu và cảnh quay dài nhiều giờ. Chế độ tư duy linh hoạt được bật theo mặc định nhưng có thể được bật/tắt cho mỗi truy vấn.
Alibaba cũng đã vận chuyển trọng lượng cho Qwen3.8-2.4T-A95B lớn hơn nhiều, một mẫu thưa thớt được chế tạo để hoạt động ở cấp Max mà công ty đã định vị để chống lại các đối thủ cạnh tranh biên giới. Cả hai mô hình đều có sẵn trên Hugging Face và ModelScope, đồng thời một phiên bản được lưu trữ với một triệu mã thông báo bối cảnh sẽ có mặt trên Qwen Cloud, dịch vụ AI của Alibaba.
Mô hình Max-tier mở rộng phạm vi tiếp cận của gia đình đến lãnh thổ biên giới. Theo phạm vi đưa tin của The Decode, Qwen3.8-Max trọng lượng mở là một hệ thống có 2,4 nghìn tỷ tham số được thiết kế cho các nhiệm vụ AI có tầm nhìn dài và Alibaba đã định vị nó là đối thủ của các mô hình hàng đầu của phương Tây, bao gồm cả Claude của Anthropic. Việc phát hành quả cân ở quy mô đó theo giấy phép cho phép là điều chưa từng có: cho đến gần đây, các mô hình thuộc loại nghìn tỷ thông số là tài sản độc quyền của một số phòng thí nghiệm ở Mỹ.
Từ trọng lượng miễn phí đến trọng lượng trả phí
Kỷ lục tải xuống không có nghĩa là Alibaba đang cho đi mọi thứ. Công ty đã báo hiệu rằng những người sử dụng quy mô lớn các mẫu Qwen trong tương lai sẽ phải đối mặt với các cáo buộc và các bản phát hành hàng đầu của họ ngày càng kết hợp trọng lượng mở với các dịch vụ lưu trữ phải trả phí - một cuốn sách coi tính mở là phân phối hơn là từ thiện.
Chiến lược đó nằm trong bối cảnh rộng lớn hơn. Một phân tích của Đại học Stanford cho thấy Trung Quốc đã dẫn đầu toàn cầu về phát triển AI trọng lượng mở trong năm 2025, với các mô hình của Trung Quốc chiếm tỷ lệ ngày càng tăng trong các bản phát hành hiệu suất cao nhất được phát hành với trọng lượng có thể tải xuống. 3 tỷ lượt tải xuống của Qwen là bằng chứng rõ ràng nhất cho sự thay đổi đó.
Tại sao Meta và Google mất vị trí dẫn đầu
Meta đã đi tiên phong trong phong trào trọng lượng mở hiện đại với Llama vào năm 2023, nhưng cam kết của nó đã dao động khi công ty theo đuổi các mô hình khép kín quy mô biên giới. Trong khi đó, Google phát hành các mô hình Gemma như những người bạn đồng hành chắt lọc cho Gemini hơn là chiến lược chính của mình. Cả hai đều không phù hợp với nhịp độ của Qwen - nhóm của Alibaba vận chuyển các dòng sản phẩm và quy mô kiểu mẫu mới với tốc độ giúp hệ sinh thái luôn được làm mới.
Alibaba cũng được hưởng lợi từ việc phân phối mà hầu hết các phòng thí nghiệm phương Tây đều thiếu. Người mẫu Qwen được xuất xưởng không chỉ thông qua Hugging Face mà còn thông qua ModelScope, trung tâm người mẫu của riêng Alibaba, thống trị ở Trung Quốc và trên khắp cộng đồng nhà phát triển Đông Nam Á. Mỗi bản phát hành đều đi kèm với các tinh chỉnh sẵn sàng chạy, các biến thể lượng tử hóa và tài liệu bằng nhiều ngôn ngữ, giảm bớt rào cản tiếp nhận ở các thị trường nơi Meta và Google có nguồn gốc mỏng hơn.
Đối với các nhà phát triển, tính toán này mang tính thực dụng: các mô hình có khả năng tải xuống mở rộng nhất hiện nay đều đến từ một công ty Trung Quốc, và việc cấp phép theo Apache 2.0 khiến cho việc sử dụng thương mại trở nên đơn giản. Đối với các nhà hoạch định chính sách ở Washington và Brussels, cột mốc quan trọng của Qwen có thể sẽ làm gia tăng các cuộc tranh luận về việc liệu việc hạn chế các mô hình trọng lượng mở của Trung Quốc có khả thi hay không khi chúng đã nắm giữ rất nhiều sự phát triển AI ở hạ nguồn của thế giới.
Đi trước AI Đọc thêm tin tức về AI →