DeepSeek, phòng thí nghiệm trí tuệ nhân tạo của Trung Quốc đã làm rung chuyển Thung lũng Silicon với các mô hình giá rẻ, đã phát hành bản beta công khai chính thức của mô hình V4-Flash, tăng cường cuộc chiến giá cả toàn cầu về AI tiên tiến và tuyên bố một bước nhảy vọt lớn về khả năng tác nhân.

API V4-Flash được cung cấp công khai vào ngày 1 tháng 8 năm 2026, theo Nikkei AsiaBloomberg. Bản phát hành này diễn ra sau nhiều tháng lặp lại trên dòng V4, ra mắt lần đầu tiên vào tháng 4 năm 2026 và nhanh chóng đưa DeepSeek trở thành đối thủ cạnh tranh nặng ký với các phòng thí nghiệm tiên phong của phương Tây. Để theo dõi bối cảnh mô hình AI đang chuyển động nhanh chóng, hãy theo dõi tin tức mới nhất của chúng tôi.

Một mô hình được đào tạo lại đánh bại Flagship của chính nó

Theo báo cáo từ Tech Times, bản phát hành V4-Flash không chỉ đơn giản là phiên bản nhẹ hơn của các mẫu hiện có của DeepSeek. V4-Flash đã được đào tạo lại được cho là đánh bại V4 Pro hàng đầu của công ty trên chín điểm chuẩn đại lý riêng biệt, đánh dấu bước nhảy vọt về năng lực đáng kể đối với mẫu được thiết kế như một mẫu nhanh hơn, hiệu quả hơn.

Việc nhấn mạnh vào hiệu quả hoạt động của đại lý phản ánh sự thay đổi trong phạm vi rộng hơn của ngành. Trong khi các điểm chuẩn từng tập trung vào kiến ​​thức và lý luận, thì phương pháp đánh giá AI tiên tiến đã chuyển sang các nhiệm vụ tác nhân—quy trình làm việc gồm nhiều bước trong đó mô hình phải lập kế hoạch, sử dụng công cụ và thích ứng với các kết quả không mong đợi. Tuyên bố của DeepSeek rằng V4-Flash hoạt động tốt hơn mẫu đắt nhất của họ về các số liệu này thách thức giả định rằng càng lớn thì càng tốt.

Định giá thấp hơn đối thủ Hoa Kỳ

Định giá của DeepSeek đã trở thành vũ khí đặc trưng của công ty kể từ khi nó bùng nổ trên phạm vi toàn cầu. Nikkei Asia báo cáo rằng các kế hoạch định giá của DeepSeek vẫn rẻ hơn nhiều so với các đối thủ của Hoa Kỳ, một chiến lược đã buộc OpenAI, Google và Anthropic phải liên tục cắt giảm giá API của riêng họ để duy trì tính cạnh tranh.

Bản phát hành mới cũng sẽ giới thiệu kế hoạch định giá giờ cao điểm, một động thái báo hiệu DeepSeek đang hoàn thiện mô hình thương mại của mình vượt xa mức giá thấp nhất đơn giản. Định giá vào giờ cao điểm—tính phí nhiều hơn trong thời gian có nhu cầu cao nhất—là tiêu chuẩn của các nhà cung cấp đám mây nhưng lại tương đối mới đối với API mô hình AI và điều đó cho thấy DeepSeek đang quản lý khối lượng điện toán khổng lồ đi kèm với nhu cầu toàn cầu ngày càng tăng.

Gia đình V4: Dòng thời gian của sự đột phá

Bản phát hành V4-Flash giới hạn bốn tháng đáng chú ý đối với dòng sản phẩm V4 của DeepSeek:

  • Tháng 4 năm 2026: DeepSeek-V4 ra mắt, cung cấp thông tin gần như tiên tiến nhất với chi phí chỉ bằng một phần nhỏ so với GPT-5.5 của OpenAI và Opus 4.7 của Anthropic, theo báo cáo của VentureBeat.
  • Tháng 5 năm 2026: DeepSeek V4 Pro được giảm giá 75%, đứng đầu bảng xếp hạng đáng giá toàn cầu.
  • Tháng 5 năm 2026: V4 Flash đứng đầu trong các thử nghiệm AI mù, đánh bại các mẫu đắt tiền hơn trong các so sánh trực tiếp giữa người dùng.
  • Tháng 8 năm 2026: V4-Flash được đào tạo lại ra mắt dưới dạng API beta công khai, đánh bại V4 Pro trên chín điểm chuẩn của tác nhân.

Tại sao điều này lại quan trọng đối với thị trường AI toàn cầu

Bản phát hành DeepSeek V4-Flash đến vào thời điểm then chốt trong cuộc đua AI toàn cầu. Các mẫu xe của Trung Quốc đã thu hẹp khoảng cách về năng lực với các mẫu xe tiên phong của phương Tây với tốc độ vượt trội và DeepSeek đã đi đầu trong nỗ lực đó.

Việc ra mắt cũng diễn ra trong bối cảnh cuộc tranh luận chính sách gay gắt ở Washington. Một số nhà lập pháp và quan chức Hoa Kỳ đã thúc đẩy các hạn chế hoặc cấm hoàn toàn đối với các mô hình AI của Trung Quốc, với lý do lo ngại về an ninh quốc gia. Những người khác, bao gồm cả những nhân vật nổi tiếng ở Thung lũng Silicon, lập luận rằng việc cấm các mẫu xe cỡ lớn của Trung Quốc có thể gây tác dụng ngược – kìm hãm sự đổi mới trong nước trong khi không giải quyết được những rủi ro thực sự. Nvidia và các nhà lãnh đạo công nghệ khác đã công khai phản đối lệnh cấm được đề xuất.

Khả năng của DeepSeek trong việc phát hành các mô hình phù hợp hoặc vượt quá hiệu suất của phương Tây với chi phí thấp chính xác là điều khiến cuộc tranh luận này trở nên có hậu quả. Nếu V4-Flash có thể đánh bại các mẫu hàng đầu về điểm chuẩn của đại lý trong khi có chi phí thấp hơn thì áp lực cạnh tranh đối với các phòng thí nghiệm của Hoa Kỳ sẽ chỉ tăng lên.

Chiến lược trọng lượng mở tăng cường tác động

Yếu tố then chốt tạo nên sức ảnh hưởng trên thị trường của DeepSeek là cách tiếp cận trọng lượng mở của nó. Không giống như nhiều mô hình biên giới phương Tây chỉ có sẵn thông qua API độc quyền, DeepSeek trước đây đã phát hành trọng số mô hình mà các nhà phát triển có thể tải xuống, nghiên cứu và chạy trên cơ sở hạ tầng của riêng họ. Điều này đã làm cho các mô hình DeepSeek trở nên đặc biệt phổ biến đối với các nhà phát triển, nhà nghiên cứu và công ty khởi nghiệp quan tâm đến chi phí muốn tránh sự ràng buộc của nhà cung cấp.

Bản beta V4-Flash tiếp tục chiến lược này, giúp mô hình tác nhân hiệu suất cao có thể tiếp cận được với khán giả toàn cầu với chi phí tối thiểu. Đối với cộng đồng nguồn mở, sự sẵn có của các mô hình trọng lượng mở có khả năng từ Trung Quốc đã đẩy nhanh quá trình nghiên cứu và triển khai độc lập theo những cách mà các mô hình đóng không thể sánh được.

Tuy nhiên, sự cởi mở này cũng đã thúc đẩy cuộc tranh luận về an ninh quốc gia. Các cơ quan tình báo Hoa Kỳ đã bày tỏ lo ngại về khả năng lạm dụng các mẫu xe có trọng lượng mở mạnh mẽ và một số quan chức đã tìm hiểu các hạn chế trong việc phân phối chúng. Sự căng thẳng giữa tính cởi mở và an ninh có thể sẽ xác định giai đoạn tiếp theo của chính sách AI ở cả hai bờ Thái Bình Dương.

Động lực định giá rộng hơn

Động thái định giá rộng hơn không có dấu hiệu giảm bớt. OpenAI gần đây đã giảm giá cho các mẫu GPT-5.6 của mình khi các công ty ngày càng nhạy cảm hơn với chi phí AI. Với việc DeepSeek hiện đang đẩy mức sàn thậm chí còn thấp hơn trong khi nâng mức trần hiệu suất, câu hỏi không còn là liệu AI Trung Quốc có thể cạnh tranh hay không mà là các công ty phương Tây có thể thích ứng nhanh như thế nào với một thị trường mà giá cao có thể không còn bền vững nữa.

Đối với các nhà phát triển và doanh nghiệp, phiên bản beta V4-Flash mang đến cơ hội thử nghiệm một mô hình hứa hẹn mang lại hiệu suất cho đại lý cấp biên với mức giá phù hợp với ngân sách. API công khai hiện có sẵn để đánh giá.

Đi trước AI

Cuộc đua mô hình AI đang diễn ra nhanh hơn bao giờ hết. Cập nhật mọi thông tin phát hành lớn và sự thay đổi của thị trường thông qua tin tức về ngành AI của chúng tôi.

Đọc thêm tin tức về AI →