Phòng thí nghiệm trí tuệ nhân tạo Trung Quốc DeepSeek đã phát hành V4-Flash "0731" vào ngày 31 tháng 7 năm 2026, một phiên bản được đào tạo lại của mô hình ngân sách gần như phù hợp với GPT-5.6 Luna của OpenAI trên điểm chuẩn của bên thứ ba với chi phí thấp hơn khoảng 60%. Bản phát hành đưa API beta công khai của mô hình vào trạng thái sẵn sàng rộng rãi, là loạt đạn mới nhất trong cuộc chiến giá cả ngày càng gay gắt giữa các nhà cung cấp trọng lượng mở của Trung Quốc và các phòng thí nghiệm biên giới phương Tây. Để biết thông tin liên tục về các cuộc chiến tranh kiểu mẫu, hãy xem tin tức AI mới nhất của chúng tôi.

Theo The Decoding, phiên bản mới đạt 50 điểm về Chỉ số trí tuệ phân tích nhân tạo - tăng 10 điểm so với V4-Flash trước đó ra mắt vào tháng 4 năm 2026. Điều đó khiến nó chỉ kém GPT-5.6 Luna cấp ngân sách của OpenAI một điểm, mặc dù chi phí cho mỗi tác vụ thấp hơn khoảng 60%, ngay cả sau khi OpenAI giảm giá 80% gần đây.

Được xây dựng cho công việc đại lý

Lợi ích lớn nhất đến từ các nhiệm vụ tác nhân, khả năng tự động hoàn thành công việc trong thế giới thực gồm nhiều bước. TechNode báo cáo rằng mô hình đạt điểm 82,7 trên Terminal Bench 2.1 và 54,4 trên DeepSWE, hai điểm chuẩn được thiết kế để đo lường mức độ AI có thể sử dụng các công cụ, viết mã và giải quyết các vấn đề kỹ thuật mà không cần cầm tay.

Trên GDPval, một điểm chuẩn kiểm tra các mô hình về công việc văn phòng phức tạp, V4-Flash đã tăng từ 1.189 lên 1.559 điểm Elo. DeepSeek cũng cho biết mô hình này ít gây ảo giác hơn so với phiên bản tiền nhiệm và sử dụng ít token hơn khoảng 12% để hoàn thành các nhiệm vụ tương tự.

Kiến trúc giống nhau, trọng lượng thông minh hơn

Bản nâng cấp giữ nguyên cấu trúc cơ bản: tổng cộng 284 tỷ tham số với 13 tỷ hoạt động cùng một lúc và cửa sổ ngữ cảnh một triệu mã thông báo. Thay vì mở rộng mô hình, DeepSeek đã đào tạo lại mô hình đó — đạt được hiệu suất cao hơn trên cùng một phạm vi hoạt động. Trọng lượng mô hình được phát hành theo giấy phép MIT cho phép trên Ôm mặt, tiếp tục phương pháp tiếp cận trọng lượng mở của DeepSeek.

DeepSeek đã cẩn thận trong phạm vi phát hành. Bản cập nhật chỉ áp dụng cho API V4-Flash; API V4-Pro cấp cao hơn và các mô hình được cung cấp thông qua ứng dụng và trang web dành cho người tiêu dùng của DeepSeek vẫn không thay đổi. API Flash mới cũng bổ sung hỗ trợ cho API phản hồi và được điều chỉnh để sử dụng với Codex, mở rộng sức hấp dẫn của nó đối với các nhà phát triển xây dựng tác nhân mã hóa.

Lợi thế giảm giá bộ nhớ đệm

Một phần đáng kể lợi thế về chi phí của DeepSeek đến từ cơ chế định giá của nó. Công ty đưa ra mức chiết khấu 98% cho bộ nhớ đệm — cao hơn nhiều so với mức 90% tiêu chuẩn ngành — có nghĩa là các phần yêu cầu lặp lại hoặc có thể dự đoán được sẽ được tính phí ở mức chỉ bằng một phần nhỏ so với mức bình thường. Kết hợp với ít mã thông báo hơn cho mỗi nhiệm vụ, chi phí hiệu quả cho nhiều khối lượng công việc sẽ giảm đáng kể.

Cơ cấu giá đó là thách thức trực tiếp đối với OpenAI, vốn đang giảm giá để bảo vệ thị phần. Kết quả là một thị trường mà chất lượng gần biên giới đang trở thành một mặt hàng và sự cạnh tranh ngày càng được quyết định bởi hiệu quả cơ sở hạ tầng và kinh tế đơn vị hơn là năng lực thô.

Cuộc chiến giá cả không có sàn

Việc phát hành này tăng cường những gì các nhà phân tích hiện mô tả là một cuộc chiến giá cả toàn diện. OpenAI đã giảm 80% giá GPT-5.6 Luna để bảo vệ cơ sở nhà phát triển của mình, chỉ để DeepSeek trả lời bằng một mô hình có khả năng tương đương và vẫn rẻ hơn nhiều. Mỗi vòng sẽ đẩy chi phí hiệu quả của trí thông minh cận biên xuống thấp hơn và khoảng cách giữa các mẫu có khả năng rẻ nhất và đắt nhất ngày càng thu hẹp.

Sự năng động là không bình thường trong phần mềm. Ở hầu hết các thị trường, lợi thế chi phí 60% với chất lượng gần như tương đương sẽ nhanh chóng chiếm được thị phần. Ở đây, lợi thế đang được so khớp và tái so khớp trong vòng vài tuần, khiến các nhà phát triển có bảng xếp hạng liên tục thay đổi. Tính chẵn lẻ của điểm chuẩn, từng là khu vực độc quyền của các phòng thí nghiệm biên giới, ngày càng có sẵn từ những người thách thức trọng lượng mở sẵn sàng công bố cả trọng lượng và giá cả của họ.

Ý nghĩa của nó đối với nhà phát triển

Đối với các nhà phát triển, ý nghĩa thực tế rất rõ ràng: các mô hình tác nhân có khả năng đang nhanh chóng rẻ hơn. Một mô hình có thể tự động điều hướng thiết bị đầu cuối, viết và gỡ lỗi mã cũng như xử lý các tác vụ văn phòng phức tạp — tất cả chỉ với một phần trăm cho mỗi yêu cầu — sẽ thay đổi tính kinh tế của việc xây dựng các sản phẩm hỗ trợ AI.

Bản phát hành phiên bản mở cũng có nghĩa là các nhóm có thể chạy mô hình trên phần cứng của riêng họ, tránh hoàn toàn phí API trên mỗi mã thông báo đối với khối lượng công việc nhạy cảm. Khi DeepSeek, OpenAI và những công ty khác tiếp tục cạnh tranh về giá cả và hiệu suất, người chiến thắng là những nhà xây dựng hiện có danh sách ngày càng tăng các mô hình có khả năng, giá cả phải chăng để lựa chọn.

Đi trước đường cong AI

Bối cảnh trí tuệ nhân tạo đang chuyển động nhanh hơn bao giờ hết và các công ty theo dõi những thay đổi này sớm sẽ đạt được lợi thế lâu dài. Để biết thông tin liên tục, được kiểm tra nguồn về các bản phát hành mô hình, các vòng tài trợ và các động thái chính sách, hãy theo dõi tin tức AI mới nhất của chúng tôi.

Đọc thêm tin tức về AI →