DeepSeek đã cập nhật dòng API của mình với mẫu hàng đầu mới, V4 Pro, đồng thời tăng giá mạnh trên nền tảng của mình - một bước đi quyết định từ bỏ chiến lược định giá đáy đã khiến phòng thí nghiệm Trung Quốc nổi tiếng và buộc các đối thủ phải tham gia cuộc chiến về giá. Đối với một ngành luôn theo dõi mọi đợt giảm giá của DeepSeek như một sự kiện khiến thị trường chuyển động, thì sự đảo chiều cũng quan trọng không kém. Theo dõi tin tức AI của chúng tôi để biết thông tin mới nhất về thị trường mô hình.
Tài liệu API chính thức của công ty, được cập nhật trong tuần này, hiện liệt kê hai mẫu: deepseek-v4-flash, chạy phiên bản DeepSeek-V4-Flash-0731 và deepseek-v4-pro, chạy bản dựng DeepSeek-V4-Pro-0813 mới. Cả hai đều cung cấp cửa sổ ngữ cảnh 1 triệu mã thông báo, sản lượng tối đa lên tới 384.000 mã thông báo cũng như chế độ suy nghĩ kép và không suy nghĩ, đồng thời cả hai đều có thể được sử dụng làm mô hình phụ trợ bên trong các công cụ tác nhân như Claude Code, GitHub Copilot và OpenCode. DeepSeek cũng đang gửi bản xem trước dành cho nhà phát triển của "DeepSeek Harness", bộ công cụ dành cho các nhà phát triển đại lý. For more context on this story, see our ongoing AI industry coverage.
Giá V4 Pro bao nhiêu
Flagship mới có giá chính xác gấp ba lần Flash ở mọi cấp độ, theo giá công bố của DeepSeek. Trên 1 triệu mã thông báo, V4 Pro niêm yết ở mức 0,022 USD cho mã thông báo đầu vào được lưu trong bộ nhớ đệm và 0,66 USD cho đầu vào không được lưu vào bộ nhớ đệm trong giờ thấp điểm và 1,98 USD cho mỗi 1 triệu mã thông báo đầu ra. Vào lúc cao điểm, những con số đó tăng gấp đôi lên 0,044 USD, 1,32 USD và 3,96 USD. Bằng cách so sánh, V4 Flash liệt kê ở mức 0,007 USD/0,014 USD cho các lần truy cập bộ nhớ đệm, 0,22 USD/0,44 USD cho các lần truy cập bộ nhớ đệm và 0,66 USD/1,32 USD cho đầu ra.
Giờ cao điểm được xác định là 01:00–04:00 và 06:00–10:00 UTC, với giá cước ngoài giờ cao điểm được đặt chính xác bằng một nửa so với giờ cao điểm. Tính đồng thời cũng được phân cấp: Khách hàng Flash nhận được 2.500 yêu cầu đồng thời, trong khi tài khoản Pro bị giới hạn ở mức 500.
Giá tăng gấp 10 lần
Thời gian ra mắt kéo dài một tuần, trong đó không thể bỏ lỡ sự chuyển đổi về giá của DeepSeek. Tạp chí Phố Wall đưa tin vào ngày 14 tháng 8 rằng DeepSeek đã nâng giá mô hình AI lên khoảng bốn lần. InfoWorld cùng ngày đưa tin rằng một số giá V4 đã tăng hơn 10 lần, do nhu cầu về AI đang làm căng thẳng năng lực của công ty. Engadget nói với độc giả rằng các mô hình này “có giá gấp bốn lần”.
Đến ngày 17 tháng 8, Tech Times đưa tin rằng giá API V4 hiện tăng gấp 4 lần vào giờ cao điểm, trong khi Nhật báo Kinh tế Seoul của Hàn Quốc đưa ra mức tăng mạnh nhất lên tới 12 lần và cho rằng động thái này khi cuộc đua AI của Trung Quốc chuyển sang thu lợi nhuận. Tờ Global Times của nhà nước Trung Quốc mô tả việc tăng vọt này là một phần trong nỗ lực thúc đẩy "thương mại hóa lành mạnh hơn" - một tín hiệu cho thấy Bắc Kinh coi kinh tế đơn vị bền vững, không chỉ thị phần, là ưu tiên hàng đầu của các nhà vô địch AI của mình.
Từ vũ khí chiến giá đến sản phẩm cao cấp
Sự thay đổi chiến lược là rõ ràng. DeepSeek đã xây dựng danh tiếng toàn cầu của mình nhờ mức giá hấp dẫn: vào cuối tháng 7, mẫu V4 Flash mới phát hành của họ đã được đánh giá chuẩn ngang hàng với GPT-5.6 Luna của OpenAI với chi phí thấp hơn 60%, đẩy nhanh cuộc đua xuống đáy siết chặt mọi nhà cung cấp API. Giờ đây, phòng thí nghiệm tương tự đang tính phí cao cấp - mức giá đầu ra cao nhất của V4 Pro là 3,96 USD trên một triệu mã thông báo cao hơn nhiều so với mức giá mà khách hàng thời Flash đã quen trả.
Việc giới thiệu các cửa sổ cao điểm và thấp điểm bản thân nó là một công cụ quản lý năng lực. Tính phí gấp đôi trong những giờ bận rộn nhất — và cắt giảm đồng thời cho mô hình cao cấp — cho phép khẩu phần DeepSeek tính toán cho khối lượng công việc có lợi nhuận cao hơn, một cẩm nang quen thuộc với các nhà cung cấp đám mây và thị trường điện.
Danh mục đầu tư hai cấp cho kỷ nguyên đại lý
Sự phân chia giữa hai mô hình được thiết kế cho những người mua khác nhau. Flash, với giới hạn đồng thời 2.500 yêu cầu và mức giá truy cập bộ đệm tối thiểu, được định vị cho lưu lượng sản xuất khối lượng lớn và các ứng dụng nhạy cảm với chi phí. Pro, với 500 yêu cầu đồng thời và mức giá gấp ba lần, nhắm mục tiêu khối lượng công việc nặng về lý luận trong đó cửa sổ ngữ cảnh 1 triệu mã thông báo và mức trần đầu ra là 384.000 mã thông báo — các phiên tác nhân dài, phân tích cơ sở mã lớn và quy trình xử lý nhiều tài liệu.
DeepSeek cũng đang thu hút các nhà phát triển ở nơi họ đang làm việc. Cả hai mô hình đều có thể sử dụng trực tiếp dưới dạng phụ trợ bên trong Claude Code, GitHub Copilot và OpenCode, đồng thời API hỗ trợ cả định dạng tương thích với OpenAI và Anthropic - nghĩa là việc di chuyển từ các nhà cung cấp phương Tây có thể là một thay đổi cấu hình một dòng. Bản xem trước mới dành cho nhà phát triển "Khai thác DeepSeek" mở rộng chiến lược đó cho các nhà xây dựng khai thác đại lý.
Ý nghĩa của nó đối với nhà phát triển
Đối với các nhà phát triển xây dựng các ứng dụng nhạy cảm với chi phí với giả định rằng DeepSeek sẽ luôn là lựa chọn hời, thông điệp đưa ra là kỷ nguyên giá token giảm không ngừng đã qua, ít nhất là tại phòng thí nghiệm Trung Quốc. Kiến trúc thân thiện với bộ đệm hiện trả tốc độ đầu vào thấp hơn 30 lần so với lệnh gọi lỗi bộ nhớ đệm trên cả hai mô hình, khiến kỷ luật nhắc nhở về bộ đệm có giá trị hơn nhiều so với lựa chọn mô hình. Và đối với thị trường rộng lớn hơn, trục xoay của DeepSeek loại bỏ người định giá tích cực nhất khỏi sàn thị trường - một món quà thầm lặng dành cho OpenAI, Anthropic và Google, những người đã cạnh tranh về chi phí cũng như năng lực trong suốt cả năm.
Liệu điểm chuẩn của V4 Pro có phù hợp với mức cao cấp hay không vẫn còn phải được kiểm tra bởi các nhà đánh giá độc lập. Điều đã rõ ràng là logic kinh doanh: sau hai năm trợ cấp cho việc sử dụng AI của thế giới, DeepSeek muốn được trả tiền cho việc đó.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →