DeepSeek wis nganyari lineup API karo model kapal penggedhe anyar, V4 Pro, nalika mundhakaken prices banget ing platform sawijining - giliran nemtokake adoh saka strategi reregan rock-bottom sing nggawe lab Cina misuwur lan meksa saingan menyang perang rega. Kanggo industri sing wis nglacak saben potongan rega DeepSeek minangka acara obah pasar, pembalikan kasebut uga penting. Tindakake jangkoan warta AI kita kanggo paling anyar ing pasar model.
Dokumentasi API resmi perusahaan, sing dianyari minggu iki, saiki nampilake rong model: deepseek-v4-flash, nganggo versi DeepSeek-V4-Flash-0731, lan deepseek-v4-pro, sing nganggo DeepSeek-V4-Pro-0813 mbangun anyar. Loro-lorone nawakake jendhela konteks 1 yuta token, nganti 384.000 token saka output maksimal, lan mode dual thinking lan non-think, lan loro-lorone bisa digunakake minangka model backend ing piranti agen kayata Claude Code, GitHub Copilot, lan OpenCode. DeepSeek uga ngirim pratinjau pangembang "DeepSeek Harness," toolkit kanggo pangembang agen. For more context on this story, see our ongoing latest AI developments.
Apa V4 Pro Biaya
Kapal penggedhe anyar nggawa persis kaping telu rega Flash ing saben tingkat, miturut rega sing diterbitake DeepSeek. Saben 1 yuta token, V4 Pro nyathet $ 0,022 kanggo token input cache lan $ 0,66 kanggo input non-cache ing jam sibuk, lan $ 1,98 saben 1 yuta token output. Ing puncak, angka kasebut tikel kaping pindho dadi $0,044, $1,32, lan $3,96. V4 Flash, dening comparison, dhaptar ing $ 0,007 / $ 0,014 kanggo cache hits, $ 0,22 / $ 0,44 kanggo cache miss, lan $ 0,66 / $ 1,32 kanggo output.
Jam sibuk ditetepake minangka 01:00–04:00 lan 06:00–10:00 UTC, kanthi tarif mati-puncak disetel persis setengah saka puncak. Concurrency uga berjenjang: Pelanggan Flash entuk 2,500 panjaluk bebarengan, dene akun Pro diwatesi 500.
Rega Nganti Tikel Sepuluh
Bukak tutup seminggu nalika transformasi rega DeepSeek dadi ora bisa dilalekake. Wall Street Journal nglaporake tanggal 14 Agustus yen DeepSeek wis ngangkat rega model AI kira-kira kaping papat. InfoWorld nglaporake dina sing padha yen sawetara rega V4 mundhak luwih saka 10 kaping, nyatakake permintaan AI sing nyuda kapasitas perusahaan. Engadget marang nonton model "kira-kira regane kaping papat luwih."
Ing tanggal 17 Agustus, Tech Times nglaporake manawa rega API V4 saiki tikel kaping papat ing jam-jam sibuk, dene Seoul Economic Daily Korea Selatan ndadekake kenaikan paling dhuwur nganti 12 kali lipat lan nggawe gerakan kasebut nalika balapan AI China dadi bathi. Global Times sing ana hubungane karo negara China nggambarake kenaikan kasebut minangka bagean saka dorongan kanggo "komersialisasi sing luwih sehat" - sinyal yen Beijing ndeleng ekonomi unit sing lestari, ora mung pangsa pasar, minangka prioritas kanggo juara AI.
Saka Senjata Perang Rega nganti Produk Premium
Owah-owahan strategi pancen angel banget. DeepSeek mbangun reputasi global babagan rega sing agresif: ing pungkasan Juli, model V4 Flash sing mentas diluncurake wis ditandhani sing cocog karo OpenAI's GPT-5.6 Luna kanthi biaya sing luwih murah 60%, nyepetake balapan menyang ngisor sing nyepetake saben panyedhiya API. Saiki lab sing padha ngisi tarif premium - rega output puncak V4 Pro $ 3.96 saben yuta token luwih dhuwur tinimbang sing biasa dibayar dening pelanggan jaman Flash.
Introduksi saka puncak lan off-puncak windows dhewe minangka alat manajemen kapasitas. Ngisi daya kaping pindho sajrone jam paling sibuk - lan ngethok konkurensi kanggo model premium - ngidini DeepSeek ngetung beban kerja kanthi margin sing luwih dhuwur, buku pedoman sing dikenal saka panyedhiya awan lan pasar listrik.
Portofolio Two-Tier kanggo Era Agen
Pemisahan ing antarane rong model kasebut dirancang kanggo para panuku sing beda. Lampu kilat, kanthi watesan konkurensi 2,500 panjaluk lan rega paling sithik cache-hit, dipanggonke kanggo lalu lintas produksi volume dhuwur lan aplikasi sing sensitif biaya. Pro, kanthi 500 panjaluk bebarengan lan regane kaping telu, target beban kerja sing abot banget ing ngendi jendela konteks 1 yuta token lan langit-langit output 384,000 token - sesi agen sing dawa, analisis basis kode gedhe, lan pipa sing akeh dokumen.
DeepSeek uga pacaran karo pangembang sing wis kerja. Loro-lorone model bisa digunakake langsung minangka backends nang Claude Code, GitHub Copilot, lan OpenCode, lan API ngandika loro OpenAI- lan format kompatibel Anthropic - tegese migrasi saka panyedhiya Western bisa dadi owah-owahan konfigurasi siji-baris. Pratinjau pangembang "DeepSeek Harness" sing anyar ngluwihi strategi kasebut kanggo para pembangun agen.
Apa Tegese kanggo Pangembang
Kanggo pangembang sing nggawe aplikasi sing sensitif biaya kanthi asumsi yen DeepSeek bakal dadi pilihan tawar-menawar, pesen kasebut yaiku jaman rega token sing terus-terusan mudhun, paling ora ing laboratorium Cina. Arsitèktur sing ramah cache saiki mbayar tingkat input 30x luwih murah tinimbang telpon cache-miss ing loro model, nggawe disiplin cepet-caching adoh luwih larang tinimbang pilihan model. Lan kanggo pasar sing luwih jembar, pivot DeepSeek mbusak panyetel rega sing paling agresif saka lantai pasar - hadiah sing sepi kanggo OpenAI, Anthropic, lan Google, sing wis saingan kanthi biaya saingan kabeh taun.
Apa pathokan V4 Pro mbenerake premium tetep kudu diuji dening evaluator independen. Sing wis jelas yaiku logika bisnis: sawise rong taun menehi subsidi kanggo panggunaan AI ing saindenging jagad, DeepSeek pengin dibayar.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →