DeepSeek telah mengemas kini barisan APInya dengan model perdana baharu, V4 Pro, sambil menaikkan harga secara mendadak di seluruh platformnya — perubahan yang tegas daripada strategi penentuan harga paling rendah yang menjadikan makmal China terkenal dan memaksa saingan ke dalam perang harga. Untuk industri yang telah menjejaki setiap potongan harga DeepSeek sebagai peristiwa yang menggerakkan pasaran, pembalikan itu sama pentingnya. Ikuti liputan berita AI kami untuk maklumat terkini mengenai pasaran model.

Dokumentasi API rasmi syarikat, yang dikemas kini minggu ini, kini menyenaraikan dua model: deepseek-v4-flash, menjalankan versi DeepSeek-V4-Flash-0731 dan deepseek-v4-pro, menjalankan binaan DeepSeek-V4-Pro-0813 baharu. Kedua-duanya menawarkan tetingkap konteks 1 juta token, sehingga 384,000 token keluaran maksimum, dan mod pemikiran dan bukan pemikiran dwi, ​​dan kedua-duanya boleh digunakan sebagai model bahagian belakang dalam alatan ejen seperti Kod Claude, Copilot GitHub dan OpenCode. DeepSeek juga menghantar pratonton pembangun "DeepSeek Harness," kit alat untuk pembangun ejen. For more context on this story, see our ongoing more AI stories.

Berapa Kos V4 Pro

Perdana baharu itu membawa tepat tiga kali ganda harga Flash pada setiap peringkat, menurut harga diterbitkan DeepSeek. Setiap 1 juta token, V4 Pro menyenaraikan pada $0.022 untuk token input cache dan $0.66 untuk input bukan cache pada waktu luar puncak dan $1.98 setiap 1 juta token output. Pada puncaknya, angka tersebut berganda kepada $0.044, $1.32 dan $3.96. V4 Flash, sebagai perbandingan, menyenaraikan pada $0.007/$0.014 untuk cache hits, $0.22/$0.44 untuk cache miss dan $0.66/$1.32 untuk output.

Waktu puncak ditakrifkan sebagai 01:00–04:00 dan 06:00–10:00 UTC, dengan kadar luar puncak ditetapkan tepat pada separuh daripada puncak. Concurrency juga berperingkat: Pelanggan Flash mendapat 2,500 permintaan serentak, manakala akaun Pro dihadkan pada 500.

Harga Naik Sepuluh Kali ganda

Pelancaran menghadkan seminggu di mana transformasi harga DeepSeek menjadi mustahil untuk terlepas. The Wall Street Journal melaporkan pada 14 Ogos bahawa DeepSeek telah menaikkan harga model AI kira-kira empat kali ganda. InfoWorld melaporkan pada hari yang sama bahawa beberapa harga V4 telah meningkat lebih daripada 10 kali ganda, memetik permintaan AI yang menekan kapasiti syarikat. Engadget memberitahu pembaca bahawa model itu "berharga empat kali lebih tinggi."

Menjelang 17 Ogos, Tech Times melaporkan bahawa harga API V4 kini meningkat empat kali ganda pada waktu puncak, manakala Seoul Economic Daily Korea Selatan meletakkan kenaikan paling mendadak sehingga 12 kali ganda dan merangka langkah itu apabila perlumbaan AI China bertukar kepada keuntungan. Global Times yang bersekutu dengan negara China menyifatkan kenaikan itu sebagai sebahagian daripada dorongan untuk "pengkomersilan yang lebih sihat" — isyarat bahawa Beijing melihat ekonomi unit yang mampan, bukan hanya bahagian pasaran, sebagai keutamaan untuk juara AInya.

Daripada Senjata Perang Harga kepada Produk Premium

Anjakan strategi adalah nyata. DeepSeek membina reputasi globalnya pada penetapan harga yang agresif: pada penghujung Julai, model V4 Flash yang baru dikeluarkan telah ditanda aras sepadan dengan GPT-5.6 Luna OpenAI pada kos 60% lebih rendah, mempercepatkan perlumbaan ke bawah yang memerah setiap penyedia API. Kini makmal yang sama mengenakan kadar premium — harga keluaran puncak V4 Pro sebanyak $3.96 setiap juta token berada jauh di atas yang biasa dibayar oleh pelanggan era Flash.

Pengenalan tingkap puncak dan luar puncak adalah alat pengurusan kapasiti. Mengecas dua kali ganda semasa waktu paling sibuk — dan memotong serentak untuk model premium — membolehkan DeepSeek mengira ke arah beban kerja margin yang lebih tinggi, buku main yang biasa daripada pembekal awan dan pasaran elektrik.

Portfolio Dua Peringkat untuk Era Ejen

Perpecahan antara kedua-dua model direka bentuk untuk pembeli yang berbeza. Flash, dengan had konkurensi 2,500 permintaan dan harga cache-hit minimum, diletakkan untuk trafik pengeluaran volum tinggi dan aplikasi sensitif kos. Pro, dengan 500 permintaan serentak dan tiga kali ganda harga, menyasarkan beban kerja yang berat beralasan di mana tetingkap konteks 1 juta token dan siling keluaran 384,000 token penting — sesi agen yang panjang, analisis pangkalan kod yang besar dan saluran paip yang berat dokumen.

DeepSeek juga meminati pembangun di mana mereka sudah bekerja. Kedua-dua model boleh digunakan secara langsung sebagai bahagian belakang dalam Claude Code, GitHub Copilot dan OpenCode, dan API bercakap dalam format yang serasi OpenAI dan Anthropic — bermakna migrasi daripada penyedia Barat boleh menjadi perubahan konfigurasi satu baris. Pratonton pembangun "DeepSeek Harness" baharu memanjangkan strategi itu kepada pembina memanfaatkan ejen.

Maksudnya untuk Pembangun

Bagi pembangun yang membina aplikasi sensitif kos dengan andaian bahawa DeepSeek akan sentiasa menjadi pilihan tawar-menawar, mesejnya ialah era kejatuhan harga token tanpa henti telah berakhir, sekurang-kurangnya di makmal Cina. Seni bina mesra cache kini membayar kadar input 30x lebih rendah daripada panggilan terlepas cache pada kedua-dua model, menjadikan disiplin cache segera jauh lebih berharga daripada pilihan model. Dan untuk pasaran yang lebih luas, pangsi DeepSeek mengalih keluar penetapan harga yang paling agresif dari lantai pasaran — hadiah yang tenang untuk OpenAI, Anthropic dan Google, yang telah bersaing dengan kos sebanyak keupayaan sepanjang tahun.

Sama ada penanda aras V4 Pro mewajarkan premium masih perlu diuji oleh penilai bebas. Apa yang sudah jelas ialah logik perniagaan: selepas dua tahun mensubsidi penggunaan AI dunia, DeepSeek mahu dibayar untuknya.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →