Makmal kecerdasan buatan China DeepSeek mengeluarkan V4-Flash "0731" pada 31 Julai 2026, versi terlatih semula model bajetnya yang hampir sepadan dengan GPT-5.6 Luna OpenAI pada penanda aras pihak ketiga pada kos kira-kira 60 peratus lebih rendah. Keluaran itu, yang meletakkan API beta awam model ke dalam ketersediaan umum, adalah salvo terkini dalam perang harga yang semakin sengit antara pembekal berat terbuka China dan makmal sempadan Barat. Untuk liputan berterusan tentang perang model, semak berita AI terkini kami.
Menurut The Decoder, versi baharu itu mendapat 50 mata pada Indeks Kecerdasan Analisis Buatan — lonjakan sepuluh mata berbanding V4-Flash sebelumnya yang dilancarkan pada April 2026. Itu meletakkannya hanya satu mata di belakang GPT-5.6 Luna peringkat bajet OpenAI, walaupun kosnya kurang 60 peratus bagi setiap tugas, walaupun selepas pemotongan harga OpenAI sebanyak 80 peratus baru-baru ini.
Dibina untuk Kerja Agen
Keuntungan terbesar datang dalam tugas agen, keupayaan untuk menyelesaikan kerja dunia nyata berbilang langkah secara autonomi. TechNode melaporkan bahawa model itu mendapat skor 82.7 pada Terminal Bench 2.1 dan 54.4 pada DeepSWE, dua penanda aras yang direka untuk mengukur sejauh mana AI boleh menggunakan alatan, menulis kod dan menyelesaikan masalah kejuruteraan tanpa memegang tangan.
Pada GDPval, penanda aras yang menguji model pada kerja pejabat yang kompleks, V4-Flash meningkat daripada 1,189 kepada 1,559 mata Elo. DeepSeek juga berkata model itu kurang kerap berhalusinasi berbanding pendahulunya dan menggunakan kira-kira 12 peratus lebih sedikit token untuk menyelesaikan tugas yang sama.
Seni Bina Sama, Pemberat Lebih Pintar
Peningkatan ini mengekalkan struktur asas yang sama: 284 bilion jumlah parameter dengan 13 bilion aktif pada satu-satu masa, dan tetingkap konteks satu juta token. Daripada membesarkan model, DeepSeek melatihnya semula — memerah lebih banyak prestasi daripada jejak yang sama. Berat model dikeluarkan di bawah lesen MIT permisif pada Wajah Memeluk, meneruskan pendekatan berat terbuka DeepSeek.
DeepSeek berhati-hati untuk merangkumi keluaran. Kemas kini hanya digunakan pada API V4-Flash; API V4-Pro peringkat lebih tinggi dan model yang disediakan melalui apl pengguna dan tapak web DeepSeek kekal tidak berubah. API Flash baharu juga menambah sokongan untuk API Respons dan disesuaikan untuk digunakan dengan Codex, meluaskan daya tarikannya kepada pembangun membina ejen pengekodan.
Tepi Diskaun Cache
Sebahagian besar kelebihan kos DeepSeek datang daripada mekanik harganya. Syarikat itu menawarkan diskaun cache sebanyak 98 peratus — jauh melebihi 90 peratus standard industri — bermakna bahagian permintaan yang berulang atau boleh diramal dibilkan pada sebahagian kecil daripada kadar biasa. Digabungkan dengan token yang lebih sedikit setiap tugas, kos berkesan untuk banyak beban kerja menurun secara mendadak.
Struktur harga itu merupakan cabaran langsung kepada OpenAI, yang dengan sendirinya telah memotong harga untuk mempertahankan bahagian pasaran. Hasilnya ialah pasaran di mana kualiti berhampiran sempadan menjadi komoditi, dan persaingan semakin diputuskan oleh kecekapan infrastruktur dan ekonomi unit berbanding keupayaan mentah.
Perang Harga Tanpa Lantai
Keluaran itu memperhebatkan apa yang disifatkan oleh penganalisis sebagai perang harga penuh. OpenAI memotong harga GPT-5.6 Luna sebanyak 80 peratus untuk mempertahankan pangkalan pembangunnya, hanya untuk DeepSeek menjawab dengan model yang berkemampuan setanding dan masih jauh lebih murah. Setiap pusingan mengurangkan kos efektif perisikan berhampiran sempadan lebih rendah, dan jurang antara model berkemampuan paling murah dan paling mahal terus mengecil.
Dinamik adalah luar biasa dalam perisian. Dalam kebanyakan pasaran, kelebihan kos sebanyak 60 peratus pada kualiti yang hampir sama akan menguasai bahagian dengan pantas. Di sini, kelebihan sedang dipadankan dan dipadankan semula dalam masa beberapa minggu, meninggalkan pembangun dengan papan pendahulu yang sentiasa berubah. Pariti penanda aras, yang pernah menjadi wilayah eksklusif makmal sempadan, semakin tersedia daripada pencabar berat terbuka yang bersedia untuk menerbitkan kedua-dua wajaran dan harga mereka.
Maksudnya untuk Pembangun
Bagi pembangun, implikasi praktikal adalah jelas: model agen yang berkebolehan semakin murah dengan pantas. Model yang boleh menavigasi terminal secara autonomi, menulis dan menyahpepijat kod serta mengendalikan tugas pejabat yang kompleks — semuanya pada pecahan sen setiap permintaan — mengubah ekonomi membina produk berkuasa AI.
Keluaran berat terbuka juga bermakna pasukan boleh menjalankan model pada perkakasan mereka sendiri, mengelakkan bayaran API per-token sepenuhnya untuk beban kerja yang sensitif. Memandangkan DeepSeek, OpenAI, dan lain-lain terus menukar harga dan prestasi, pemenang adalah pembina yang kini mempunyai menu yang semakin meningkat dengan model yang mampu dan mampu untuk dipilih.
Kekal Mendahului Keluk AI
Landskap kecerdasan buatan bergerak lebih pantas berbanding sebelum ini, dan firma yang menjejaki anjakan ini lebih awal mendapat kelebihan yang berkekalan. Untuk liputan berterusan, disemak sumber bagi keluaran model, pusingan pembiayaan dan langkah dasar, ikuti [berita AI terbaharu] kami(https://aibuzzwire.news).
Baca lebih banyak berita AI →