Laboratorul chinez de inteligență artificială DeepSeek a lansat V4-Flash „0731” pe 31 iulie 2026, o versiune reantrenată a modelului său bugetar care aproape se potrivește cu GPT-5.6 Luna OpenAI pe benchmark-uri terțe la un cost cu aproximativ 60% mai mic. Lansarea, care pune API-ul beta public al modelului în disponibilitate generală, este cea mai recentă salvă într-un război din ce în ce mai intens al prețurilor dintre furnizorii chinezi de tip open-weight și laboratoarele de frontieră occidentală. Pentru acoperirea continuă a războaielor modelelor, consultați cele mai recente știri AI.
Potrivit The Decoder, noua versiune are 50 de puncte la Artificial Analysis Intelligence Index – un salt de zece puncte față de precedentul V4-Flash lansat în aprilie 2026. Aceasta o plasează cu doar un punct în spatele bugetului GPT-5.6 Luna al OpenAI, în ciuda faptului că costă cu aproximativ 60% mai puțin pe sarcină, chiar și după reducerea recentă a prețului OpenAI cu 80%.
Construit pentru munca agentică
Cele mai mari câștiguri au venit în sarcinile agentice, capacitatea de a finaliza în mod autonom munca în mai mulți pași în lumea reală. TechNode a raportat că modelul are 82,7 pe Terminal Bench 2.1 și 54,4 pe DeepSWE, două benchmark-uri concepute pentru a măsura cât de bine poate un AI să folosească instrumentele, să scrie cod și să rezolve problemele de inginerie fără a ține mâna.
Pe GDPval, un etalon care testează modele pentru lucrări complexe de birou, V4-Flash a urcat de la 1.189 la 1.559 de puncte Elo. DeepSeek a mai spus că modelul halucinează mai rar decât predecesorul său și folosește cu aproximativ 12% mai puține jetoane pentru a îndeplini aceleași sarcini.
Aceeași arhitectură, greutăți mai inteligente
Upgrade-ul păstrează aceeași structură de bază: 284 de miliarde de parametri în total, cu 13 miliarde activi în orice moment și o fereastră de context de un milion de token. În loc să mărească modelul, DeepSeek l-a reantrenat - strângând mai multă performanță din aceeași amprentă. Greutățile modelului sunt eliberate sub licența permisivă MIT pe Hugging Face, continuând abordarea deschisă a DeepSeek.
DeepSeek a avut grijă să limiteze lansarea. Actualizarea se aplică numai API-ului V4-Flash; API-ul V4-Pro de nivel superior și modelele deservite prin aplicația pentru consumatori și site-ul web DeepSeek rămân neschimbate. Noul API Flash adaugă, de asemenea, suport pentru API-ul Responses și este adaptat pentru utilizare cu Codex, extinzându-și atractivitatea pentru dezvoltatori care creează agenți de codare.
The Cache Discount Edge
O parte semnificativă a avantajului de cost al DeepSeek provine din mecanismele sale de stabilire a prețurilor. Compania oferă o reducere de 98% la cache – cu mult peste standardul de 90% – ceea ce înseamnă că părțile repetate sau previzibile ale unei cereri sunt facturate la o mică fracțiune din tariful normal. Combinat cu mai puține jetoane per sarcină, costul efectiv pentru multe sarcini de lucru scade dramatic.
Această structură de prețuri este o provocare directă pentru OpenAI, care a redus prețurile pentru a apăra cota de piață. Rezultatul este o piață în care calitatea aproape de frontieră devine o marfă, iar concurența este din ce în ce mai decisă de eficiența infrastructurii și de economia unitară, mai degrabă decât de capacitatea brută.
Un război al prețurilor fără etaj
Lansarea intensifică ceea ce analiștii descriu acum drept un război total al prețurilor. OpenAI a redus prețurile GPT-5.6 Luna cu 80 la sută pentru a-și apăra baza de dezvoltatori, doar pentru ca DeepSeek să răspundă cu un model care este comparabil capabil și încă mult mai ieftin. Fiecare rundă reduce costul efectiv al inteligenței apropiate de frontieră, iar diferența dintre cele mai ieftine și cele mai scumpe modele capabile continuă să se restrângă.
Dinamica este neobișnuită în software. Pe majoritatea piețelor, un avantaj de cost de 60% la o calitate aproape egală ar capta rapid cota. Aici, avantajul este egalat și re-potrivit în câteva săptămâni, lăsând dezvoltatorilor un clasament aflat în continuă schimbare. Paritatea de referință, cândva provincia exclusivă a laboratoarelor de frontieră, este din ce în ce mai disponibilă de la competitorii cu greutate deschisă care doresc să-și publice atât ponderile, cât și prețurile.
Ce înseamnă pentru dezvoltatori
Pentru dezvoltatori, implicația practică este clară: modelele agentice capabile devin mai ieftine rapid. Un model care poate naviga în mod autonom într-un terminal, scrie și depana cod și poate gestiona sarcini complexe de birou - toate la o fracțiune de un cent pe cerere - schimbă economia construirii de produse bazate pe inteligență artificială.
Lansarea open-weight înseamnă, de asemenea, că echipele pot rula modelul pe propriul hardware, evitând în întregime taxele API per token pentru sarcinile de lucru sensibile. Pe măsură ce DeepSeek, OpenAI și alții continuă să schimbe lovituri cu privire la preț și performanță, câștigătorii sunt constructorii care acum au un meniu tot mai mare de modele capabile și accesibile din care să aleagă.
Rămâi înaintea curbei AI
Peisajul inteligenței artificiale se mișcă mai repede ca niciodată, iar firmele care urmăresc aceste schimbări devreme câștigă un avantaj de durată. Pentru o acoperire continuă, verificată la sursă, a lansărilor de modele, rundelor de finanțare și mișcărilor de politică, urmăriți cele mai recente știri AI.
Citiți mai multe știri AI →