Anthropic a dezvăluit Claude Opus 5, un nou model AI despre care compania spune că oferă inteligență aproape de frontieră la aproximativ jumătate din prețul modelului său de top Fable 5. Lansat pe 24 iulie 2026, Opus 5 este acum modelul implicit pe Claude Max și cel mai puternic model disponibil pe Claude Pro, poziționându-l ca calul de bătaie de zi cu zi al Anthropic pentru codificare, agenți autonomi și cunoștințe profesionale.
Lansarea aterizează într-un moment în care companiile examinează cheltuielile cu inteligența artificială. Potrivit CNBC, noul model „rivalează cu Fable 5 și este mai ieftin, deoarece companiile se îngrijorează de costuri”, în timp ce Bloomberg l-a caracterizat drept un „model mai eficient din punct de vedere al costurilor pentru sarcinile de zi cu zi”. Pentru echipele care urmăresc cele mai recente dezvoltări AI, Opus 5 reprezintă un pariu deliberat că următorul câmp de luptă competitiv este valoarea, nu supremația de referință brută.
Performanță de referință: Noua ultimă generație în ceea ce privește codificarea și munca de cunoștințe
Anthropic raportează că Opus 5 postează rezultate de ultimă generație cu privire la codificare și evaluări ale activității de cunoaștere, inclusiv Frontier-Bench și GDPval-AA. Pe Frontier-Bench v0.1, compania spune că Opus 5 depășește toate celelalte modele și mai mult decât dublează performanța predecesorului său, Opus 4.8, la un cost pe sarcină mai mic.
Pe CursorBench 3.2, Opus 5 se situează la 0,5% din scorul maxim al lui Fable 5, în timp ce costă jumătate mai mult pe sarcină, conform propriilor benchmark-uri Anthropic. Decrypt a remarcat că modelul „depășește Fable 5 la majoritatea benchmark-urilor – la jumătate din preț”.
Câștigurile se extind la evaluările agentice și de rezolvare a problemelor:
- ARC-AGI 3: Opus 5 are scoruri de aproximativ trei ori mai mari decât următorul cel mai bun model la acest test roman de rezolvare a problemelor.
- Zapier AutomationBench: O rată de promovare de aproximativ 1,5 ori următorul cel mai bun model pentru același cost, măsurând finalizarea sarcinilor de afaceri de la capăt la capăt.
- OSWorld 2.0 (utilizare computer): Opus 5 depășește cel mai bun rezultat al lui Fable 5 la puțin peste o treime din cost.
În special, Anthropic recunoaște că Opus 5 „rămâne în spatele lui Mythos 5 în sarcinile de securitate cibernetică”, o zonă în care un model de frontieră rival își păstrează conducerea.
Agenție mai puternică și autoverificare
O temă recurentă în anunț este capacitatea îmbunătățită a Opus 5 de a-și verifica propria lucrare și de a repeta până când reușește. Anthropic a descris mai multe exemple din testarea cu acces timpuriu care evidențiază această autonomie.
Într-o sarcină Frontier-Bench, modelului i s-a dat un desen al unei piese de mașină și i s-a cerut să scrie cod pentru a o reconstrui ca model 3D FreeCAD - dar nu i s-a oferit în mod deliberat nicio modalitate de a vizualiza desenul direct. Se pare că Opus 5 și-a scris propria conductă de viziune computerizată pentru a extrage geometria din pixelii bruti, apoi a reconstruit întreaga parte, reușind în mod repetat acolo unde niciun model concurent nu a putut rezolva sarcina după cinci încercări.
Având în vedere o eroare reală într-un manager de pachete cu sursă deschisă popular, Opus 5 a găsit cauza principală și a remediat un caz limită pe care patch-ul comunității îl ratase, în timp ce un model concurent a remediat doar simptomul de suprafață și a declarat eroarea rezolvată. Un inginer de la o firmă de tranzacționare ar fi folosit Opus 5 pentru a construi un flux de date de piață pentru un nou schimb într-o singură sesiune - o sarcină pe care modelele anterioare nu o puteau îndeplini deloc - și, negăsind niciun feed live pentru a valida, modelul și-a construit propriul cabl de testare.
Recepția clienților
Partenerii cu acces timpuriu au oferit evaluări în mare măsură pozitive. Scott Wu, CEO al Cognition (producătorul agentului de codificare Devin), a declarat că Opus 5 „se apropie de performanța la nivel de Fable la jumătate din cost” și arată „o putere deosebită în sarcinile dificile de depanare și analiză a cauzei principale”. Sualeh Asif, co-fondatorul Cursor, a spus că modelul oferă „inteligență aproape de Fable 5 la viteză și costuri Opus”.
Wade Foster, CEO al Zapier, a raportat că Opus 5 „s-a clasat pe primul loc în clasamentul AutomationBench al lui Zapier fără a cheltui mai multe jetoane decât modelele anterioare Claude”, completând un flux de lucru complet de prevenire a abandonului de la capăt la cap – semnalând conturile cu risc, alertând proprietarul potrivit și rezumat pentru echipele de reținere. Modelele anterioare nu au trecut; Opusul 5 a atins 100%.
Câștiguri în cercetarea științifică
Anthropic a subliniat, de asemenea, îmbunătățirile Opus 5 pentru munca științifică. Modelul depășește Opus 4.8 la fiecare dintre evaluările Anthropic în științele vieții, care acoperă biologia structurală, chimia organică și bioinformatica. Compania a indicat o îmbunătățire cu 10,2 puncte procentuale a unui punct de referință intern al chimiei organice (inferând structuri moleculare din datele spectroscopiei) și un câștig de 7,7 puncte în sarcinile de predicție a funcției proteinelor. Un client de genomica a descris modelul ca fiind „mai mult ca un om de știință atent”, căutând testele statistice potrivite și verificându-și propriile rezultate.
Strategia de stabilire a prețurilor
Prin prețul Opus 5 la același nivel cu Opus 4.8, în timp ce se apropie de inteligența lui Fable 5, Anthropic reduce efectiv decalajul dintre ofertele sale de nivel mediu și cele de vârf. VentureBeat a încadrat lansarea drept „un model AI mai ieftin pentru codare, agenți și fluxuri de lucru ale întreprinderii”, iar Seeking Alpha a observat că Opus 5 este „mai aproape și mai ieftin de modelul de frontieră Fable 5”. Compania oferă o setare de „efort” reglabilă, care le permite clienților să schimbe informații pentru viteză și costuri mai mici cu token, ajustand raportul cost-performanță per sarcină.
Ce înseamnă pentru cursa AI
Opus 5 subliniază cât de rapid scade costul AI aproape de frontieră. Un model care se află la o distanță uimitoare de cele mai capabile sisteme disponibile – la jumătate din prețul simbolului – îi presează pe concurenți să justifice prețurile premium pentru câștiguri marginale. Odată cu Anthropic, OpenAI, Google și alții care se luptă pentru a face modele capabile suficient de accesibile pentru implementarea zilnică, la scară largă, întrebarea pentru întreprinderi se schimbă de la „care model este cel mai inteligent?” la "care model oferă cea mai mare inteligență pe dolar?"
Pentru Anthropic, mesajul este clar: raționamentul high-end nu mai este un produs de lux. Opus 5 aduce capacitatea adiacentă frontierei la un nivel de preț care face implementarea susținută, de zi cu zi, realistă - și acesta se poate dovedi a fi cel mai important detaliu dintre toate.
Stai înaintea AI
Claude Opus 5 este disponibil începând de astăzi pe Claude Pro, Claude Max și prin API-ul Anthropic. Pentru mai multe despre această poveste și peisajul mai larg al inteligenței artificiale, ține pasul cu știrile de ultimă oră AI așa cum se întâmplă.
Citiți mai multe știri AI →