Anthropic heeft Claude Opus 5 onthuld, een nieuw AI-model dat volgens het bedrijf grensverleggende intelligentie levert tegen ongeveer de helft van de prijs van zijn topmodel Fable 5-model. Opus 5, uitgebracht op 24 juli 2026, is nu het standaardmodel op Claude Max en het sterkste model dat beschikbaar is op Claude Pro, waardoor het wordt gepositioneerd als het dagelijkse werkpaard van Anthropic voor coderen, autonome agenten en professioneel kenniswerk.

De lancering komt op een moment waarop bedrijven de AI-uitgaven onder de loep nemen. Volgens CNBC "concurreert het nieuwe model met Fable 5 en is het goedkoper omdat bedrijven zich zorgen maken over de kosten", terwijl Bloomberg het typeerde als een "kostenefficiënter model voor alledaagse taken". Voor teams die de laatste AI-ontwikkelingen volgen, vertegenwoordigt Opus 5 een bewuste gok dat het volgende competitieve slagveld waarde zal zijn, en niet pure benchmark-suprematie.

Benchmarkprestaties: nieuwe state-of-the-art op het gebied van codering en kenniswerk

Anthropic meldt dat Opus 5 state-of-the-art resultaten publiceert op het gebied van coderen en evaluaties van kenniswerk, waaronder Frontier-Bench en GDPval-AA. Over Frontier-Bench v0.1 zegt het bedrijf dat Opus 5 alle andere modellen overtreft en de prestaties van zijn voorganger, Opus 4.8, ruimschoots verdubbelt, tegen lagere kosten per taak.

Op CursorBench 3.2 komt Opus 5 binnen 0,5% van de piekscore van Fable 5, terwijl het volgens Anthropic's eigen benchmarks de helft per taak kost. Decrypt merkte op dat het model "op de meeste benchmarks beter scoort dan Fable 5 - tegen de helft van de prijs."

De voordelen strekken zich uit tot agentische en probleemoplossende evaluaties:

  • ARC-AGI 3: Opus 5 scoort grofweg drie keer hoger dan het op één na beste model op deze nieuwe probleemoplossende test.
  • Zapier AutomationBench: Een slagingspercentage van ongeveer 1,5x het op één na beste model voor dezelfde kosten, waarbij de end-to-end voltooiing van zakelijke taken wordt gemeten.
  • OSWorld 2.0 (computergebruik): Opus 5 overtreft het beste resultaat van Fable 5 met iets meer dan een derde van de kosten.

Anthropic erkent met name dat Opus 5 "achter Mythos 5 blijft op het gebied van cyberbeveiligingstaken", een gebied waar een rivaliserend grensmodel de leiding behoudt.

Sterkere keuzevrijheid en zelfverificatie

Een terugkerend thema in de aankondiging is het verbeterde vermogen van Opus 5 om zijn eigen werk te verifiëren en te herhalen totdat het slaagt. Anthropic beschreef verschillende voorbeelden uit early-access-tests die deze autonomie benadrukken.

Bij één Frontier-Bench-taak kreeg het model een tekening van een machineonderdeel en werd gevraagd code te schrijven om het te reconstrueren als een 3D FreeCAD-model, maar kreeg het doelbewust geen mogelijkheid om de tekening rechtstreeks te bekijken. Opus 5 schreef naar verluidt zijn eigen computervisiepijplijn om geometrie uit onbewerkte pixels te extraheren en vervolgens het volledige deel opnieuw op te bouwen, waarbij hij herhaaldelijk slaagde waar geen enkel concurrerend model de taak na vijf pogingen kon oplossen.

Gegeven een echte bug in een populaire open-source pakketbeheerder, vond Opus 5 de hoofdoorzaak en repareerde een randgeval dat de eigen patch van de gemeenschap had gemist, terwijl een concurrerend model alleen het oppervlakkige symptoom repareerde en verklaarde dat de bug opgelost was. Een ingenieur bij een handelsfirma gebruikte naar verluidt Opus 5 om in één sessie een marktdatafeed voor een nieuwe beurs te bouwen – een taak die eerdere modellen helemaal niet konden voltooien – en omdat er geen live feed was om te valideren, bouwde het model zijn eigen testharnas.

Klantontvangst

Partners voor vroege toegang boden grotendeels positieve beoordelingen. Scott Wu, CEO van Cognition (maker van de Devin-codeeragent), zei dat Opus 5 "prestaties op Fable-niveau benadert tegen de helft van de kosten" en "bijzonder sterk is bij moeilijke debugging- en hoofdoorzaakanalysetaken." Sualeh Asif, mede-oprichter van Cursor, zei dat het model "bijna Fable 5-intelligentie levert tegen Opus-snelheid en -kosten."

Wade Foster, CEO van Zapier, meldde dat Opus 5 "bovenaan Zapier's AutomationBench-leaderboard stond zonder meer tokens uit te geven dan eerdere Claude-modellen", waarmee een volledige workflow ter voorkoming van klantverloop van begin tot eind werd voltooid - waarbij risicovolle accounts werden gemarkeerd, de juiste eigenaar werd gewaarschuwd en samenvattingen werden gemaakt voor retentieteams. Eerdere modellen kwamen niet door; Opus 5 scoorde 100%.

Winsten in wetenschappelijk onderzoek

Anthropic benadrukte ook de verbeteringen van Opus 5 voor wetenschappelijk werk. Het model presteert beter dan Opus 4.8 op alle levenswetenschappelijke evaluaties van Anthropic, waaronder structurele biologie, organische chemie en bio-informatica. Het bedrijf wees op een verbetering van 10,2 procentpunt ten opzichte van een interne organische chemiebenchmark (die moleculaire structuren afleidt uit spectroscopiegegevens) en een winst van 7,7 procentpunt bij het voorspellen van eiwitfuncties. Eén genomics-klant beschreef het model als 'zich meer gedragen als een zorgvuldige wetenschapper', die naar de juiste statistische tests reikte en de eigen resultaten controleerde.

De prijsstrategie

Door Opus 5 op hetzelfde niveau te prijzen als Opus 4.8 en tegelijkertijd de intelligentie van Fable 5 te benaderen, verkleint Anthropic effectief de kloof tussen zijn middenklasse- en vlaggenschipaanbod. VentureBeat omschreef de release als "een goedkoper AI-model voor codering, agenten en bedrijfsworkflows", en Seeking Alpha merkte op dat Opus 5 "dichter en goedkoper is bij grensmodel Fable 5." Het bedrijf biedt een aanpasbare ‘inspannings’-instelling waarmee klanten intelligentie kunnen inruilen voor snelheid en lagere tokenkosten, waarbij de kosten-prestatieverhouding per taak kan worden verfijnd.

Wat het betekent voor de AI-race

Opus 5 onderstreept hoe snel de kosten van near-frontier AI dalen. Een model dat binnen redelijke afstand komt van de meest capabele systemen die beschikbaar zijn – tegen de helft van de symbolische prijs – zet concurrenten onder druk om premiumprijzen voor marginale winsten te rechtvaardigen. Nu Anthropic, OpenAI, Google en anderen racen om capabele modellen betaalbaar genoeg te maken voor dagelijkse, grootschalige implementatie, verschuift de vraag voor bedrijven van "welk model is het slimste?" tot "welk model levert de meeste intelligentie per dollar?"

Voor Anthropic is de boodschap duidelijk: high-end redeneren is niet langer een luxeproduct. Opus 5 brengt grensoverschrijdende capaciteit naar een prijsniveau dat duurzame, alledaagse inzet realistisch maakt – en dat zou wel eens het meest consequente detail van allemaal kunnen blijken te zijn.

Blijf AI een stap voor

Claude Opus 5 is vanaf vandaag beschikbaar op Claude Pro, Claude Max en via de API van Anthropic. Voor meer informatie over dit verhaal en het bredere landschap van kunstmatige intelligentie kunt u breaking AI news volgen zodra dit zich voordoet.

Lees meer AI-nieuws →