Anthropic zaprezentował Claude Opus 5, nowy model sztucznej inteligencji, który według firmy zapewnia informacje wywiadowcze niemal na granicy za mniej więcej połowę ceny swojego topowego modelu Fable 5. Wydany 24 lipca 2026 r. Opus 5 jest obecnie domyślnym modelem Claude Max i najsilniejszym modelem dostępnym w Claude Pro, co pozycjonuje go jako codziennego konia pociągowego firmy Anthropic do kodowania, autonomicznych agentów i profesjonalnej pracy opartej na wiedzy.

Premiera następuje w momencie, gdy firmy analizują wydatki na sztuczną inteligencję. Według CNBC nowy model „konkuruje z Fable 5 i jest tańszy, ponieważ firmy obawiają się kosztów”, natomiast Bloomberg określił go jako „bardziej opłacalny model do codziennych zadań”. Dla zespołów śledzących najnowsze rozwój sztucznej inteligencji Opus 5 stanowi celowe założenie, że kolejnym polem bitwy konkurencyjnej będzie wartość, a nie surowa dominacja w benchmarkach.

Wydajność wzorcowa: najnowocześniejsza technologia w zakresie kodowania i pracy z wiedzą

Anthropic donosi, że Opus 5 publikuje najnowocześniejsze wyniki w zakresie kodowania i ocen pracy opartej na wiedzy, w tym Frontier-Bench i PKBval-AA. Firma twierdzi, że w przypadku Frontier-Bench v0.1 Opus 5 przewyższa wszystkie inne modele i ponad dwukrotnie zwiększa wydajność swojego poprzednika, Opus 4.8, przy niższym koszcie na zadanie.

Według własnych testów Anthropic w CursorBench 3.2 Opus 5 mieści się w granicach 0,5% maksymalnego wyniku Fable 5, a jednocześnie kosztuje o połowę mniej za zadanie. Decrypt zauważył, że model „przewyższa Fable 5 w większości testów porównawczych – za połowę ceny”.

Korzyści obejmują oceny agentyczne i rozwiązywanie problemów:

  • ARC-AGI 3: Opus 5 uzyskał mniej więcej trzy razy lepszy wynik w tym teście rozwiązywania nowatorskich problemów niż kolejny najlepszy model.
  • Zapier AutomationBench: Wskaźnik zdawalności około 1,5 razy lepszy od następnego najlepszego modelu przy tych samych kosztach, mierzący kompleksową realizację zadań biznesowych.
  • OSWorld 2.0 (na komputerze): Opus 5 przewyższa najlepszy wynik Fable 5 przy nieco ponad jednej trzeciej kosztów.

W szczególności Anthropic przyznaje, że Opus 5 „pozostaje w tyle za Mythos 5 w zadaniach związanych z cyberbezpieczeństwem”, czyli w obszarze, w którym konkurencyjny model z pogranicza utrzymuje wiodącą pozycję.

Silniejsza agencja i samoweryfikacja

Powracającym tematem ogłoszenia jest ulepszona zdolność Opus 5 do weryfikowania własnej pracy i iteracji, aż do skutku. Anthropic opisał kilka przykładów z testów wczesnego dostępu, które podkreślają tę autonomię.

W jednym z zadań Frontier-Bench model otrzymał rysunek części maszyny i został poproszony o napisanie kodu w celu zrekonstruowania go jako model 3D FreeCAD – ale celowo nie umożliwiono mu bezpośredniego obejrzenia rysunku. Opus 5 podobno napisał własny potok widzenia komputerowego, aby wyodrębnić geometrię z nieprzetworzonych pikseli, a następnie przebudował całą część, wielokrotnie z sukcesem, gdy żaden konkurencyjny model nie był w stanie rozwiązać zadania po pięciu próbach.

Biorąc pod uwagę prawdziwy błąd w popularnym menedżerze pakietów typu open source, Opus 5 znalazł główną przyczynę i naprawił przypadek Edge, który przeoczył łatka społeczności, podczas gdy konkurencyjny model naprawił jedynie objawy powierzchniowe i ogłosił, że błąd został rozwiązany. Inżynier z firmy handlowej podobno użył Opus 5 do zbudowania w ciągu jednej sesji źródła danych rynkowych dla nowej giełdy – zadania, którego poprzednie modele w ogóle nie były w stanie wykonać – a nie znajdując żadnego bieżącego źródła danych do sprawdzenia, model zbudował własną wiązkę testową.

Przyjęcie klienta

Partnerzy wczesnego dostępu przedstawili w dużej mierze pozytywne oceny. Scott Wu, dyrektor generalny Cognition (twórcy agenta kodującego Devin), powiedział, że Opus 5 „osiąga wydajność na poziomie Fable za połowę ceny” i wykazuje „szczególną moc w przypadku trudnych zadań związanych z debugowaniem i analizą przyczyn źródłowych”. Sualeh Asif, współzałożycielka Cursor, powiedziała, że ​​model zapewnia „inteligencję bliską Fable 5 przy szybkości i cenie Opus”.

Wade Foster, dyrektor generalny firmy Zapier, poinformował, że Opus 5 „zajął pierwsze miejsce w tabeli liderów AutomationBench firmy Zapier, nie wydając więcej tokenów niż poprzednie modele Claude”, realizując od początku do końca pełny przepływ pracy zapobiegający odejściu klientów — oznaczanie kont obarczonych ryzykiem, ostrzeganie odpowiedniego właściciela i podsumowanie dla zespołów zajmujących się utrzymaniem. Poprzednie modele nie przeszły; Opus 5 trafił w 100%.

Zyski w badaniach naukowych

Anthropic podkreśliło również ulepszenia Opus 5 w pracy naukowej. Model przewyższa Opus 4.8 we wszystkich ocenach nauk przyrodniczych firmy Anthropic, obejmujących biologię strukturalną, chemię organiczną i bioinformatykę. Firma wskazała na poprawę o 10,2 punktu procentowego w wewnętrznym benchmarku chemii organicznej (wnioskowanie o strukturach molekularnych na podstawie danych spektroskopowych) i o 7,7 punktu więcej w zadaniach przewidywania funkcji białek. Jeden z klientów zajmujących się genomiką opisał model jako zachowujący się „bardziej jak uważny naukowiec”, sięgający po odpowiednie testy statystyczne i sprawdzający własne wyniki.

Strategia cenowa

Wyceniając Opus 5 na tym samym poziomie co Opus 4.8 i zbliżając się do inteligencji Fable 5, Anthropic skutecznie zmniejsza różnicę pomiędzy swoimi produktami ze średniej półki i flagowcami. VentureBeat określił tę premierę jako „tańszy model sztucznej inteligencji do kodowania, agentów i przepływów pracy w przedsiębiorstwie”, a Seeking Alpha zauważył, że Opus 5 jest „bliższy i tańszy od pionierskiego modelu Fable 5”. Firma oferuje regulowane ustawienie „wysiłku”, które pozwala klientom wymieniać inteligencję na szybkość i niższe koszty tokenów, dostosowując stosunek kosztów do wydajności dla każdego zadania.

Co to oznacza dla wyścigu AI

Opus 5 podkreśla, jak szybko spada koszt sztucznej inteligencji w pobliżu granic. Model, który w imponujący sposób dorównuje najbardziej wydajnym dostępnym systemom – za połowę symbolicznej ceny – wywiera presję na konkurentów, aby uzasadniali wyższe ceny w zamian za marginalne zyski. Ponieważ Anthropic, OpenAI, Google i inne firmy ścigają się, aby wydajne modele były wystarczająco przystępne cenowo do codziennego wdrażania na dużą skalę, pytanie dla przedsiębiorstw zmienia się z „który model jest najmądrzejszy?” na „który model zapewnia najwięcej inteligencji w przeliczeniu na dolara?”

Dla Anthropic przekaz jest jasny: zaawansowane rozumowanie nie jest już produktem luksusowym. Opus 5 przenosi zaawansowane możliwości do poziomu cenowego, który sprawia, że ​​trwałe, codzienne wdrażanie staje się realistyczne – i to może okazać się najważniejszym szczegółem ze wszystkich.

Wyprzedź sztuczną inteligencję

Claude Opus 5 jest dostępny od dziś na Claude Pro, Claude Max i poprzez API Anthropic. Więcej informacji na temat tej historii i szerszego krajobrazu sztucznej inteligencji znajdziesz na bieżąco w najnowszych wiadomościach o sztucznej inteligencji.

Przeczytaj więcej aktualności o sztucznej inteligencji →