Anthropic wypuścił Claude Sonnet 5, nazywając go najbardziej agentycznym modelem klasy Sonnet, jaki zbudowała firma. Zaprezentowany 30 czerwca 2026 r. nowy model może planować, korzystać z narzędzi takich jak przeglądarki i terminale, a także działać autonomicznie na poziomie, który jeszcze kilka miesięcy temu wymagał większych i znacznie droższych modeli. Premiera następuje w momencie, gdy cała branża sztucznej inteligencji dąży do przekształcenia chatbotów w zdolnych agentów, którzy mogą działać w imieniu użytkownika, a nie tylko odpowiadać na pytania.

Dla programistów śledzących najnowsze osiągnięcia ta wiadomość stanowi uzupełnienie szeregu najświeższych wiadomości dotyczących sztucznej inteligencji, które zmieniły krajobraz konkurencji. Anthropic przedstawia Sonnet 5 jako moment, w którym możliwości agenta w końcu osiągają średnie ceny, co może zmienić sposób, w jaki zespoły budżetują na autonomiczne przepływy pracy.

Wydajność, która dorównuje okrętowi flagowemu

Według Anthropic Sonnet 5 zmniejsza różnicę pomiędzy linią Sonnet ze średniej półki a topowymi modelami Opus firmy. Jego wydajność jest zbliżona do Opus 4.8, ale przy znacznie niższych cenach i stanowi wyraźną poprawę w stosunku do swojego poprzednika, Sonnet 4.6, pod względem rozumowania, użycia narzędzi, kodowania i pracy opartej na wiedzy.

Firma Anthropic opublikowała krzywe kosztów i wydajności porównujące model z Sonnet 4.6 i Opus 4.8 w dwóch ocenach agentów: BrowseComp, która mierzy wyszukiwanie agentów, i OSWorld-Verified, która testuje użycie komputera. Firma twierdzi, że Sonnet 5 oferuje szerszy zakres opcji pod względem stosunku ceny do jakości niż Sonnet 4.6, a przy większym wysiłku może dorównać Opus 4.8 w niektórych zadaniach.

Agresywne ceny dla agentów

Cena ma kluczowe znaczenie dla boiska. Claude Sonnet 5 zostanie wprowadzony na rynek z wstępną ceną wynoszącą 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych, dostępną do 31 sierpnia 2026 r. Po tym okresie cena będzie wynosić 3 USD za milion tokenów wejściowych i 15 USD za milion tokenów wyjściowych.

Dla porównania Opus 4.8 kosztuje 5 dolarów za milion tokenów wejściowych i 25 dolarów za milion tokenów wyjściowych. Ponieważ agenci przetwarzają dużą liczbę tokenów podczas rozumowania i wywoływania narzędzi na wielu etapach, ta różnica cenowa ma ogromne znaczenie dla budżetów przedsiębiorstw. Testerzy wczesnego dostępu cytowani przez Anthropic opisali Sonnet 5 kończący złożone zadania, w których poprzednie modele Sonnet zatrzymywały się, i sprawdzający własne dane wyjściowe bez wyraźnego pytania.

Dostępność w każdym planie

Claude Sonnet 5 jest dostępny we wszystkich planach Anthropic od dnia premiery. Jest to domyślny model dla użytkowników Free i Pro i jest dostępny dla klientów Max, Team i Enterprise. Programiści mogą uzyskać do niego dostęp poprzez Claude API przy użyciu identyfikatora modelu `claude-sonnet-5`, a także poprzez Claude Code i platformę Claude.

Szerokie wdrożenie jest godne uwagi, ponieważ zapewnia wysoką wydajność agenta w rękach bezpłatnych użytkowników, a nie tylko płacących klientów korporacyjnych. Anthropic stwierdziło, że linia Sonnet historycznie była początkiem ery agentyzmu dla wielu programistów, wskazując Claude'a Sonneta 3.5, 3.6 i 3.7 jako pierwsze modele, które wykazały silne umiejętności kodowania i posługiwania się narzędziami.

Wbudowana historia dotycząca bezpieczeństwa

Bezpieczeństwo było kluczową częścią ogłoszenia. Firma Anthropic stwierdziła, że ​​jej oceny wykazały, że Sonnet 5 wykazuje ogólnie niższy wskaźnik niepożądanych zachowań niż Sonnet 4.6 i jest ogólnie bezpieczniejszy w użyciu w kontekstach agentycznych. Firma zauważyła również, że model ten ma znacznie mniejszą zdolność do wykonywania zadań związanych z cyberbezpieczeństwem niż obecne modele Opus, co jest przemyślanym wyborem projektowym, który zmniejsza ryzyko niewłaściwego użycia nawet w miarę wzrostu ogólnych możliwości.

Karta systemowa Claude Sonnet 5, wydana wraz z modelem, szczegółowo przedstawia szerszy zestaw ocen. Firma Anthropic postawiła na przejrzystość testów bezpieczeństwa jako wyróżnik konkurencyjny, ponieważ organy regulacyjne w Stanach Zjednoczonych i Europie analizują premiery nowych modeli.

Szerszy moment agenta

Premiera następuje w warunkach intensywnej konkurencji. Rywale, w tym OpenAI, Google i szybko rozwijający się zestaw chińskich laboratoriów, naciskają na modele, które zamiast po prostu generować tekst, mogą wykonywać wieloetapowe działania. Dostarczając możliwości agenta zbliżone do Opusa po cenach Sonnet, Anthropic obstawia, że ​​kolejnym polem bitwy nie będą surowe wyniki testów porównawczych, ale koszt niezawodnej obsługi agenta w przypadku długich i złożonych zadań.

Ponieważ wstępne ceny obowiązują do końca sierpnia, programiści mają teraz możliwość przetestowania Sonnet 5 pod kątem najbardziej wymagających obciążeń agentowych, zanim zaczną obowiązywać wyższe stawki.

Wyprzedź sztuczną inteligencję

Tempo wypuszczania modeli nie wykazuje oznak spowolnienia. Aby na bieżąco relacjonować nowe premiery, rundy finansowania i zmiany polityki, odwiedź AI Buzz Wire, aby na bieżąco otrzymywać najnowsze informacje o rozwoju sztucznej inteligencji.

Przeczytaj więcej aktualności o sztucznej inteligencji →