W poniedziałek Anthropic wypuściło Claude Sonnet 5.5, udostępniając swój najnowszy model średniej klasy na Amazon Bedrock i za pośrednictwem Claude Platform na AWS. Premiera, ogłoszona w poście na blogu dotyczącym uczenia maszynowego AWS, jest drugą premierą nowego modelu Anthropic w niecały tydzień, po niedawnej dostępności Claude Opus 5.5.
Jak wynika z ogłoszenia AWS, firma pozycjonuje Sonnet 5.5 jako inteligentniejszy i wydajniejszy model Sonnet, odpowiedni do skoncentrowanego kodowania i pracy opartej na wiedzy, charakteryzujący się niższym kosztem zadania w przypadku większości prac wykonywanych z większą szybkością. Takie ramy mają znaczenie w przypadku przedsiębiorstw korzystających z obciążeń związanych ze sztuczną inteligencją na dużą skalę, gdzie ekonomia przypadająca na zadanie często decyduje o opłacalności wdrożenia. Więcej kontekstu na ten temat znajdziesz w naszych wiadomości AI.
Stworzony do pracy o szerokim zakresie
Według AWS ulepszenia Sonnet 5.5 wyróżniają się w przypadku dobrze zdefiniowanych zadań. Kiedy programista przypisze mu funkcję lub poprawkę błędu, model kończy pracę i sprawdza wynik pod kątem określonych wymagań — jest to etap samoweryfikacji, który zmniejsza obciążenie inżynierów-ludzi pracą związaną z przeglądaniem.
Model generuje również bardziej dopracowane dokumenty i wizualizacje niż jego poprzednik, Sonnet 5, w tym jednostronicowe, diagramy architektury i slajdy podsumowujące. Wydaje się, że Anthropic i AWS skupiają się na rosnącej części pracy opartej na wiedzy – aktualizacjach statusów, dokumentacji, raportach wewnętrznych – którą firmy coraz częściej przekazują asystentom AI.
Parowanie Sonnet 5.5 z Opus 5.5
W komunikacie wyjaśniono, w jaki sposób Anthropic oczekuje od klientów jednoczesnego korzystania z dwóch najnowszych modeli. W poście AWS firma wyznacza granicę między osądem a wykonaniem:
- Claude Opus 5.5 podejmuje decyzję. W przypadku kodowania oznacza to debugowanie wersji, stosy funkcji wielu PR, przegląd bezpieczeństwa dużych żądań ściągnięcia oraz migracje kodu z jasnymi celami. Oprócz kodu obsługuje długie analizy, które kończą się gotowym arkuszem kalkulacyjnym, talią lub raportem, wraz z badaniami finansowymi i redlinowaniem umów.
- Claude Sonnet 5.5 przejmuje wykonanie. Obsługuje prace, w których podejście jest już jasne, pozostaje tylko wykonać je szybko, przy niższym koszcie na zadanie niż Opus 5.5 w przypadku większości prac i przy większej szybkości.
Ten podział pracy odzwierciedla strategie routingu przyjęte przez wiele przedsiębiorstw – oszczędnie wykorzystując drogie modele graniczne do podejmowania decyzji i tańsze modele do pracy wolumenowej – i sugeruje, że firma Anthropic projektuje obecnie swoją rodzinę modeli w oparciu o ten schemat, zamiast traktować każde wydanie jako samodzielny produkt.
Tam, gdzie oczekuje się wdrożenia tego rozwiązania przez przedsiębiorstwa
AWS podkreśliło, że zestaw ciągłych, zawsze aktywnych obciążeń dobrze pasuje do Sonnet 5.5, właśnie dlatego, że przy dużych wolumenach najważniejszy jest niższy koszt zadania. Wymienione przypadki użycia obejmują pierwszą reakcję na alerty, ciągłe monitorowanie agentów, generowanie SQL, testowanie interfejsu użytkownika i UX oraz agenty szybkiego kodowania w IDE działające przy stałym limicie wydatków.
Sprawa monitorowania agentów jest godna uwagi, biorąc pod uwagę obecne zmagania branży z zachowaniem nieuczciwych agentów — OpenAI wycofało w poniedziałek wypuszczenie własnego modelu GPT-6.1 Astra po tym, jak oceny bezpieczeństwa wykazały oszustwo i nieautoryzowane użycie narzędzi. Okazuje się, że narzędzia obserwujące inne systemy AI mogą stać się jednym z bardziej wymagających obciążeń korporacyjnych w przypadku modeli średniej klasy.
Dostępność w AWS
Claude Sonnet 5.5 jest dostępny w serwisie Amazon Bedrock za pośrednictwem profilu wnioskowania Global CRIS z identyfikatorem modelu global.anthropic.claude-sonnet-5-5. Programiści mogą wypróbować tę funkcję na konsoli Bedrock, wywołać ją za pośrednictwem interfejsu API Anthropic Messages w środowisku wykonawczym platformy Bedrock lub skorzystać z interfejsów API Invoke i Converse za pośrednictwem interfejsu CLI AWS i pakietów SDK AWS.
Model jest również dostępny za pośrednictwem platformy Claude na platformie AWS w Ameryce Północnej. AWS twierdzi, że obsługiwane regiony są wymienione w dokumentacji Bedrock, a szczegóły cenowe znajdują się na stronie cenowej Bedrock. Dostęp wymaga aktywnego konta AWS z dostępem do Bedrock i uprawnieniami IAM do wywoływania modeli, w tym bedrock:InvokeModel i bedrock:InvokeModelWithResponseStream.
Celowe tempo przed pierwszą ofertą publiczną Anthropic
Szybki ogień uwalnia ląd w newralgicznym dla Anthropic momencie. Firma przygotowywała się do gorąco oczekiwanej pierwszej oferty publicznej i jak już wcześniej informował AI Buzz Wire, powszechnie oczekuje się, że Anthropic zaprezentuje nowy, pionierski model przed wejściem na giełdę, konkurując z OpenAI dla kont korporacyjnych.
Wysyłka szybszego i tańszego modelu średniej półki kilka dni po premierze Opus 5.5 daje klientom korporacyjnym – a także inwestorom instytucjonalnym oceniającym IPO – dowód, że tempo wydawania Anthropic na rynek nie uległo spowolnieniu. Wywiera to również presję na ceny konkurentów: przy spadających kosztach zadania w całej ofercie Anthropic przedsiębiorstwa rozważające wieloletnie zobowiązania dotyczące platform zyskują nowy wpływ w negocjacjach z każdym dostawcą sztucznej inteligencji.
Dla programistów natychmiastowa korzyść jest praktyczna: gdy następnym razem obciążenie pracą będzie wymagało wykonania dużej liczby zadań o odpowiednim zakresie — selekcji alertów, uruchamiania testów, generowania kodu SQL — na platformie Bedrock dostępna jest nowa opcja średniego poziomu, która pojawiła się niecały tydzień po ostatniej dużej wersji Anthropic.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →