Jak wynika z nowej analizy przeprowadzonej przez platformę benchmarkingową Arena, w grze Anthropic Claude Opus 5.5 prawie porzucono myślnik, jeden z najbardziej rozpoznawalnych tików w tekście generowanym przez sztuczną inteligencję. Model używa teraz około 95 procent mniej kresek niż jego poprzednik, pisze krótszymi zdaniami i preferuje prostsze sformułowania. Jest jeden znaczący kompromis: odpowiedzi są coraz dłuższe.

Ustalenia pochodzą z przeprowadzonej przez Arena analizy wzniosłych odpowiedzi zebranych za pośrednictwem Text Arena w okresie od sierpnia do września 2026 r., jak podaje BleepingComputer. Z dwunastu środków pisarskich śledzonych przez Arenę dziesięć poszło w kierunku, który platforma uważa za lepszy w porównaniu z Claude Opus 5. Więcej kontekstu na ten temat znajdziesz w naszych trendy AI.

Liczby stojące za zmianą stylu Claude’a

Główną statystyką jest zapadnięcie się myślnika. Według danych Arena Opus 5 używał 15,2 kresek na 1000 słów, podczas gdy Opus 5.5 zmniejszył tę liczbę do zaledwie 0,8, co stanowi redukcję o około 95 procent.

Średniki, kolejny nawyk interpunkcyjny często uznawany za maszynowy, również gwałtownie spadł z 6,10 do 1,64 na 1000 słów. Struktura zdań zmieniła się wraz z interpunkcją: przeciętne zdanie w odpowiedziach Opus 5.5 składa się obecnie z 10,03 słów, w porównaniu z 12,14 słów w Opus 5, przy czym analiza wykazała również prostszy dobór słów i mniejszą liczbę długich zdań złożonych ze zdań, które stały się znakiem rozpoznawczym wcześniejszych modeli.

Zbiór danych platformy Arena skupiał się na uzasadnionych odpowiedziach firmy Text Arena z okresu dwóch miesięcy, co oznacza, że ​​porównanie ogranicza się do konkretnego ustawienia oceny, a nie do codziennego użytku. Mimo to kierunek zmian jest spójny w przypadku większości wskaźników śledzonych przez platformę.

Dlaczego Em Dash stał się wizytówką AI

Kreska em zajmowała dziwną pozycję w kulturze pisania AI. Przez lata czytelnicy, redaktorzy i samozwańczy wykrywacze sztucznej inteligencji traktowali gęste rozproszenie myślników jako charakterystyczny znak prozy generowanej maszynowo, do tego stopnia, że ​​znak interpunkcyjny stał się skrótem dla szerszego zjawiska niskiej jakości treści wytwarzanych maszynowo, często odrzucanych jako „niechlujstwo AI”.

Dyskusyjne jest, czy stereotyp był kiedykolwiek wiarygodnym sygnałem, ponieważ wielu pisarzy swobodnie używa myślników, a wiele tekstów AI ich unikało. Ale percepcja miała znaczenie, szczególnie w przypadku firm, które używają dużych modeli językowych do tworzenia tekstów marketingowych, dokumentacji i artykułów i nie chcą, aby ich wyniki były odbierane jako oczywiście syntetyczne.

Na tym tle model, który wyraźnie unika wzoru, ma praktyczną zaletę. Jak zauważyło BleepingComputer w swoim raporcie, zmniejszona zależność Opus 5.5 od oczywistych wzorców pisania AI oznacza, że ​​użytkownicy rzadziej tworzą tekst, który można odczytać jako zwykły wynik maszynowy.

Kompromis: krótsze zdania, dłuższe odpowiedzi

Jedyną miarą, która poszła w złym kierunku, jest gadatliwość. Według danych Areny średnia długość odpowiedzi w Opus 5.5 wzrosła z 453 do 481 słów w porównaniu z Opus 5, co czyni go najdłużej piszącym modelem Opus w porównaniu.

Może się to wydawać niewielkim wzrostem, ale jest sprzeczne z szerszą tendencją branżową zmierzającą w kierunku bardziej zwięzłych, bardziej bezpośrednich wyników modeli i oznacza, że ​​użytkownicy spalający tokeny w wywołaniach API mogą zapłacić nieco więcej za tę samą substancję. Krótsze zdania w połączeniu z dłuższymi odpowiedziami oznaczają także ich więcej: model dzieli swoją prozę na mniejsze części, mówiąc więcej ogólnie.

Oczywiście gadatliwość nie jest automatycznie wadą. W przypadku zadań takich jak wyjaśnienia, dokumentacja i analiza kilka dodatkowych zdań może zwiększyć przejrzystość. W przypadku szybkich odpowiedzi lub obciążeń wrażliwych na koszty jest to trend, który warto obserwować.

Co to oznacza dla autorów, redaktorów i narzędzi do wykrywania

Analiza przypomina, że statystyczne odciski palców tekstu AI to ruchome cele. Narzędzia i heurystyki stworzone do oznaczania myślników, zwyczajów średników lub długości zdań ulegną pogorszeniu, gdy laboratoria będą celowo eliminować te wzorce, czy to w celu poprawy czytelności, czy po prostu uniknięcia piętna z nimi związanego.

Podkreśla również, jak bardzo konkurencja między pionierskimi modelami przesunęła się w kierunku cech, które trudno uchwycić w tradycyjnych benchmarkach. Dane Arena sugerują, że Anthropic zwraca uwagę na to, jak jej model pisze, a nie tylko na to, jak koduje. BleepingComputer zauważa, że ​​Opus 5.5 jest uważany za jeden z najmocniejszych modeli kodowania, a jakość pisania stała się cichszym wyróżnikiem na rynku, na którym większość publicznych porównań dotyczy ocen agentycznych i programistycznych.

Mała zmiana o widocznym śladzie

Nikt nie czyta tabeli benchmarków i nie zmienia swojej prozy. Jednak po przemnożeniu przez ogromną ilość tekstu, który obecnie wytwarzają codziennie duże modele językowe, 95-procentowy spadek użycia myślników to zmiana, która staje się widoczna w praktyce, jak to ujęto w raporcie, w Internecie jest coraz mniej myślników.

Na razie dania na wynos są proste. Claude Opus 5.5 pisze z mniejszą liczbą nawyków interpunkcyjnych związanych z tekstem generowanym przez sztuczną inteligencję, używa krótszych zdań i używa prostszych słów niż jego poprzednik. Mówi też trochę więcej. To, czy ta kombinacja lepiej się czyta, jest oceną indywidualnych użytkowników, ale jest to konkretny, wymierny przykład laboratoriów aktywnie zmieniających brzmienie pisania maszynowego.

---

Bądź na Bieżąco z AI

Najnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.

Czytaj więcej wiadomości AI →