Anthropics Claude Opus 5.5 har nästan övergivit em dash, en av de mest igenkännliga ticsen i AI-genererad text, enligt ny analys från benchmarking-plattformen Arena. Modellen använder nu ungefär 95 procent färre em-streck än sin föregångare, skriver i kortare meningar och föredrar enklare formuleringar. Det finns en anmärkningsvärd avvägning: dess svar blir längre.
Resultaten kommer från Arenas analys av högresonerande svar som samlats in genom Text Arena mellan augusti och september 2026, enligt rapporter från BleepingComputer. Av de tolv skrivmåtten Arena spårade rörde sig tio i vad plattformen anser vara en bättre riktning jämfört med Claude Opus 5. For more context on this story, see our ongoing breaking AI news.
Siffrorna bakom Claudes stilskifte
Rubrikstatistiken är kollapsen av em-strecket. Opus 5 använde 15,2 em-streck per 1 000 ord, medan Opus 5,5 sänkte den siffran till bara 0,8, en minskning med ungefär 95 procent, enligt Arenas data.
Semikolon, en annan interpunktionsvana som ofta flaggas som maskinliknande, sjönk också kraftigt, från 6,10 till 1,64 per 1 000 ord. Meningsstrukturen ändrades tillsammans med skiljetecken: den genomsnittliga meningen i Opus 5.5-svar har nu 10,03 ord, en minskning från 12,14 ord för Opus 5, där analysen också noterar enklare ordval och färre av de långa, satsstaplade meningarna som blev en signatur för tidigare modeller.
Arenas datauppsättning fokuserade på högkvalitativa svar från Text Arena under ett tvåmånadersfönster, vilket innebär att jämförelsen är anpassad till en specifik utvärderingsinställning snarare än vardaglig användning. Ändå är förändringens riktning konsekvent över de flesta av de åtgärder som plattformen spårade.
Varför Em Dash blev AI:s telefonkort
Em-strecket intog en märklig position i AI-skrivkulturen. I åratal behandlades en tät spridning av em-streck av läsare, redaktörer och egenutformade AI-detektorer som ett tecken på maskingenererad prosa, till den grad att skiljetecken blev en förkortning för det bredare fenomenet med lågkvalitativt maskinproducerat innehåll, ofta avfärdat som "AI-slop".
Huruvida stereotypen någonsin var en pålitlig signal kan diskuteras, eftersom många mänskliga författare använder em-streck frikostigt och många AI-texter undvek dem. Men uppfattningen spelade roll, särskilt för företag som använder stora språkmodeller för att utarbeta marknadsföringsexemplar, dokumentation och artiklar och inte vill att deras utdata ska läsas som uppenbart syntetiska.
Mot den bakgrunden har en modell som bevisligen undviker mönstret ett praktiskt försäljningsargument. Som BleepingComputer observerade i sin rapport innebär Opus 5.5:s minskade beroende av uppenbara AI-skrivmönster att användare är mindre benägna att producera text som läses som generisk maskinutdata.
Avvägningen: kortare meningar, längre svar
Det enda mått som rörde sig åt fel håll är omfång. Enligt Arenas siffror ökade den genomsnittliga svarslängden för Opus 5.5 från 453 ord till 481 ord jämfört med Opus 5, vilket gör den till den Opus-modell som skriver längst i jämförelsen.
Det kan tyckas vara en liten ökning, men det strider mot en bredare branschtrend mot tunnare, mer direkta modellutgångar, och det betyder att användare som bränner tokens på API-anrop kan betala något mer för samma ämne. Kortare meningar i kombination med längre svar innebär också fler av dem: modellen delar upp sin prosa i mindre bitar samtidigt som den säger mer överlag.
Ordspråkighet är naturligtvis inte automatiskt ett fel. För uppgifter som förklaringar, dokumentation och analys kan några extra meningar ge klarhet. För snabba svar eller kostnadskänsliga arbetsbelastningar är det en trend värd att titta på.
Vad det betyder för författare, redaktörer och upptäcktsverktyg
Analysen är en påminnelse om att de statistiska fingeravtrycken av AI-text är rörliga mål. Verktyg och heuristik byggda för att flagga em-streck, semikolonvanor eller meningslängd kommer att försämras när laboratorier medvetet stämmer bort dessa mönster, oavsett om det är för att förbättra läsbarheten eller helt enkelt för att undkomma det stigmat som är kopplat till dem.
Det understryker också hur mycket konkurrensen mellan frontiermodeller har skiftat mot kvaliteter som är svåra att fånga i traditionella riktmärken. Arenas data tyder på att Anthropic uppmärksammar hur dess modell skriver, inte bara hur den kodar. BleepingComputer noterar att Opus 5.5 betraktas som en av de starkaste modellerna för kodning, och skrivkvalitet har blivit en tystare differentiator på en marknad där de flesta offentliga jämförelser kretsar kring agent- och programmeringsutvärderingar.
En liten förändring med ett synligt fotavtryck
Ingen läser en benchmarktabell och ändrar sin prosa. Men multiplicerat över den enorma volym text som stora språkmodeller nu producerar dagligen, är en 95-procentig minskning av användningen av em-streck den typ av förändring som blir synlig i naturen, som rapporten uttryckte det, färre och färre em-streck på internet.
För närvarande är takeaways enkla. Claude Opus 5.5 skriver med färre av de skiljetecken som är förknippade med AI-genererad text, håller meningar kortare och använder enklare ord än sin föregångare. Den pratar också lite mer. Huruvida den kombinationen läser bättre är en bedömning för enskilda användare, men det är ett konkret, mätbart exempel på att laboratorier aktivt omformar hur maskinskrivande låter.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →