Claude Opus 5.5 van Anthropic heeft het em-dashboard, een van de meest herkenbare tics van door AI gegenereerde tekst, vrijwel verlaten, volgens nieuwe analyse van het benchmarkingplatform Arena. Het model gebruikt nu grofweg 95 procent minder em-streepjes dan zijn voorganger, schrijft in kortere zinnen en geeft de voorkeur aan eenvoudiger bewoordingen. Er is één opmerkelijke wisselwerking: de antwoorden worden langer.
De bevindingen komen uit Arena's analyse van hoog-redenerende reacties verzameld via Text Arena tussen augustus en september 2026, zoals gerapporteerd door BleepingComputer. Van de twaalf schrijfmaatregelen die Arena volgde, gingen er tien in wat het platform als een betere richting beschouwt vergeleken met Claude Opus 5. Voor meer context over dit verhaal, zie ons AI-nieuws.
De cijfers achter Claude's stijlverandering
De belangrijkste statistiek is de ineenstorting van het em-streepje. Opus 5 gebruikte 15,2 em-streepjes per 1000 woorden, terwijl Opus 5.5 dat cijfer verlaagde tot slechts 0,8, een vermindering van ongeveer 95 procent, volgens de gegevens van Arena.
Puntkomma's, een andere interpunctiegewoonte die vaak als machine-achtig wordt bestempeld, daalden ook scherp, van 6,10 naar 1,64 per 1.000 woorden. De zinsstructuur is naast de interpunctie veranderd: de gemiddelde zin in de reacties op Opus 5.5 telt nu 10,03 woorden, tegen 12,14 woorden voor Opus 5. Uit de analyse blijkt ook dat de woordkeuze eenvoudiger is en dat er minder lange zinnen met zinsdelen zijn die kenmerkend werden voor eerdere modellen.
De dataset van Arena concentreerde zich op hoog-redenerende reacties van Text Arena gedurende een periode van twee maanden, wat betekent dat de vergelijking zich richt op een specifieke evaluatie-instelling in plaats van op dagelijks gebruik. Toch is de richting van de verandering consistent in de meeste metingen die het platform heeft gevolgd.
Waarom de Em Dash het visitekaartje van AI werd
Het em-dash nam een vreemde positie in in de AI-schrijfcultuur. Jarenlang werd een dichte verspreiding van em-streepjes door lezers, redacteuren en zelfbenoemde AI-detectoren behandeld als een veelbetekenend teken van machinaal gegenereerd proza, tot het punt dat het leesteken een afkorting werd voor het bredere fenomeen van machinaal geproduceerde inhoud van lage kwaliteit, vaak afgedaan als 'AI-slop'.
Of het stereotype ooit een betrouwbaar signaal is geweest, valt te betwijfelen, aangezien veel menselijke schrijvers em-streepjes royaal gebruiken en veel AI-teksten ze vermeden. Maar de perceptie was van belang, vooral voor bedrijven die grote taalmodellen gebruiken om marketingteksten, documentatie en artikelen op te stellen en niet willen dat hun output als overduidelijk synthetisch leest.
Tegen die achtergrond heeft een model dat het patroon aantoonbaar vermijdt een praktisch verkoopargument. Zoals BleepingComputer in zijn rapport opmerkte, betekent de verminderde afhankelijkheid van Opus 5.5 van voor de hand liggende AI-schrijfpatronen dat gebruikers minder snel tekst produceren die leest als generieke machine-uitvoer.
De wisselwerking: kortere zinnen, langere antwoorden
De enige maatstaf die de verkeerde kant op ging, is breedsprakigheid. Volgens de cijfers van Arena is de gemiddelde antwoordlengte voor Opus 5.5 gestegen van 453 woorden naar 481 woorden vergeleken met Opus 5, waardoor dit het langst geschreven Opus-model in de vergelijking is.
Dat lijkt misschien een kleine stijging, maar het druist in tegen een bredere trend in de sector naar beknoptere, directere modeloutputs, en het betekent dat gebruikers die tokens branden bij API-aanroepen mogelijk iets meer betalen voor dezelfde stof. Kortere zinnen gecombineerd met langere antwoorden impliceren ook dat ze er meer moeten zijn: het model verdeelt zijn proza in kleinere stukjes en zegt tegelijkertijd meer in het algemeen.
Breedsprakigheid is uiteraard niet automatisch een fout. Voor taken als uitleg, documentatie en analyse kunnen een paar extra zinnen duidelijkheid toevoegen. Voor snelle antwoorden of kostengevoelige werklasten is dit een trend die de moeite waard is om te bekijken.
Wat het betekent voor schrijvers, redacteuren en detectietools
De analyse herinnert ons eraan dat de statistische vingerafdrukken van AI-tekst bewegende doelen zijn. Hulpmiddelen en heuristieken die zijn gebouwd om em-streepjes, puntkomma-gewoonten of zinslengte te markeren, zullen achteruitgaan naarmate laboratoria deze patronen opzettelijk wegstemmen, hetzij om de leesbaarheid te verbeteren, hetzij eenvoudigweg om te ontsnappen aan het stigma dat eraan kleeft.
Het onderstreept ook hoeveel concurrentie tussen grensmodellen is verschoven naar kwaliteiten die moeilijk te vangen zijn in traditionele benchmarks. Uit de gegevens van Arena blijkt dat Anthropic aandacht besteedt aan de manier waarop het model schrijft, en niet alleen aan de manier waarop het codeert. BleepingComputer merkt op dat Opus 5.5 wordt beschouwd als een van de sterkste modellen voor coderen, en dat schrijfkwaliteit een stillere onderscheidende factor is geworden in een markt waar de meeste publieke vergelijkingen draaien om agentische en programmeerevaluaties.
Een kleine verandering met een zichtbare voetafdruk
Niemand leest een benchmarktabel en verandert zijn proza. Maar vermenigvuldigd met de enorme hoeveelheid tekst die grote taalmodellen nu dagelijks produceren, is een daling van 95 procent in het em-dash-gebruik het soort verschuiving dat zichtbaar wordt in het wild, zoals het rapport het stelt: steeds minder em-dashs op internet.
Voorlopig zijn de afhaalrestaurants eenvoudig. Claude Opus 5.5 schrijft met minder interpunctiegewoonten die gepaard gaan met door AI gegenereerde tekst, houdt zinnen korter en gebruikt eenvoudigere woorden dan zijn voorganger. Er wordt ook wat meer gepraat. Of die combinatie beter leest, is een oordeel voor individuele gebruikers, maar het is een concreet, meetbaar voorbeeld van laboratoria die actief een nieuwe vorm geven aan hoe machinaal schrijven klinkt.
---
Blijf Voorop met AIHet laatste AI-nieuws, analyses en doorbraken — allemaal op één plek.
Lees meer AI-nieuws →