Laut einer neuen Analyse der Benchmarking-Plattform Arena hat Claude Opus 5.5 von Anthropic den Gedankenstrich, einen der bekanntesten Merkmale von KI-generiertem Text, so gut wie aufgegeben. Das Modell verwendet jetzt rund 95 Prozent weniger Gedankenstriche als sein Vorgänger, schreibt in kürzeren Sätzen und bevorzugt einfachere Formulierungen. Es gibt einen bemerkenswerten Nachteil: Die Antworten werden immer länger.
Die Ergebnisse stammen aus Arenas Analyse von Antworten mit hoher Begründung, die zwischen August und September 2026 über Text Arena gesammelt wurden, wie von BleepingComputer berichtet. Von den zwölf Schreibmaßnahmen, die Arena verfolgte, bewegten sich zehn in eine Richtung, die die Plattform im Vergleich zu Claude Opus 5 für eine bessere Richtung hält. Weitere Informationen zu dieser Geschichte finden Sie in unserer aktuelle KI-Trends.
Die Zahlen hinter Claudes Stilwechsel
Die Schlagzeilenstatistik ist der Zusammenbruch des Geviertstrichs. Opus 5 verwendete 15,2 Geviertstriche pro 1.000 Wörter, während Opus 5.5 diesen Wert auf nur 0,8 senkte, was laut Arena-Daten einer Reduzierung um rund 95 Prozent entspricht.
Semikolons, eine weitere häufig als maschinenartig bezeichnete Zeichensetzungsgewohnheit, gingen ebenfalls stark zurück, von 6,10 auf 1,64 pro 1.000 Wörter. Mit der Interpunktion änderte sich auch die Satzstruktur: Der durchschnittliche Satz in Opus 5.5-Antworten umfasst jetzt 10,03 Wörter, gegenüber 12,14 Wörtern in Opus 5, wobei die Analyse auch einfachere Wortwahlen und weniger lange Sätze mit Satzgliedern feststellte, die zu einem Markenzeichen früherer Modelle wurden.
Der Datensatz von Arena konzentrierte sich auf Antworten mit hoher Begründung von Text Arena über einen Zeitraum von zwei Monaten, was bedeutet, dass der Vergleich auf eine bestimmte Bewertungseinstellung und nicht auf die alltägliche Nutzung beschränkt ist. Dennoch ist die Richtung der Veränderung bei den meisten von der Plattform verfolgten Maßnahmen konsistent.
Warum der Em Dash zur Visitenkarte der KI wurde
Der Gedankenstrich nahm in der KI-Schreibkultur eine seltsame Stellung ein. Jahrelang wurde eine dichte Aneinanderreihung von Gedankenstrichen von Lesern, Redakteuren und selbsternannten KI-Detektoren als verräterisches Zeichen maschinengenerierter Prosa behandelt, bis hin zu dem Punkt, dass das Satzzeichen zur Abkürzung für das umfassendere Phänomen minderwertiger, maschinenproduzierter Inhalte wurde, die oft als „KI-Schwachsinn“ abgetan wurden.
Ob das Stereotyp jemals ein verlässliches Signal war, ist fraglich, da viele menschliche Autoren Bindestriche großzügig verwenden und viele KI-Texte sie vermeiden. Aber die Wahrnehmung war wichtig, insbesondere für Unternehmen, die große Sprachmodelle zum Verfassen von Marketingtexten, Dokumentationen und Artikeln verwenden und nicht möchten, dass ihre Ergebnisse offensichtlich synthetisch wirken.
Vor diesem Hintergrund hat ein Modell, das dieses Muster nachweislich vermeidet, ein praktisches Verkaufsargument. Wie BleepingComputer in seinem Bericht feststellte, bedeutet die geringere Abhängigkeit von Opus 5.5 von offensichtlichen KI-Schreibmustern, dass Benutzer weniger wahrscheinlich Texte produzieren, die als generische Maschinenausgabe gelesen werden.
Der Kompromiss: Kürzere Sätze, längere Antworten
Die einzige Maßnahme, die in die falsche Richtung ging, ist die Ausführlichkeit. Den Zahlen von Arena zufolge stieg die durchschnittliche Antwortlänge für Opus 5.5 im Vergleich zu Opus 5 von 453 Wörtern auf 481 Wörter, was es zum am längsten schreibenden Opus-Modell im Vergleich macht.
Das mag wie ein kleiner Anstieg erscheinen, aber es steht im Widerspruch zu einem breiteren Branchentrend zu knapperen, direkteren Modellausgaben und bedeutet, dass Benutzer, die Token bei API-Aufrufen verbrennen, möglicherweise etwas mehr für die gleiche Substanz bezahlen. Kürzere Sätze in Kombination mit längeren Antworten implizieren auch mehr davon: Das Modell zerlegt seine Prosa in kleinere Teile und sagt insgesamt mehr.
Ausführlichkeit ist natürlich nicht automatisch ein Fehler. Bei Aufgaben wie Erklärungen, Dokumentation und Analyse können ein paar zusätzliche Sätze für mehr Klarheit sorgen. Für schnelle Antworten oder kostensensible Arbeitslasten ist dieser Trend einen Blick wert.
Was es für Autoren, Redakteure und Erkennungstools bedeutet
Die Analyse erinnert daran, dass die statistischen Fingerabdrücke von KI-Texten bewegliche Ziele sind. Tools und Heuristiken, die darauf ausgelegt sind, Gedankenstriche, Semikolongewohnheiten oder Satzlängen zu kennzeichnen, verschlechtern sich, wenn Labore diese Muster absichtlich wegblenden, sei es um die Lesbarkeit zu verbessern oder einfach um dem damit verbundenen Stigma zu entgehen.
Es unterstreicht auch, wie stark sich der Wettbewerb zwischen Spitzenmodellen hin zu Qualitäten verlagert hat, die in herkömmlichen Benchmarks nur schwer zu erfassen sind. Die Daten von Arena deuten darauf hin, dass Anthropic darauf achtet, wie sein Modell schreibt, und nicht nur darauf, wie es codiert. BleepingComputer stellt fest, dass Opus 5.5 als eines der stärksten Modelle für Codierung gilt und die Schreibqualität in einem Markt, in dem sich die meisten öffentlichen Vergleiche auf Agenten- und Programmierbewertungen drehen, zu einem ruhigeren Unterscheidungsmerkmal geworden ist.
Eine kleine Veränderung mit sichtbarem Fußabdruck
Niemand liest eine Benchmark-Tabelle und ändert seine Prosa. Aber multipliziert mit der enormen Textmenge, die große Sprachmodelle heute täglich produzieren, ist ein Rückgang der Geviertstrich-Nutzung um 95 Prozent die Art von Verschiebung, die in freier Wildbahn sichtbar wird, wie es in dem Bericht heißt, bei immer weniger Geviertstrichen im Internet.
Im Moment sind die Imbissbuden unkompliziert. Claude Opus 5.5 schreibt mit weniger Zeichensetzungsgewohnheiten, die mit KI-generiertem Text verbunden sind, hält Sätze kürzer und verwendet einfachere Wörter als sein Vorgänger. Es wird auch etwas mehr geredet. Ob sich diese Kombination besser liest, muss der einzelne Benutzer beurteilen, aber es ist ein konkretes, messbares Beispiel dafür, dass Labore den Klang von maschinellem Schreiben aktiv umgestalten.
---
Bleib vorne bei KIDie neuesten KI-Nachrichten, Analysen und Durchbrüche – alles an einem Ort.
Mehr KI-Nachrichten lesen →