Згідно з новим аналізом платформи порівняльного аналізу Arena, Claude Opus 5.5 від Anthropic майже відмовився від тире, одного з найбільш впізнаваних знаків тексту, створеного штучним інтелектом. У моделі тепер використовується приблизно на 95 відсотків менше тире, ніж у її попереднику, написання коротшими реченнями та перевага простішому формулюванню. Є один помітний компроміс: його відповіді стають довшими.
Про це повідомляє BleepingComputer. Ці висновки були отримані в результаті аналізу аргументованих відповідей, зібраних за допомогою Text Arena у період із серпня по вересень 2026 року. З дванадцяти записів, які відстежувала Arena, десять рухалися в тому, що платформа вважає кращим напрямком порівняно з Claude Opus 5. For more context on this story, see our ongoing latest AI developments.
Цифри, що стоять за зміною стилю Клода
Статистика заголовка — згортання тире. Opus 5 використовував 15,2 тире em на 1000 слів, тоді як Opus 5.5 знизив цей показник лише до 0,8, скорочення приблизно на 95 відсотків, згідно з даними Arena.
Крапки з комою, інша пунктуаційна звичка, яку часто позначають як машинну, також різко впала з 6,10 до 1,64 на 1000 слів. Структура речень змінилася разом із пунктуацією: середнє речення у відповідях Opus 5.5 тепер складається з 10,03 слів, порівняно з 12,14 слів для Opus 5, при цьому аналіз також відзначає простіший вибір слів і менше довгих речень із складеними реченнями, які стали ознакою попередніх моделей.
Набір даних Arena зосереджено на обґрунтованих відповідях Text Arena протягом двомісячного вікна, що означає, що порівняння стосується конкретного налаштування оцінки, а не щоденного використання. Незважаючи на це, напрямок змін є незмінним у більшості показників, які відстежує платформа.
Чому Em Dash став візитною карткою ШІ
Тире займає дивне місце в культурі письма ШІ. Протягом багатьох років читачі, редактори та самозвані детектори штучного інтелекту сприймали щільний розкид тире як ознаку машинно-генерованої прози, аж до того, що знак пунктуації став скороченням ширшого явища низькоякісного машинно створеного контенту, який часто відкидали як «помиї штучного інтелекту».
Чи був стереотип колись надійним сигналом, залишається дискусійним, оскільки багато авторів-людей широко використовують тире, а багато текстів ШІ уникають їх. Але сприйняття мало значення, особливо для компаній, які використовують великі мовні моделі для написання маркетингової копії, документації та статей і не хочуть, щоб їхні результати сприймалися як явно синтетичні.
На цьому фоні модель, яка явно уникає шаблону, має практичну перевагу. Як зазначив BleepingComputer у своєму звіті, менша залежність Opus 5.5 від очевидних шаблонів письма штучного інтелекту означає, що користувачі з меншою ймовірністю створять текст, який читається як загальний машинний вихід.
Компроміс: коротші речення, довші відповіді
Єдина міра, яка пішла неправильно, це багатослівність. Згідно з даними Arena, середня довжина відповіді для Opus 5.5 зросла з 453 слів до 481 слова порівняно з Opus 5, що зробило його найдовшою моделлю Opus для порівняння.
Це може здатися невеликим збільшенням, але воно суперечить ширшій галузевій тенденції до коротких, більш прямих вихідних даних моделі, і це означає, що користувачі, записуючи токени під час викликів API, можуть платити трохи більше за ту саму речовину. Коротші речення в поєднанні з довшими відповідями також передбачають їх більше: модель розбиває свою прозу на менші частини, кажучи більше в цілому.
Багатослівність, звичайно, не є автоматично недоліком. Для таких завдань, як пояснення, документування та аналіз, кілька додаткових речень можуть додати ясності. Для швидких відповідей або чутливих до витрат навантажень це тенденція, на яку варто звернути увагу.
Що це означає для авторів, редакторів і інструментів виявлення
Аналіз є нагадуванням про те, що статистичні відбитки тексту ШІ є рухомими цілями. Інструменти та евристики, створені для позначення тире, звичок крапки з комою або довжини речення, погіршаться, оскільки лабораторії навмисно відрегулюють ці шаблони, чи то для покращення читабельності, чи просто для того, щоб уникнути стигми, пов’язаної з ними.
Це також підкреслює, наскільки велика конкуренція між передовими моделями змістилася в бік якостей, які важко охопити традиційними тестами. Дані Arena свідчать про те, що Anthropic звертає увагу на те, як пише її модель, а не лише на кодування. BleepingComputer зазначає, що Opus 5.5 вважається однією з найсильніших моделей для кодування, а якість написання стала менш помітною на ринку, де більшість публічних порівнянь обертається навколо оцінювання агентів і програмування.
Невелика зміна з помітним слідом
Ніхто не читає еталонну таблицю і не змінює свою прозу. Але якщо помножити на величезний обсяг тексту, який тепер створюють щодня великі мовні моделі, 95-відсоткове падіння використання тире — це той вид зміни, який стає помітним у дикій природі, як зазначено у звіті, дедалі менше й менше тире в Інтернеті.
Наразі висновки прості. Claude Opus 5.5 пише з меншою кількістю звичок пунктуації, пов’язаних із текстом, створеним штучним інтелектом, зберігає коротші речення та використовує простіші слова, ніж його попередник. Він також говорить трохи більше. Окремі користувачі вирішують, чи ця комбінація читається краще, але це конкретний, вимірний приклад лабораторій, які активно змінюють те, як звучить машинне письмо.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →