بر اساس تحلیل جدید پلتفرم بنچمارک آرنا، Claude Opus 5.5 متعلق به Anthropic، خط em dash را که یکی از قابل تشخیص ترین تیک های متن تولید شده توسط هوش مصنوعی است، کنار گذاشته است. این مدل اکنون تقریباً 95 درصد کمتر از مدل قبلی خود از خط تیره em استفاده می کند، در جملات کوتاه تر می نویسد و از جمله بندی ساده تر استفاده می کند. یک مبادله قابل توجه وجود دارد: پاسخ های آن طولانی تر می شوند.
طبق گزارش BleepingComputer، این یافتهها از تجزیه و تحلیل پاسخهای منطقی Arena بدست آمده است که از طریق Text Arena بین آگوست و سپتامبر 2026 جمعآوری شده است. از دوازده سنجه نوشتن که Arena ردیابی شد، ده مورد به سمتی حرکت کردند که پلتفرم در مقایسه با Claude Opus 5 جهت بهتری را در نظر میگیرد. For more context on this story, see our ongoing breaking AI news.
اعداد پشت تغییر سبک کلود
آمار تیتر سقوط خط em است. براساس دادههای Arena، Opus 5 از 15.2 em در هر 1000 کلمه استفاده میکرد، در حالی که Opus 5.5 این رقم را به 0.8 کاهش داد که تقریباً 95 درصد کاهش داشت.
نقطه ویرگول، یکی دیگر از عادت های نقطه گذاری که اغلب به عنوان ماشین مانند علامت گذاری می شود، به شدت کاهش یافت، از 6.10 به 1.64 در هر 1000 کلمه. ساختار جملات در کنار علائم نگارشی تغییر کرد: میانگین جمله در پاسخهای Opus 5.5 اکنون 10.03 کلمه است که در مقایسه با 12.14 کلمه برای Opus 5 کاهش یافته است، با تجزیه و تحلیل همچنین انتخاب کلمات سادهتر و تعداد جملات طولانی و بند-انباشته کمتری که به امضای مدلهای قبلی تبدیل شدند، اشاره میکند.
مجموعه داده Arena بر پاسخهای با استدلال بالا از Text Arena در یک پنجره دو ماهه متمرکز شده است، که به این معنی است که این مقایسه به جای استفاده روزمره، به یک تنظیم ارزیابی خاص محدود میشود. با این حال، جهت تغییر در اکثر معیارهایی که پلتفرم ردیابی کرده است، سازگار است.
چرا Em Dash به کارت تلفن هوش مصنوعی تبدیل شد
em dash جایگاه عجیبی در فرهنگ نوشتن هوش مصنوعی داشت. برای سالها، خوانندگان، ویراستاران، و آشکارسازهای هوش مصنوعی خود بهعنوان نشانهای از نثر تولید شده توسط ماشین، پراکندگی انبوه خط تیرهها را تلقی میکردند، تا جایی که علامت نقطهگذاری به خلاصهنویسی برای پدیده گستردهتر محتوای کمکیفیت و تولید شده توسط ماشین تبدیل شد، که اغلب به عنوان «شیب هوش مصنوعی» رد میشد.
اینکه آیا این کلیشه همیشه یک سیگنال قابل اعتماد بوده است قابل بحث است، زیرا بسیاری از نویسندگان انسانی از خط تیره ها به طور آزادانه استفاده می کنند و بسیاری از متون هوش مصنوعی از آنها اجتناب می کنند. اما این تصور مهم بود، به ویژه برای مشاغلی که از مدلهای زبان بزرگ برای پیشنویس نسخههای بازاریابی، اسناد و مقالات استفاده میکنند و نمیخواهند خروجی آنها بهطور آشکار ترکیبی خوانده شود.
در مقابل آن پسزمینه، مدلی که بهطور آشکار از الگو اجتناب میکند، نقطه فروش عملی دارد. همانطور که BleepingComputer در گزارش خود مشاهده کرد، کاهش اتکای Opus 5.5 به الگوهای نوشتاری واضح هوش مصنوعی به این معنی است که کاربران کمتر احتمال دارد متنی را تولید کنند که به عنوان خروجی دستگاه عمومی خوانده شود.
معامله: جملات کوتاه تر، پاسخ های طولانی تر
یکی از معیارهایی که به راه اشتباه حرکت کرد، پرحرفی است. با توجه به اعداد Arena، میانگین طول پاسخ برای Opus 5.5 از 453 کلمه به 481 کلمه در مقایسه با Opus 5 افزایش یافته است که طولانیترین مدل Opus را در مقایسه با آن مینویسد.
این ممکن است افزایش کمی به نظر برسد، اما برخلاف روند صنعت گستردهتر به سمت خروجیهای مدل کوتاهتر و مستقیمتر است، و به این معنی است که کاربرانی که توکنها را در تماسهای API میسوزانند ممکن است برای همان ماده کمی بیشتر بپردازند. جملات کوتاهتر همراه با پاسخهای طولانیتر نیز دلالت بر تعداد بیشتری از آنها دارد: مدل نثر خود را به قطعات کوچکتر تقسیم میکند و در عین حال کلیتر میگوید.
البته پرحرفی به طور خودکار یک نقص نیست. برای کارهایی مانند توضیحات، مستندسازی و تجزیه و تحلیل، چند جمله اضافی می توانند وضوح را به شما اضافه کنند. برای پاسخهای سریع یا بار کاری حساس به هزینه، روندی است که ارزش تماشا کردن دارد.
چه معنایی برای نویسندگان، ویراستاران و ابزارهای تشخیص دارد
این تحلیل یادآوری می کند که اثر انگشت آماری متن هوش مصنوعی اهداف متحرک هستند. ابزارها و اکتشافیهایی که برای علامتگذاری خط تیرهها، عادتهای نقطه ویرگول یا طول جملات ساخته شدهاند، از آنجایی که آزمایشگاهها عمداً این الگوها را حذف میکنند، چه برای بهبود خوانایی یا صرفاً برای فرار از انگ متصل به آنها، تنزل مییابند.
همچنین نشان میدهد که چقدر رقابت در بین مدلهای مرزی به سمت کیفیتهایی که در معیارهای سنتی به سختی به دست میآیند تغییر کرده است. دادههای Arena نشان میدهد که Anthropic به نحوه نوشتن مدل خود توجه میکند، نه فقط به نحوه کدگذاری. BleepingComputer اشاره میکند که Opus 5.5 به عنوان یکی از قویترین مدلها برای کدنویسی در نظر گرفته میشود، و کیفیت نوشتن در بازاری که اکثر مقایسههای عمومی حول ارزیابیهای عامل و برنامهنویسی میچرخد، به عاملی آرامتر تبدیل شده است.
یک تغییر کوچک با ردپایی قابل مشاهده
هیچ کس جدول معیار را نمی خواند و نثر خود را تغییر نمی دهد. اما با چند برابر شدن حجم عظیم متنی که مدلهای زبان بزرگ اکنون روزانه تولید میکنند، کاهش 95 درصدی در استفاده از خط خطی، نوعی تغییر است که در طبیعت قابل مشاهده است، همانطور که گزارش میگوید، خط تیرههای کمتر و کمتری در اینترنت مشاهده میشود.
در حال حاضر، غذای آماده ساده است. Claude Opus 5.5 با عادات نگارشی کمتر مرتبط با متن تولید شده توسط هوش مصنوعی می نویسد، جملات را کوتاه تر نگه می دارد و از کلمات ساده تری نسبت به نسخه قبلی خود استفاده می کند. همچنین کمی بیشتر صحبت می کند. این که آیا این ترکیب بهتر خوانده میشود یا نه، برای تک تک کاربران قضاوت میکند، اما این یک مثال عینی و قابل اندازهگیری از آزمایشگاههایی است که به طور فعال به شکلی شبیه به نوشتن ماشینی شکل میدهند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →