קלוד אופוס 5.5 של Anthropic כמעט נטש את ה-em dash, אחד מהטיקים המוכרים ביותר של טקסט שנוצר בינה מלאכותית, על פי ניתוח חדש מפלטפורמת ההשוואה Arena. המודל משתמש כעת בערך ב-95% פחות מקפים em מאשר קודמו, כותב במשפטים קצרים יותר ומעדיף ניסוח פשוט יותר. יש פשרה אחת בולטת: התשובות שלה מתארכות.

הממצאים מגיעים מניתוח של ארנה של תגובות הגיוניות גבוהות שנאספו דרך Text Arena בין אוגוסט לספטמבר 2026, כפי שדווח על ידי BleepingComputer. מתוך 12 מדדי הכתיבה ש-Arena עקבו אחריהם, עשרה נעו במה שהפלטפורמה רואה בכיוון טוב יותר בהשוואה לקלוד אופוס 5. For more context on this story, see our ongoing AI news.

המספרים מאחורי שינוי הסטייל של קלוד

נתון הכותרת הוא קריסת מקף ה-em. Opus 5 השתמש ב-15.2 מקפים em ל-1,000 מילים, בעוד ש-Opus 5.5 ירד ל-0.8 בלבד, ירידה של כ-95%, על פי הנתונים של ארנה.

נקודה-פסיק, הרגל נוסף של פיסוק שסומן לעתים קרובות כדמוי מכונה, ירדו בחדות גם כן, מ-6.10 ל-1.64 לכל 1,000 מילים. מבנה המשפטים השתנה לצד הפיסוק: המשפט הממוצע בתגובות של אופוס 5.5 מכיל כעת 10.03 מילים, ירידה מ-12.14 מילים עבור אופוס 5, כאשר הניתוח מציין גם בחירות מילים פשוטות יותר ופחות מהמשפטים הארוכים, המוערמים בסעיפים, שהפכו לחתימת מודלים קודמים.

מערך הנתונים של Arena התמקד בתגובות הגיוניות גבוהות מ-Text Arena במשך חלון של חודשיים, מה שאומר שההשוואה מתמקדת בהגדרת הערכה ספציפית ולא לשימוש יומיומי. למרות זאת, כיוון השינוי עקבי ברוב המדדים שאחריהם עקבה הפלטפורמה.

מדוע Em Dash הפך לכרטיס הביקור של AI

מקף em תפס עמדה מוזרה בתרבות הכתיבה של AI. במשך שנים, פיזור צפוף של מקפי em טופל על ידי קוראים, עורכים וגלאי בינה מלאכותית בעיצוב עצמי כסימן מובהק לפרוזה שנוצרה על ידי מכונה, עד כדי כך שסימן הפיסוק הפך לקיצור של התופעה הרחבה יותר של תוכן שיוצר על ידי מכונה באיכות נמוכה, שלעתים קרובות נדחתה כ"שיפוע AI".

אפשר להתווכח אם הסטריאוטיפ אי פעם היה אות מהימן, מכיוון שהרבה כותבים אנושיים משתמשים במקפים בנדיבות וטקסטים רבים של AI נמנעו מהם. אבל התפיסה הייתה חשובה, במיוחד עבור עסקים שמשתמשים במודלים של שפות גדולות כדי לנסח עותק שיווקי, תיעוד ומאמרים ולא רוצים שהפלט שלהם ייקרא כמו סינתטי ברור.

על רקע זה, למודל שנמנע באופן מופגן מהדפוס יש נקודת מכירה מעשית. כפי שהבחין BleepingComputer בדוח שלה, ההסתמכות המופחתת של Opus 5.5 על דפוסי כתיבה ברורים של AI פירושה שמשתמשים נוטים פחות לייצר טקסט שנקרא כפלט מכונה גנרי.

הפשרה: משפטים קצרים יותר, תשובות ארוכות יותר

המדד היחיד שזז בדרך הלא נכונה הוא מילוליות. לפי המספרים של ארנה, אורך התשובה הממוצע של אופוס 5.5 עלה מ-453 מילים ל-481 מילים בהשוואה לאפוס 5, מה שהופך אותו לדגם האופוס בעל הכתיבה הארוכה ביותר בהשוואה.

זה אולי נראה כמו עלייה קטנה, אבל זה מנוגד למגמה רחבה יותר של התעשייה לעבר פלטי דגמים ישירים יותר, וזה אומר שמשתמשים ששורפים אסימונים בקריאות API עשויים לשלם מעט יותר עבור אותו חומר. משפטים קצרים יותר בשילוב עם תשובות ארוכות יותר מרמזים גם על יותר מהם: המודל מפרק את הפרוזה שלו לחתיכות קטנות יותר תוך שהוא אומר יותר באופן כללי.

מילולית, כמובן, אינה אוטומטית פגם. עבור משימות כמו הסברים, תיעוד וניתוח, כמה משפטים נוספים יכולים להוסיף בהירות. לתשובות מהירות או עומסי עבודה רגישים לעלות, זוהי מגמה ששווה צפייה.

מה זה אומר עבור סופרים, עורכים וכלי זיהוי

הניתוח הוא תזכורת לכך שטביעות האצבע הסטטיסטיות של טקסט בינה מלאכותית הן מטרות נעות. כלים והיוריסטיקה שנבנו כדי לסמן מקפים, הרגלי נקודה-פסיק או אורך משפט ידרדרו ככל שמעבדות מכוונות את הדפוסים הללו בכוונה, בין אם כדי לשפר את הקריאות או פשוט כדי לברוח מהסטיגמה המוצמדת אליהם.

זה גם מדגיש עד כמה התחרות בין דגמי החזית עברה לכיוון איכויות שקשה לתפוס במדדים מסורתיים. הנתונים של ארנה מצביעים על כך שאנתרופיק שמה לב לאיך המודל שלה כותב, לא רק איך הוא מקודד. BleepingComputer מציינת כי Opus 5.5 נחשב לאחד המודלים החזקים ביותר לקידוד, ואיכות הכתיבה הפכה למבדיל שקט יותר בשוק שבו רוב ההשוואות הציבוריות סובבות סביב הערכות סוכן ותכנות.

שינוי קטן עם טביעת רגל נראית לעין

אף אחד לא קורא טבלת אמת מידה ומשנה את הפרוזה שלו. אבל בהכפלה על פני נפח הטקסט העצום שמודלים בשפות גדולות מייצרים כיום מדי יום, ירידה של 95 אחוז בשימוש במקפים ב-em היא סוג השינוי שנראה בטבע, כפי שנאמר בדו"ח, פחות ופחות מקפים ב-em באינטרנט.

לעת עתה, הטייק אווי פשוט. קלוד אופוס 5.5 כותב עם פחות הרגלי פיסוק הקשורים לטקסט שנוצר בינה מלאכותית, שומר על משפטים קצרים יותר ומשתמש במילים פשוטות יותר מקודמו. זה גם מדבר קצת יותר. האם השילוב הזה קורא טוב יותר הוא שיפוט עבור משתמשים בודדים, אבל הוא דוגמה קונקרטית וניתנת למדידה של מעבדות שמעצבות מחדש באופן אקטיבי את מה שנשמע כתיבה במכונה.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →