אנתרופיק חשפה את קלוד אופוס 5, דגם בינה מלאכותית חדש שלדבריה מספק מודיעין קרוב לגבול בערך במחצית המחיר מדגם ה-Fable 5 המוביל שלה. Opus 5, שיצא ב-24 ביולי 2026, הוא כעת דגם ברירת המחדל של קלוד מקס והדגם החזק ביותר הזמין בקלוד פרו, ומציב אותו כסוס העבודה היומיומי של Anthropic לקידוד, סוכנים אוטונומיים ועבודת ידע מקצועי.

ההשקה נוחתת ברגע שבו עסקים בוחנים הוצאות בינה מלאכותית. לפי CNBC, הדגם החדש "מתחרה ב-Fable 5 והוא זול יותר מכיוון שעסקים מתלבטים מעלויות", בעוד בלומברג אפיינה אותו כ"מודל חסכוני יותר למשימות יומיומיות". עבור צוותים שעוקבים אחר [פיתוחי הבינה המלאכותית] האחרונים (https://aibuzzwire.news), Opus 5 מייצג הימור מכוון ששדה הקרב התחרותי הבא הוא ערך, לא עליונות גולמית.

ביצועי בנצ'מרק: עדכניים חדשים בעבודת קידוד וידע

Anthropic מדווח כי Opus 5 מפרסם תוצאות עדכניות על הערכות קידוד ועבודת ידע, כולל Frontier-Bench ו-GDPval-AA. ב-Frontier-Bench v0.1, החברה אומרת ש-Opus 5 עולה על כל הדגמים האחרים ויותר מכפיל את הביצועים של קודמו, Opus 4.8, בעלות נמוכה יותר למשימה.

ב-CursorBench 3.2, Opus 5 מגיע בטווח של 0.5% מהציון השיא של Fable 5 תוך עלות חצי יותר למשימה, על פי המדדים של Anthropic עצמה. Decrypt ציין כי המודל "מתעלה על Fable 5 ברוב המדדים - בחצי המחיר".

הרווחים מתרחבים להערכות סוכניות ופותרות בעיות:

  • ARC-AGI 3: אופוס 5 מקבל ציונים גבוהים בערך פי שלושה מהדגם הבא הטוב ביותר במבחן חדש זה לפתרון בעיות.
  • Zapier AutomationBench: שיעור מעבר של פי 1.5 בערך מהדגם הבא הטוב ביותר באותה עלות, מדידת השלמת משימות עסקיות מקצה לקצה.
  • OSWorld 2.0 (שימוש במחשב): Opus 5 עולה על התוצאה הטובה ביותר של Fable 5 בקצת יותר משליש מהעלות.

יש לציין כי אנתרופיק מודה ש-Opus 5 "נשאר מאחורי Mythos 5 במשימות אבטחת סייבר", תחום שבו מודל חזית מתחרה שומר על ההובלה.

סוכנות ואימות עצמי חזק יותר

נושא שחוזר על עצמו בהכרזה הוא היכולת המשופרת של Opus 5 לאמת את עבודתו ולחזור על עצמה עד להצלחתה. אנתרופיק תיאר כמה דוגמאות מבדיקות גישה מוקדמת המדגישות את האוטונומיה הזו.

במשימה אחת של Frontier-Bench, המודל קיבל ציור של חלק מהמכונה והתבקש לכתוב קוד כדי לשחזר אותו כמודל 3D FreeCAD - אך בכוונה לא ניתנה לו דרך לצפות בשרטוט ישירות. לפי הדיווחים, אופוס 5 כתבה צינור ראיית מחשב משלה כדי לחלץ גיאומטריה מפיקסלים גולמיים, ולאחר מכן בנה מחדש את החלק המלא, והצליחה שוב ושוב כאשר אף דגם מתחרה לא הצליח לפתור את המשימה לאחר חמישה ניסיונות.

בהינתן באג אמיתי במנהל חבילות פופולרי בקוד פתוח, Opus 5 מצא את סיבת השורש ותיקן מקרה קצה שהתיקון של הקהילה עצמה פספס, בעוד שדגם מתחרה תיקן רק את סימפטום פני השטח והכריז שהבאג נפתר. על פי הדיווחים, מהנדס בחברת מסחר השתמש ב-Opus 5 כדי לבנות הזנת נתוני שוק לבורסה חדשה בסשן אחד - משימה שדגמים קודמים לא יכלו להשלים כלל - ומכיוון שלא מצא שום עדכון חי לאימות, הדגם בנה רתמת בדיקה משלו.

קבלת לקוחות

שותפים לגישה מוקדמת הציעו הערכות חיוביות ברובן. סקוט וו, מנכ"ל Cognition (יצרנית סוכן הקידוד של Devin), אמר ש-Opus 5 "ניגש לביצועים ברמת Fable בחצי מהעלות" ומראה "חוזק מיוחד במטלות איתור באגים קשות ומשימות ניתוח שורש". סואלה אסיף, מייסד שותף של Cursor, אמר כי הדגם מספק "אינטליגנציה ליד Fable 5 במהירות ובמחיר Opus".

ווייד פוסטר, מנכ"ל Zapier, דיווח ש-Opus 5 "עברה בראש טבלת ה-AutomationBench של Zapier מבלי להוציא יותר אסימונים מאשר דגמים קודמים של קלוד", והשלימה זרימת עבודה מלאה למניעת נטישה מקצה לקצה - סימון חשבונות בסיכון, התראה לבעלים הנכון וסיכום עבור צוותי שימור. דגמים קודמים לא עברו; אופוס 5 הגיע ב-100%.

רווחים במחקר מדעי

Anthropic הדגישה גם את השיפורים של אופוס 5 לעבודה מדעית. המודל מתעלה על אופוס 4.8 בכל אחת מהערכות מדעי החיים של Anthropic, המכסה ביולוגיה מבנית, כימיה אורגנית וביואינפורמטיקה. החברה הצביעה על שיפור של 10.2 נקודות אחוז בהשוואה לכימיה אורגנית פנימית (הסקת מבנים מולקולריים מנתוני ספקטרוסקופיה) ועל עלייה של 7.7 נקודות במטלות חיזוי תפקודי חלבון. לקוח גנומיקה אחד תיאר את המודל כמתנהג "יותר כמו מדען זהיר", מגיע לבדיקות הסטטיסטיות הנכונות ומצליב את התוצאות שלו.

אסטרטגיית התמחור

על ידי תמחור של Opus 5 באותה רמה של Opus 4.8 תוך התקרבות לאינטליגנציה של Fable 5, Anthropic מצמצמת למעשה את הפער בין הצעות הביניים למוצרי הדגל שלה. VentureBeat הגדיר את המהדורה כ"מודל AI זול יותר לקידוד, סוכנים וזרימות עבודה ארגוניות", ו-Seeking Alpha ציין כי Opus 5 הוא "קרוב וזול יותר לדגם הגבול Fable 5". החברה מציעה הגדרת "מאמץ" מתכווננת המאפשרת ללקוחות להחליף אינטליגנציה עבור מהירות ועלויות סמליות נמוכות יותר, תוך כוונון עדין של יחס העלות לביצועים לכל משימה.

מה זה אומר עבור מירוץ AI

Opus 5 מדגיש באיזו מהירות העלות של AI קרוב לגבול יורדת. מודל שמגיע במרחק נגיעה מהמערכות הכי יכולות שיש - בחצי מהמחיר הסמלי - לוחץ על המתחרים להצדיק תמחור פרימיום עבור רווחים שוליים. כאשר Anthropic, OpenAI, Google ואחרות דוהרות להפוך דגמים בעלי יכולת סבירים מספיק עבור פריסה יומיומית בקנה מידה גדול, השאלה עבור ארגונים עוברת מ"איזה דגם הוא החכם ביותר?" ל"איזה דגם מספק הכי הרבה אינטליגנציה לדולר?"

עבור אנתרופיק, המסר ברור: חשיבה מתקדמת היא כבר לא מוצר מותרות. Opus 5 מביא את היכולת הצמודה לגבול לנקודת מחיר שהופכת את הפריסה היומיומית המתמשכת למציאותית - וזה עשוי להתגלות כפרט המשמעותי מכולם.

הישאר לפני AI

קלוד אופוס 5 זמין החל מהיום בקלוד פרו, קלוד מקס, ודרך ה-API של Anthropic. למידע נוסף על הסיפור הזה ועל נוף הבינה המלאכותית הרחב יותר, התעדכן בחדשות הבינה המלאכותיות בזמן שזה קורה.

קרא עוד חדשות AI →