אנתרופיק הודיעה ביום שלישי על הרחבה משמעותית של מאמצי הגישה למודלים ממוקדי אבטחה שלה, תוך מבנה מחדש של יוזמת הגישה הבודקת שלה לתוכנית אימות סייבר (CVP) רשמית עם שלוש שכבות נפרדות למקצועני אבטחת סייבר. המהלך מגיע כשהחברה חשפה שיוזמת Project Glasswing שלה חשפה לפחות 129,000 פרצות תוכנה מאומתות מאז אפריל.
התוכנית המחודשת מאפשרת לצוותי אבטחה שנבדקו להפעיל את הדגמים המסוגלים ביותר של Anthropic - כולל קלוד אופוס 5.5, קלוד סונט 5.5 וקלוד מיתוס 5.1 - עם אמצעי הגנה מופחתים ומסווגים חוסמים, הרשאות שבדרך כלל אינן זמינות למשתמשים כלליים. לפי Anthropic, המטרה היא להעביר את יכולות הבינה המלאכותית הגבולית לידיים של מגינים לפני ששחקנים זדוניים יפעילו את אותם כלים. For more context on this story, see our ongoing AI trends.
שלוש שכבות גישה, שלושה תרחישי איום
התוכנית החדשה מאורגנת סביב שלוש רמות גישה, כל אחת מותאמת לסוג אחר של עבודת אבטחה:
- Defense Access מכסה פעולות הגנה כגון תגובה לאירועים, הנדסה לאחור של תוכנות זדוניות וניתוח ואימות פגיעות.
- Red Team Access מוסיפה בדיקות חדירה מורשות ו-red teaming למקרים של שימוש הגנתי, ומאפשרת התקפות מדומה נגד מערכות שיש לארגונים הרשאה לבדוק.
- גישה מיוחדת נושאת הכי מעט אמצעי הגנה ושמורה לקבוצה מוגבלת של ארגונים מאומתים המורשים לבדוק מערכות בטיחות בינה מלאכותית בעצמם.
ארגונים וצוותי אבטחה בודדים מגישים בקשה לשכבה שתואמת את עבודתם, ואנתרופיק סוקרת כל אפליקציה לפני מתן גישה. החברה אמרה כי כל שלושת השכבות כוללות גישה לדגמי הדגל הנוכחיים שלה, כמו גם לדגמים חדשים ששוחררו בעתיד.
Safeguards Still Bite — באופן סלקטיבי
אנתרופיק שילב את ההכרזה עם נתוני הערכה שנועדו להראות שמערכת השכבות מפרידה בין עבודה הגנתית מיטיבה ליכולת מסוכנת באמת. בהערכת CyScenarioBench על קלוד אופוס 5.5, החברה דיווחה כי אמצעי הגנה חסמו 46 מתוך 50 משימות בשכבת הגישה להגנה. בשכבת Red Team Access באותו דגם, אף אחת מהמשימות לא נחסמה, והמודל השלים 34 מתוך 50 - אותו שיעור השלמה שנרשם כאשר לא הוחלו אמצעי הגנה כלל.
לעומת זאת, ללא גישת CVP, כל משימה נחסמה בהנחיה הראשונה, לפי Anthropic.
"הערכות אלו נותנות לנו ביטחון בכך שנוכל להפוך יכולות סייבר מתקדמות לזמינות בבטחה לקבוצה רחבה יותר של מגינים, ולהרחיב את מאמצי ההגנה שהתחלנו עם Project Glasswing", אמרה החברה בהודעתה, שדווחה בהרחבה על ידי האקר ניוז, רויטרס ו-SecurityWeek.
העיצוב משקף הימור שרוב עבודת האבטחה ההגנתית - תיקון, ניתוח יומנים, ניסוי תוכנות זדוניות - יכולה להמשיך תחת מעקות בטיחות קפדניים, בעוד שבדיקות התקפיות לגיטימיות זקוקות למסדרון רחב יותר. זה גם משקף את האופן שבו תעשיית האבטחה טיפלה זמן רב בכלים דו-שימושיים: בדוק את המתרגל, לא רק את הכלי.
טביעת הרגל המתרחבת של Glasswing
הרחבת התוכנית קשורה קשר הדוק ל-Project Glasswing, היוזמה של Anthropic ליישם את המודלים שלה על התקשות תוכנה קריטית. החברה אמרה ש- Glasswing חשפה לפחות 129,000 פרצות תוכנה מאומתות בין אפריל ליולי 2026, ועוד 5,500 פרצות מאומתות בין אפריל לאוקטובר באמצעות מאמצי סריקה בקוד פתוח.
מבין הפגיעויות המאומתות, יותר מ-33,000 דורגו עד כה כקריטיות או בדרגת חומרה גבוהה - נתון שאנתרופיק מתאר כסביר כי הוא חסר ספירה משמעותית, מכיוון שהיא מסתמכת על נתוני סקר רק מקבוצת משנה של שותפי Glasswing. החברה מעריכה שההשפעה האמיתית יכולה להיות לפחות פי חמישה יותר.
תצוגה מדודה של גילוי פגיעות מונעת בינה מלאכותית
ניתוח בלתי תלוי מצביע על כך שהמבול של פגמים שנמצאו בינה מלאכותית אינו מתורגם ישירות לגל תואם של הפרות מנוצלות. בניתוח שפורסם בסוף החודש שעבר, חוקר VulnCheck פטריק גאריטי מצא שרק 2 מתוך 300 נקודות התורפה שהתגלו על ידי Anthropic או Project Glasswing - בערך 0.67 אחוז - נוצלו בטבע.
שני הפגמים המנוצלים הם CVE-2026-26980, פגיעות של הזרקת SQL ב-Ghost CMS, ו-CVE-2026-61500, פגם בזיוף הפעלה ב-Rejetto HTTP File Server. הנתונים תומכים בניואנס שחוקרי אבטחה הדגישו: AI מוריד את המחסום לגילוי פגיעות, אבל רוב הפגמים שהוא מעלה מעולם לא היו על המכ"מים של התוקפים.
ההכרזה נוחתת גם על רקע ויכוח רחב יותר על עבודת אבטחה שנוצרת בינה מלאכותית. מחקר של 1Password ו-Veracode הראה שתיקוני פגיעות שנכתבו ב-AI יכולים בעצמם להציג פגמים חדשים, מה שמדגיש כי אוטומציה מסייעת אך אינה מחליפה אימות אנושי.
משמעות הדבר עבור תעשיית האבטחה
עבור צוותי אבטחה, ה-CVP מוריד את אנרגיית ההפעלה לשימוש במודלים חזיתיים בעבודה הגנתית אמיתית. מגיבים לאירועים זוכים בנתיב מאושר לסיוע בניתוח תוכנות זדוניות; בודקי חדירה מקבלים סביבה מבוקרת להתקפות בסיוע בינה מלאכותית; והקבוצה הקטנה של ארגונים המבקרים מערכות בטיחות AI בעצמם זוכה לגישה הכי פחות מוגבלת.
עבור Anthropic, התוכנית היא גם אסטרטגיית בטיחות וגם מסחרית. זה קונקרטיז את עמדת החברה לפיה יש לשחרר יכולות סייבר חזקות במכוון, למגנים בדוקים, במקום לדכא לחלוטין - בניגוד ליריבים שעמדו בפני בדיקה מדוקדקת של דגמים עם בקרת סייבר חלשה יותר. זה גם מעמיק את הקשרים של Anthropic עם הארגונים שסביר להניח שישלמו עבור גישה למודלים חזיתיים: ממשלות, מפעילי תשתית קריטית וספקי אבטחה גדולים.
החברה לא הודיעה על שינויים בתמחור הקשורים לתוכנית, והבקשות מעובדות דרך ערוצי הגישה הבודקים הקיימים של Anthropic. בהתחשב בקנה המידה של מה ש- Glasswing כבר צץ - וההודאה של החברה עצמה שהמספרים כנראה ממעיטים במציאות - תעשיית האבטחה תראה כמה מתוך 129,000 הממצאים האלה מתוקנים לפני שהתוקפים ימצאו אותם תחילה.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →