Anthropic השיקה את OSS Scanner, שירות הסכמה חינמי המשתמש בדגמי הבינה המלאכותית החזקים ביותר של החברה - כולל קלוד מיתוס - כדי לסרוק מעת לעת פרויקטים זכאים בקוד פתוח לאיתור פרצות אבטחה ולספק דוחות באגים שנוצרו על ידי מודלים ישירות למתחילים.
השירות, שהוכרז ביום רביעי בפוסט בבלוג של החברה, הוא תוצר של שינוי שקט בעבודת האבטחה של Anthropic: המודלים שלו מצאו לאחרונה פרצות מהר יותר ממה שצוות האבטחה של Anthropic עצמו יכול לאמת אותן. עבור מפתחים שעוקבים אחר הכלים המעצבים מחדש את אבטחת התוכנה, ההשקה היא רגע משמעותי לסיקור שלנו על פיתוחי AI בתשתית קוד פתוח.
מפרויקט Glasswing לשירות ציבורי
OSS Scanner מבוסס על הניסיון של Anthropic בשימוש בקלוד לציד פגיעויות במהלך Project Glasswing, מאמץ גילוי הפגיעות הפנימי של החברה. המספרים מהעבודה הזו מסבירים מדוע אנתרופיק פותחת את הצינור לציבור.
במהלך ששת החודשים האחרונים, אנתרופיק אומרת שהדגמים האחרונים שלה הציפו יותר מ-29,000 פגיעויות של מועמדים בכמה מפרויקטי התוכנה החשובים בעולם - אך החברה הצליחה לסקור ולבחון ידנית כ-6,000 מהם. יכולת האימות האנושית, לא יכולת המודל, הפכה לצוואר הבקבוק.
צד הביקוש מספר סיפור דומה. דוחות אנתרופיים שמתחזקים שמקבלים את הדו"חות הראשונים שלהם מבקשים יותר ויותר את כל מה שיש לחברה: כמעט 5,000 דוחות כבר נשלחו ישירות למתחילים שביקשו הגשות בכמות גדולה של ממצאים לא מאומתים, כולל תיקונים.
ההקשר של היכולת הוא בולט. ב-CyberGym, אמת מידה אקדמית לאיתור פגיעות, מודלים של שפות גדולות הפכו ממציאת מתחת ל-20% מהפגיעויות בתחילת השנה שעברה ליותר מ-85% השנה, לפי Anthropic - קפיצה שהפכה דיווחי באגים של AI מרעש לממצאים ניתנים לפעולה.
איך המספרים החזיקו מעמד בבדיקה
לפני ההשקה, Anthropic אימתה את הצינור עם עשרות פרויקטים בקוד פתוח, והפיקה מאות דוחות באגים - כולל פגיעויות שלדבריה עשויות להיות מרותקות לניצול ביצוע קוד מרחוק לא מאומת.
המבחן המובהק ביותר כלל בדיקה חיצונית. אנתרופיק ביקשה מבוחני החדירה המומחים הבודקים את ממצאי חשיפת הפגיעות המתואמת (CVD) שלה לבחון 97 ממצאים קריטיים ובעלי חומרה גבוהה מהסורק, שנלקחו מ-48 פרויקטים. מתוכם, 85 - 88 אחוז - עמדו ברף של תהליך CVD של אנתרופיק. מתוך 12 הנותרים, 11 היו בעיות ידועות אמיתיות אך משוכפלות או ממצאים אחרים מאותה סריקה. רק אחד היה חיובי כוזב מוחלט.
כל דוח, אומרת החברה, מכיל מפיק עצמאי והסבר על הפגיעות, כולל חצייה כדי לקבוע מתי הפגם הוצג.
הפשרה: מהירות על ודאות
החלטת התכנון המרכזית של OSS Scanner היא גם הסיכון הגדול ביותר שלה: הדוחות נוצרים במלואם במודל, ללא סקירה או בדיקה אנושית. Anthropic מפורש שהדבר מאפשר סריקה מהירה יותר ותכופה יותר, אך גם שחלק מהדיווחים יהיו שגויים או לא חוקיים.
החברה מסגרת את הפשרה כמענה לדרישת המתחזקים. מכיוון שניתן כעת לפתח ניצולים תוך דקות, פרויקטים מעדיפים יותר ויותר לקבל כל ממצא לא מאומת באופן מיידי - עם תיקונים מוצעים מצורפים - על פני המתנה לבדיקה אנושית. בהשראת OSS-Fuzz של גוגל, שסרקה תוכנת קוד פתוח עם fuzzers במשך שנים, OSS Scanner מיישם את אותו היגיון על ניתוח קוד מונע בינה מלאכותית.
פרויקטים המעדיפים טיפול מסורתי אינם נשארים בחוץ: אנתרופיק אומרת שהיא תמשיך לחשוף ידנית דוחות פגיעות מאומתים על ידי אדם באמצעות תהליך ה-CVD הקיים שלה, במיוחד עבור פרויקטים ללא משאבים לבדיקת דוחות עצמם. מסלול מהיר אופציונלי זמין למי שרוצה ממצאים גולמיים ברגע שהם נוצרים.
מי יכול להירשם - ומה עוד הכריז אנתרופי
מנהלי ליבה של פרויקטים כשירים יכולים להירשם על ידי שליחת בקשת משיכה למאגר GitHub בעקבות תבנית פרויקט סטנדרטית. הזכאות משקפת את הקריטריונים של OSS-Fuzz: לפרויקטים צריכה להיות השפעה קריטית על התשתית ועל אבטחת המשתמשים, כאשר הקבלה נקבעת כל מקרה לגופו.
הסורק מגיע לצד מערך רחב יותר של יוזמות אבטחה אנתרופיות. תוכנית אימות הסייבר של החברה הופכת יכולות סייבר מתקדמות ומסווגים מופחתים של חסימה לזמינים לאנשי אבטחה מתאימים - תוכנית Anthropic הורחבה מוקדם יותר השבוע עם שלוש שכבות של גישה לקלוד עבור צוותי אבטחה. מאמץ נפרד של Claude for OSS מספק מנויי קלוד מקס 20x בחינם כדי לעזור למתחילים לתקן נקודות תורפה ולשפר את הפרויקטים שלהם. SiliconANGLE דיווחה גם על תוכנית אנתרופית חדשה המתמקדת בהגנה על תשתיות קריטיות, ומסגרת את הכרזות השבוע כדחיפה מתואמת לאבטחת סייבר הגנתית.
מה זה אומר לאבטחת קוד פתוח
אם OSS Scanner עובד כפי שפורסם, זה מסמן שינוי מבני באבטחת קוד פתוח: AI מוצא את הבאגים, ובני אדם עוברים מציד לאימות. השינוי הזה מעביר את הנטל האמיתי על המתחזקים, שחייבים לבדוק דוחות שנוצרו על ידי מכונה - חלקם שגויים - תוך שהם מחליטים אם לסמוך על תיקונים אוטומטיים.
שיעור האימות של 88 אחוז מצביע על כך שיחס האות לרעש כעת מספיק טוב כדי להיות שווה את זמנו של מתחזק, לפחות עבור פרויקטי תשתית קריטיים. האם המערכת האקולוגית הרחבה יותר תסכים תופיע במספרי הנרשמים - ובכמה פרויקטים נרשמים יפסיקו בשקט לאחר מבול הדוחות הראשון שלהם.
---
הישאר לפני AIקבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.
קרא עוד חדשות AI →