חוקרי אבטחה ב-Searchlight Cyber ​​הוכיחו שמודל הקידוד GPT-5.6 של OpenAI יכול לחשוף פגיעות רצינית של ביצוע קוד מרחוק בוורדפרס תמורת כ-25 דולר בעלויות API, ממצא שמגבש דאגה גוברת לגבי האופן שבו ניתן לנצל כלי AI חזיתיים כדי למצוא פגמים שניתנים לניצול בשבריר משווי השוק השחור שלהם.

המחקר, שפורסם באתר של Searchlight Cyber, מראה כי חוקר יחיד, חמוש ב-GPT-5.6 Sol Ultra ובבסיס קוד וורדפרס פגיע במכוון, הצליח לזהות שרשרת המובילה מגישה מוקדמת לאימות כל הדרך לביצוע קוד מרחוק. התוצאה נוחתת במרכזו של דיון מתבשל על פוטנציאל האבטחה ההתקפי של מודלים של שפות גדולות, נושא שמעקב אחר [פיתוחי בינה מלאכותית] (https://aibuzzwire.news).

תגלית של $25 בשוק של $500,000

הכותרת של המחקר היא הכלכלה הקשה שלו. ברוקרים מנצלים, המתווכים שקונים נקודות תורפה ומוכרים אותן מחדש לממשלות ולקונים פרטיים, ישלמו עד 500,000 דולר עבור פגם אמין בביצוע קוד מרחוק של וורדפרס, לפי Searchlight Cyber. וורדפרס מפעילה כ-40 אחוז מכל אתרי האינטרנט, מה שהופך באג RCE לבעל ערך יוצא דופן.

לעומת מדד זה, כ-25 דולר שהוציא החוקר על קריאות API ל-GPT-5.6 כדי למצוא את הפגם, עוצרים. העבודה לא דרשה צוות גדול, תשתית מטושטשת מיוחדת או שבועות של ביקורת ידנית. במקום זאת, היא הסתמכה על הכוונת מודל קידוד מסוגל להגיב על קוד המקור של וורדפרס מהעקרונות הראשונים.

החוקרים פרסמו כלי בודק חינמי, wp2Shell.com, כך שמנהלי מערכת יכולים לקבוע אם מופעי וורדפרס שלהם מושפעים. הם אמרו שהם עצרו את פרטי הפרסום המלאים כדי לתת למגינים זמן להגיב.

איך הדגם מצא את הפגם

בלב הגילוי עומדת מערכת ה-hook של וורדפרס, המנגנון שנותן לפלטפורמה את מערכת התוספים העצומה שלה. הוקס, עם שמות כמו `wp_enqueue_scripts` או `publish_post`, מאפשרים לפלאגינים לצרף התנהגות מותאמת אישית כמעט לכל שלב במחזור החיים של וורדפרס. הם מחולקים לפעולות, שמבצעות תופעות לוואי, ומסננים, שמשנים נתונים בזמן שהם עוברים דרכם.

הגמישות הזו היא גם משטח התקפה רחב ידיים. המשימה שהציבו החוקרים הייתה למצוא שרשרת המאפשרת ביצוע קוד מרחוק מנקודת התחלה לא מאומתת, כשההצלחה מוגדרת כיכולת לקרוא קובץ מוגן ממערכת הקבצים של השרת.

GPT-5.6 Sol Ultra, מודל הקידוד ממוקד-היגיון של OpenAI, עבד דרך הניתוח על ידי בחינת האופן שבו הנתונים זורמים דרך ה-hooks של וורדפרס ואל פעולות שעלולות להיות מסוכנות. כוחו של המודל לא טמון בחיפוש עיוור אחר דפוסים, אלא בחשיבה לגבי האינטראקציות בין רכיבים, יכולת שהשתפרה בצורה ניכרת עם שחרור מודלים ממוקדי חשיבה אחרונים.

החוקרים מסגרו את התרגיל סביב מאגר המכיל עותק פגיע של וורדפרס, הגדרה הדומה לאתגר לכידת הדגל שבו הצלחה פירושה חילוץ קובץ דגל. אבל הם הדגישו שמחלקת הפגיעות הבסיסית היא אמיתית ומשפיעה על פריסות ייצור של MySQL, מסד הנתונים שמאחורי רוב אתרי וורדפרס חיים.

הדילמה הדו-שימושית

הממצא נוחת כשחברות בינה מלאכותית עומדות בפני בדיקה מעמיקה לגבי האופן שבו ניתן לעשות שימוש לרעה במודלים שלהן. מודלים של Frontier מוערכים יותר ויותר בשל יכולתם לסייע בעבירות סייבר, והתוצאות הפכו לא נוחות יותר ככל שהיכולות מטפסות. מודל שיכול לגלח את העלות של מציאת באג קריטי ממאות אלפי דולרים למחיר של כמה קפה מעצב מחדש את נוף האיומים בדרכים קונקרטיות.

המגינים טוענים שאותה יכולת מאיצה עבודת הגנה, ועוזרת לצוותי אבטחה למצוא ולתקן פגמים לפני שתוקפים עושים זאת. Searchlight Cyber ​​עצמה תופסת את שני הצדדים של הקו הזה, ומציעה ניהול משטח התקפות וכלי ניטור אינטרנט אפלים תוך פרסום מחקר פוגעני. בודק wp2Shell מגלם את המקרה ההגנתי: הפוך את הגילוי למשהו שמנהלי מערכת יכולים לפעול עליו באופן מיידי.

אבל קשה להתעלם מהחוסר סימטריה. לחוקר בודד עם מפתח API יש כעת גישה לכוח ביקורת שפעם דרש צוות ממומן היטב. ככל שהעלות של מציאת נקודות תורפה יורדת, הנטל עובר למהירות ולקנה המידה שבהן ניתן לתקן אותן.

מה זה אומר עבור וורדפרס ומעבר לכך

עבור המערכת האקולוגית של וורדפרס, המחקר הוא תזכורת לכך שארכיטקטורת ה-hook של הפלטפורמה, הבסיס לכלכלת התוספים שלה, היא גם נקודת התורפה התוצאתית ביותר שלה. מפעילי אתרים מוזמנים להפעיל את בודק wp2Shell, לעדכן את התוספים ואת הליבה ולהגביל את מה שמשתמשים לא מאומתים יכולים להגיע אליהם.

באופן רחב יותר, הניסוי הוא נקודת נתונים בוויכוח שזז במהירות על היכן צריך לעמוד הגבול בין מחקר אבטחה פתוח לבין התפשטות יכולת AI התקפית. ככל שדגמי קידוד יגדלו יותר מסוגלים, הדגמות כמו זו צפויות להיות נפוצות יותר, לא פחות.

הישאר לפני AI

המפגש בין AI ואבטחת סייבר נע מהר יותר ממה שכל צוות בודד יכול לעקוב. לדיווח על מחקר AI פוגעני, כלים הגנתיים ודיוני המדיניות הבאים, עקוב אחר סיקור תעשיית AI ב-AI Buzz Wire.

קרא עוד חדשות AI →