סטארט-אפ אמריקאי בשם Abliteration.ai הפך את אחת הטכניקות ה-AI השנויות ביותר במחלוקת של קוד פתוח לשירות מסחרי, ומוכר גישה לדפדפן ול-API לדגמי משקל פתוח פופולאריים כשהכשרת הבטיחות שלהם נמחקה - כולל ה-GLM-5.3 של Z.ai שיצא לאחרונה, אחד הדגמים הפתוחים המסוגלים ביותר הזמינים כיום.
החברה לוקחת את שמה מ"אבליטרציה", שיטה המסירה את הנטייה של מודל לסרב לבקשות מזיקות. חוקרים וחובבים השתמשו בטכניקה במשך שנים, ו-Huging Face מארח אלפי דוגמניות מפוצלות. מה שחדש הוא האריזה: Abliteration.ai מארח דגמים מתוקנים בתשתית משלו, כך שכל אחד עם דפדפן אינטרנט יכול לבצע שאילתות עליהם מבלי להוריד משקולות או לשכור GPUs. TechCrunch דיווחה על הפיתוח ב-3 בספטמבר, ומאז היא ספגה בדיקה של חוקרי בטיחות שעוקבים אחר הדיון המשקולות הפתוחות שאנו עוקבים אחרנו בסיקור החדשות של AI.
מטכניקה תת-קרקעית לפלטפורמה סוהר
Abliteration.ai נוסדה בסוף השנה שעברה והתאגדה רשמית במרץ, ומעבירה את הפרקטיקה מנישת קוד פתוח של עשה זאת בעצמך למוצר מסחרי מלוטש. על ידי אירוח הדגמים עצמו, החברה מסירה שתי נקודות חיכוך בבת אחת: משתמשים כבר לא צריכים את המיומנות הטכנית כדי לבטל מודל, וגם לא את המחשוב כדי להפעיל אחד.
מייסד שותף דבון - TechCrunch הסתיר את שם משפחתו לבקשתו מכיוון שהוא נשאר מועסק בחברה אחרת - אמר שהחברה כרתה עסקאות עם מספר ספקי ענן גדולים וממומנת כולה באמצעות הכנסות לקוחות. הסטארט-אפ לא גייס הון סיכון, למרות שהוא אמר שהשיחות מתנהלות.
מה נמצאה הבדיקה של TechCrunch
החברה אומרת שמטרתה היא לאפשר "עבודת סייבר התקפית, שיתוף פעולה אדום ובדיקות סוכנים שדגמים אחרים מסרבים לעשות". TechCrunch העמיד את זה במבחן עם חשבון חינמי, וחיפש גרסה מבוטלת של GLM-5.3 דרך דפדפן אינטרנט. הכתבים ביקשו מהדגם לכתוב תוכנית Python שגונבת סיסמאות שמורות של כרום, ולייצר פרוטוקול מפורט לטיפוח פתוגן אנושי מסוכן בבית. הוא נענה בקלות לשתי הבקשות, לפי הדו"ח.
הניסוי הזה הוא לב הסיפור: משימות שדגמי הגבול המיינסטרים מסרבים באופן מוחלט זמינות כעת מאחורי טופס הרשמה, ללא עלות, בלשונית דפדפן.
טיעון ההגנה של הצוות האדום
הטענה של דבון לעסק היא הטיעון האבטחה הקלאסי: אינך יכול להתגונן מפני התנהגות שאינך יכול לשחזר. מודל שמסרב לכתוב קוד ניצול עובד מועיל מעט לצוות אדום שמנסה להבין תוקפים אמיתיים.
"התמונה הגדולה של דוגמניות מחוללות היא שהן מסוגלות לדגמן שחקנים גרועים", אמר ל-TechCrunch. "היתרון הוא שכעת המגנים יכולים לנוע מהר ככל האפשר... אני חושב שזה יאיץ את אבטחת הסייבר, שהיא סוג של נקודה מנוגדת לאינטואיציה".
בין לקוחות החברה נמנים סטארט-אפים בתחילת דרכם בבריטניה ובאירופה הבודקים את האבטחה של בנקים, חברות תעופה ומפעילים אחרים של תשתיות קריטיות. לקוח גדול אחד, אמר דבון, רד צוות סוכני בנקאות ולא יכול היה לבצע את העבודה הזו עם מודלים מסחריים ללא שינוי.
'מודל שהופך לסוציופת'
חוקרי בטיחות רואים את אותה יכולת בצורה שונה מאוד. אנדרו יון, ראש מחקר בעמותת הבטיחות בינה מלאכותית CivAI, אמר ל-TechCrunch כי אבליטרציה מאפשרת לך "לשנות את המודל כך שיהפוך לסוציופת".
"אתה יכול להקליד כאן ממש כל דבר, וזה יעמוד בו", אמר יון, והוסיף כי הוא מצפה ש"מודלים ערוכים ומבוטלים ישמשו לפגיעה בעתיד הקרוב".
במאמר דעה שפורסם לאחרונה, טען יון שאם לא ניתן למנוע באופן מציאותי את הסרת מעקה הבטיחות, ממשלות צריכות לדרוש מספקים להפעיל מסווגים שמזהים וחוסמים פעילות סייבר ונשק ביולוגי מזיקים, ועליהן לדרוש מחברות השוכרות גישה ישירה למעבדי GPU מתקדמים לאמת את זהות הלקוחות ולמנוע שירות כאשר קיים חשד לשימוש לרעה מסוכן.
מעקות בטיחות דקים וללא בדיקות זהות
לעת עתה, אמצעי ההגנה של Abliteration.ai עצמו הם מינימליים. הפלטפורמה מציעה ללקוחות שכבת מתן אופציונלית כדי שיוכלו להוסיף כל הגבלה שהם רוצים, והאתר עצמו שומר על כמה מגבלות קטנות - TechCrunch לא הצליחה לגרום למודל לייצר הוראות התאבדות, ודבון אמר שהוא עובד על אמצעים נוספים למניעת אלימות.
החברה לא מבצעת סינון מכיר את הלקוח מעבר לרישום כרטיס האשראי ששימש לתשלום. "אתה לא רוצה להיות האחראי לכך שמישהו עושה משהו מטורף... אז איפה אתה מותח את הגבול של מהי האחריות שלך כחברה?" אמר דבון. "אנחנו עדיין בתהליך להגדיר את זה".
שאלה שהתעשייה לא יכולה להתחמק ממנה
לא כל עוסק באבטחה מסכים שמודלים מבוטלים הם אפילו הכלי הטוב ביותר לבדיקות פוגעניות. אחמד עלי, מנכ"ל חברת הפבראיקס, אמר ל-TechCrunch שהחברה שלו מסתמכת יותר על דגמים בעלי משקל פתוח לכוונון עדין, שכבר נשלחים עם מעט סירובים - ומציין שביטול יכול לפגום ביכולות הבסיסיות של הדגם.
רוב המומחים ש-TechCrunch התייעץ איתו מסכימים על דבר אחד: אי אפשר להפסיק את התרגול. משקולות הניתנות להורדה אומרות שכל אחד יכול להסיר סירובים באופן מקומי, כפי שהודגשה פרשנות משנת 2026 של המרכז למאבק בטרור בווסט פוינט על שימוש לרעה ב"חיסול". השאלה הפתוחה של Abliteration.ai היא האם הורדת עלות הגישה לכולם - מגינים ותוקפים כאחד - הופכת את האינטרנט לבטוח יותר או מסוכן יותר.
הישאר לפני AI
בטיחות AI מתפתחת מדי יום. קבל את הפיתוחים האחרונים של AI במקום אחד.
קרא עוד חדשות AI →