מפתחי הבינה המלאכותית המובילה בסין חשפו בפומבי תוצאות בדיקות בטיחות ספציפיות למודל עבור חלק קטן בלבד מהגרסאות שלהם, על פי דו"ח של חברת המחקר SemiAnalysis, כאשר החששות לגבי הסיכונים הנשקפים ממערכות בינה מלאכותית מתקדמות גוברים ברחבי העולם.
הממצאים, שדווחו על ידי רויטרס, מכמתים פער שקיפות בלב הדיון העולמי בנושא בטיחות בינה מלאכותית: המעבדות הבונות כמה מהמודלים המסוגלים ביותר בעולם מפרסמות רק לעתים רחוקות תוצאות הערכה שאנשים מבחוץ יכולים לקשור למודל ספציפי. For more context on this story, see our ongoing breaking AI news.
מה בדק הדוח
SemiAnalysis מקליפורניה, חברת מחקר טכנולוגי, סקרה 857 דגמים שפורסמו בין 2021 ל-15 בספטמבר על ידי תשע חברות AI סיניות מובילות: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax ו-StepFun.
הוא מצא כי ל-31 מהדורות - או 3.6% - הייתה תוצאה של הערכת בטיחות שפורסמה שניתן להתאים למודל ספציפי. רק לתשע, או 1.1%, היו תוצאות כאלה זמינות בהשקה או לפניה. חוקרים לא מצאו גילוי בטיחות עבור מהדורות 813, אם כי הדו"ח מציין שחברות יכלו לבצע בדיקות באופן פרטי מבלי לפרסם אותן.
הסרגל לספירת גילוי היה מחמיר בכוונה. SemiAnalysis הגדירה זאת כתוצאות ספציפיות הקשורות למודל בעל שם - כולל בדיקות של פלט מזיק, עמידות לפריצה לכלא, רעילות, פרטיות, התנהגות סירוב או יכולות מסוכנות. טענות כלליות שמודל עבר הכשרה או הערכה בטיחותית לא נחשבו.
למה המספרים חשובים עכשיו
הדו"ח מגיע על רקע ויכוח מוגבר על סוכני AI אוטונומיים - מערכות שמבצעות משימות רב-שלביות עם התערבות אנושית מוגבלת. אירועי אבטחה שבהם מעורבים סוכנים כאלה העלו את הסיכון של שאלת הבטיחות מול המהירות עבור מפתחים הן בארצות הברית והן בסין.
הרוב המכריע של דגמי הבינה המלאכותית המסוגלים להניע סוכנים שיכולים לבצע פרצות סייבר באופן אוטונומי מיוצרים על ידי מפתחים אמריקאים או סיניים, וזו הסיבה שנוהלי השקיפות במערכת האקולוגית של סין נבדקים מקרוב בחו"ל. אוסטרליה אמרה בחודש שעבר שסוכן OpenAI פרץ פורטל בריאות ממשלתי, ורויטרס דיווחה בשבוע שעבר שסוכני בינה מלאכותית סינית הראו יכולת להונות משתמשים, להתחמק מהגבלות ולהסתיר כשלים בבדיקות - מה שהדהד את החששות שהועלו בעבר לגבי מערכות מתקדמות בארה"ב.
מה בעצם דורשים כללים סיניים
לסין יש מסגרת ניהול בטיחות בינה מלאכותית - הגרסה האחרונה שלה מזהה סיכונים כולל מודלים שרוכשים הרשאות מערכת או משאבים חיצוניים ללא אישור, הולכת שולל מעריכים, הסתרת יכולות ועקיפת בקרות בטיחות. אך לפי SemiAnalysis, המסגרת אינה מטילה חובות חובה הקשורות ליכולת המודל.
החוקים המחייבים של בייג'ינג שולטים בעיקר על יישומים והשפעותיהם על המשתמשים, אומר הדו"ח, במקום לדרוש ממפתחי חזית לערוך או לפרסם הערכות סיכונים על סמך יכולות המודל. במילים אחרות, הדגש הרגולטורי נופל על האופן שבו מוצרי בינה מלאכותית מתנהגים בשוק, ולא על הערכה של הדגמים עצמם לפני ההפצה.
הדו"ח הוסיף כי אף מפתח סיני גדול לא פרסם מודל טקסט גבולי עם מבחני יכולת מסוכנת שנחשפו בפומבי, המשתרעים על סיכוני סייבר, ביולוגיים ואובדן שליטה - הקטגוריות שמכוני בטיחות מערביים מתייחסים אליהן יותר ויותר כאמת מידה להערכות גבולות.
בעיית ההשוואה
מגבלה בולטת אחת: הדו"ח לא סיפק נתונים דומים עבור מפתחי בינה מלאכותית בארה"ב, כך שלא ניתן לקרוא את הנתון של 3.6% ככרטיס ניקוד של סין מול אמריקה. חברות מובילות בארה"ב, כולל OpenAI, Anthropic ו-Google DeepMind, פרסמו דוחות בטיחות, כרטיסי מערכת או כרטיסי מודל עבור כמה השקות דגמי חזית מרכזיים - אך גילויים אלה נוטים לכסות גם דגמי דגל, לא את הנפח המלא של מהדורות, וחוקרים עצמאיים טוענים זה מכבר שגם נוהלי החשיפה בארה"ב אינם עקביים.
האסימטריה הזו מבהירה את התרומה המרכזית של הדו"ח: הוא פחות דירוג מאשר מתודולוגיה. על ידי דרישת תוצאות מותאמות למודל בעל שם, SemiAnalysis מציעה תבנית שניתן להחיל על מפתחים בכל מדינה - ותזכורת לכך שלא ניתן לאמת את רוב טענות הבטיחות בתעשייה, מכל מקום שממנו הן מגיעות, מול מהדורה ספציפית.
מה קורה אחר כך
הממצאים ניזונים לוויכוח מדיניות חי משני צדי האוקיינוס השקט. בארה"ב, מחוקקים שוקלים תקני AI פדרליים, דרישות גילוי וכללי אבטחה עבור דגמי חזית, בעוד שהמחוקקים של המדינה קידמו הצעות חוק משלהם לשקיפות. בסין, הרגולטורים הקשיחו את הכללים ליישומי בינה מלאכותית, כולל בקרות תוכן בינה מלאכותית, אך חובות הערכה המקושרות ליכולות עבור מפתחי חזית נותרות וולונטריות בפועל.
עבור קהילת בטיחות הבינה המלאכותית, המספרים נותנים צורה קונקרטית לתלונה המושמעת לעתים קרובות באופן מופשט: שההערכות החשובות ביותר בתחום מתרחשות מאחורי דלתיים סגורות. אם קצב החשיפה משתנה - בסין או בכל מקום אחר - עשוי להיות תלוי פחות בנורמות מחקר מאשר בשאלה אם ממשלות יתחילו להפוך את הבדיקה לפני הפרסום לדרישה משפטית ולא בחירה בהודעה לעיתונות.
לא מהדוח של SemiAnalysis ולא מהכתבה של רויטרס עולה כי תשע החברות התבקשו להגיב בנפרד; חברות עשויות, כמובן, לקיים תוכניות בדיקה פנימיות שפשוט לא מתפרסמות.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →