האוניברסיטה הגדולה ביותר במקסיקו מאלצת כ-58,000 מועמדים לגשת מחדש לבחינת הכניסה שלה באופן אישי, לאחר שגרסה מרוחקת, מבוקרת בינה מלאכותית, של המבחן יצרה זינוק חשוד בציונים גבוהים והאשמות נרחבות על רמאות. ההחלטה של ​​האוניברסיטה הלאומית האוטונומית של מקסיקו, הידועה בשם UNAM, היא אחד ממקרי הנשורת הדרמטיים ביותר עד כה מהאימוץ המהיר של מעקב אחר בחינות מבוסס בינה מלאכותית בהשכלה גבוהה.

המקרה מדגיש את המתח הגובר בין מוסדות הממהרים לאמץ בדיקה אוטומטית לבין המציאות שניתן לעקוף מערכות ניטור בינה מלאכותית. למידע נוסף על איך בינה מלאכותית מעצבת מחדש מוסדות, עיין ב[חדשות הבינה המלאכותיות] שלנו (https://aibuzzwire.news).

מה השתבש

מוקדם יותר הקיץ, כמעט 160,000 מועמדים ניגשו לבחינת הכניסה של UNAM מרחוק לחלוטין - דבר ראשון עבור המוסד. במשך מספר שבועות מסוף מאי עד תחילת יוני 2026, התלמידים השלימו את מבחן 120 השאלות מהבית באמצעות דפדפן "נעילה" ותוכנת בדיקת מצלמת אינטרנט המופעלת על ידי AI.

התוצאות דומות מעט לשנים קודמות. בין 2021 ל-2025, 3.5 אחוז מהנבחנים קיבלו ציון של 100 או יותר בבחינה. השנה עשו זאת 16.3 אחוזים. הזינוק היה בולט עוד יותר בחלק העליון: בין 2021 ל-2025, רק 0.9 אחוז מהמועמדים קיבלו ציון של 110 ומעלה, אך השנה 5.5 אחוז הגיעו לציון זה. למעשה, הציונים הגבוהים הוכפלו בערך פי חמישה.

אנומליה סטטיסטית זו עוררה האשמות של רמאות נרחבת והניעה את UNAM לכנס ועדה של מומחים לחקירה. הפאנל הגיש כעת את המלצתו.

בחינת הבקרה

מסקנת הוועדה בוטה: הדרך היחידה להחזיר את האמון היא לחייב את המועמדים לגשת למבחן חדש באופן אישי. UNAM תנהל את מה שהיא מכנה "בחינת בקרה", והיא תחול לא רק על אלו שהבטיחו מקום על סמך תוצאות השנה, אלא גם על כל מי שהיה מתקבל על סמך ציוני מינימום מוצלחים מאז 2021. כ-58,000 אנשים עלולים להיפגע.

לפי Gaceta UNAM, הפרסום הרשמי של האוניברסיטה, הרקטור התנצל בפני מועמדים ישרים שעכשיו יצטרכו להתכונן למבחן ולגשת שוב למרות שלא עשו שום דבר רע. הרקטור בכל זאת הגן על המהלך, וכינה את בחינת הבקרה "הכרחית כדי לתת ודאות ולהבטיח שוויון בגישה".

ציר הזמן צפוף. השיעורים מתוכננים כעת להתחיל ב-10 באוגוסט 2026, כלומר האוניברסיטה תצטרך לארגן ולתת ציון של בחינה אישית המונית עבור עשרות אלפי מועמדים תוך מספר ימים, או לדחות את תחילת הקדנציה האקדמית.

איך הפרוקטורינג נכשל

הבחינה מרחוק נשענה על שתי שכבות של אבטחה. על פי דיווח של El País, הבדיקה דרשה את דפדפן LockDown מבית Respondus, הנועל את סביבת הבדיקה על ידי מניעת הדפסה, העתקה, גלישה באינטרנט וגישה ליישומים אחרים במהלך הבחינה.

UNAM גם פרסה מערכת פרוקטוריון מ-Territorium שהשתמשה באלגוריתמי AI כדי לנטר את מצלמת האינטרנט של כל נבדק. המערכת תוכננה לזהות מתי אדם אחר תפס את מקומו של הפונה, מתי טלפונים סלולריים או אוזניות בשימוש, או מתי המבקש עזב את מסגרת המצלמה. בכל בחינה היה גם מפקח אנושי אחד על כל 150 מועמדים, שקיבלו התראות אוטומטיות ויכלו לסמן אי סדרים.

אמצעים אלה לא פעלו מספיק טוב. UNAM ביטלה בסופו של דבר כמעט 2% מסך כל הבחינות בגין בעיות התנהגות לא מוגדרות, אך נראה שהרוב המכריע של חשד לבגידות חמק.

איך תלמידים רימו לכאורה

דיווח ב"ניו יורק טיימס" בשבוע שעבר פירט את השיטות שהסטודנטים השתמשו לפי הדיווחים כדי להביס את הניטור. לפי ה"טיימס", טיפים לבגידה נפוצו בהרחבה לפני שהבדיקות עלו לאוויר. חשבונות מקוונים יעצו לתלמידים למקם צגים מחוץ למסגרת של מצלמת האינטרנט, שם יוכלו לגשת ל-ChatGPT או לדגמי AI אחרים. אחרים הציעו להחביא אוזניות מתחת לשיער, או לשכור מישהו אחר שיסיר את הבחינה מהמצלמה.

מכיוון שהבחינה הייתה מרובה בחירה ולא מבוססת על חיבורים, היה קשה לזהות את הסימנים המעידים על סיוע בבינה מלאכותית, כמו תשובות מלאות שהודבקו בתיבות טקסט בבת אחת. ייתכן שסטודנטים הסתמכו גם על דפי רמאות, שאלות דליפות ושיטות מסורתיות אחרות של חוסר יושר אקדמי.

סיפור אזהרה לבדיקת בינה מלאכותית

פרק UNAM עשוי להדהד הרבה מעבר למקסיקו. אוניברסיטאות וגופי הסמכה ברחבי העולם השקיעו רבות בבדיקה מרחוק המופעלת על ידי בינה מלאכותית, המשווקת כדרך ניתנת להרחבה לשמירה על שלמות הבחינות במהלך בדיקות מקוונות והיברידיות. הטכנולוגיה מבטיחה להחליף את המשגיחים האנושיים במעקב אלגוריתמי תמידי, אך מקרה UNAM מצביע על כך שנבחנים נחושים עדיין יכולים למצוא פערים.

האירוע גם מעלה שאלות לא נוחות לגבי הוגנות. מועמדים ישרים שפעלו על פי הכללים עומדים כעת בנטל להיבחן מחדש, בעוד שהאוניברסיטה חייבת לספוג את העלות הלוגיסטית ואת הנזק המוניטין של השקת בדיקות פגומה. UNAM הכירה במה שהוא כינה את ההסתברות שהפורמט המרוחק נפגע, והמוסד משלם כעת את המחיר על מתן עדיפות לנוחות על פני האמינות המוכחת של הערכה אישית.

עבור מוסדות השוקלים תוכניות בדיקה מרחוק דומות, הלקח ממקסיקו סיטי מפוכח: בדיקת בינה מלאכותית עשויה להיות נחוצה, אך כערובה עצמאית ליושרה, היא רחוקה מלהיות מספקת.

הישאר לפני AI

מקרה UNAM הוא רגע מכונן בוויכוח על AI בחינוך. קרא עוד סיקור תעשיית AI וקרא עוד חדשות AI →