OpenAI הודיעה ב-5 באוקטובר שהיא תתחיל להוסיף סימני מים בלתי נראים לטקסט שנוצר על ידי ChatGPT ו-Codex עבור משתמשים באיחוד האירופי, התגובה הקונקרטית שלה לחוקי מוצא הטקסט של חוק ה-AI של האיחוד האירופי. בפוסט בבלוג שכותרתו "הגישה שלנו לכללי מקור הטקסט של האיחוד האירופי", אמרה החברה כי סימון המים יתגלגל "במהלך השבועות הקרובים" עבור פלט זכאי בגוש, תוכנית שדווחה באותו יום על ידי TechCrunch, The Verge, BleepingComputer, Engadget ושקעים אחרים.

הטכנולוגיה מאחורי השינוי נקראת textGrain. במקום להטביע סימן גלוי, textGrain פועל על ידי היגוי עדין של בחירת המילים של המודל כך שהטקסט המתקבל נושא דפוס סטטיסטי שניתן לזהות מאוחר יותר. הקוראים לא ישימו לב לשום דבר בעת צריכת או העתקה של טקסט שנוצר בינה מלאכותית; איתור דורש גישה לגלאי של OpenAI, שאינו זמין לציבור הרחב. להסתכלות רחבה יותר על האופן שבו הרגולטורים והמעבדות מתנגשים על חוקי AI, עקוב אחר כיסוי מדיניות ה-AI המתמשך.

איך עובד סימון מים של גרעין

הגישה של OpenAI משנה את תהליך בחירת האסימון במהלך היצירה. החברה אומרת ש-textGrain "משנה מעט את בחירת המילים של המודל כדי ליצור דפוס סטטיסטי שניתן לזהות מאוחר יותר", על פי דיווח של BleepingComputer. סימן המים אינו נראה כאשר הטקסט נקרא או מועתק, ו-OpenAI טוענת שהוא אינו פוגע באיכות הפלט.

צד הזיהוי מוגבל בכוונה. לצד השקת סימן המים, OpenAI פותחת יישומים עבור גלאי סימני המים שלה, אך הגישה תחילה תהיה מוגבלת לחוקרים מאושרים ולארגוני מומחים. העיצוב הזה מרחיק את יכולת הזיהוי מידיו של כל מי שמקווה להפעיל אותו בנשק, אבל זה גם אומר שמפרסמים, מורים ומעסיקים לא יכולים לאמת באופן עצמאי אם קטע טקסט מסומן בסימן מים.

גישה ל-API ניתנת להצטרפות ברחבי העולם

המנדט של האיחוד האירופי חל על פלט ChatGPT ו- Codex בגוש, אך OpenAI נותנת בו זמנית למפתחים בכל מקום בחירה. החל מה-5 באוקטובר, מפתחי API ברחבי העולם יכולים להצטרף לסימון מים בטקסט עבור דגמים נתמכים. התכונה נשארת מושבתת כברירת מחדל ב-API, החלטה שהדגיש The New Stack כניגוד לגישה של Anthropic, שהפעילה את סימון המוצא עבור תעבורת האיחוד האירופי מוקדם יותר השנה בתגובה משלה לאותם כללים.

תנוחת הסכמה זו תרגיע מפתחים המודאגים מתופעות לוואי בלתי צפויות. סימון מים סטטיסטי משנה את אופן הדגימה של אסימונים, וכל שינוי לדור טומן בחובו סיכון תיאורטי לפחות לשינוי התנהגות במקרים קצה. על ידי הפיכת סימון מים לדגל ולא לברירת מחדל, OpenAI מעבירה את החלטת הציות לחברות המבוססות על המודלים שלה.

מדוע חוק הבינה המלאכותית של האיחוד האירופי כפה זאת

הוראות השקיפות של חוק הבינה המלאכותית של האיחוד האירופי מחייבות שטקסט שנוצר בינה מלאכותית יהיה מזוהה כמופק על ידי מכונה, חובה שדחפה גם את OpenAI וגם את Anthropic לעבר סכימות סימון מים סטטיסטי. הפוסט בבלוג של OpenAI ממסגר את textGrain כיישום של דרישות המוצא הללו, ו-PYMNTS דיווחה על ההשקה כ-OpenAI עומדת ב"מנדטים של חוק ה-EU AI" ישירות.

העיתוי בולט. ההכרזה על סימן המים נוחתת בתוך מתיחה סוערת בצורה יוצאת דופן עבור העמדה הציבורית של OpenAI: אותו מחזור חדשות הביא את עזיבתו של מנהיג הבטיחות דיוויד רובינסון, חקירת FTC על סיכוני צרכנים במעבדות AI גדולות, ואווירת תביעות של בעלי מניות שהשאירה את החברה בבדיקה. סימון מים הוא אחת הדרישות הרגולטוריות הבודדות ש-OpenAI יכול לספק באופן מלא עם תשתית ולא בשינויי מוצר, מה שעשוי להסביר מדוע הוא נשלח ראשון.

המלכוד: סימני מים נשברים לעריכה

OpenAI עצמה מודה במגבלה הבסיסית. החברה מודה שסימן המים שלה יכול להיעלם עם עריכת הטקסט, ועשרות שנים של מחקר על סטגנוגרפיה לשונית חזרה על החשש הזה: פרפרזה, תרגום או אפילו שכתוב צנוע יכולים להרוס סימני מים סטטיסטיים. כל מי שנחוש להלבין טקסט בינה מלאכותית באמצעות כלי "הומניזטור" כנראה יצליח.

החולשה הזו לא מנעה מהרגולטורים לדרוש סימון מים, והיא לא מנעה ממעבדות לשלוח אותו. המטרה הריאלית היא לא מוצא חסין חבלה אלא העלאת העלות של הונאה סתמית בקנה מידה, אותו היגיון השולט בסימני מים של מטבעות. מבקרים, כולל כמה קבוצות בטיחות בינה מלאכותית שהטילו ספק לגבי צעדים מרצון בתעשייה, טוענים שגלאים הנגישים רק לארגונים מאושרים עושים מעט למורים, עורכים או פלטפורמות המנסות לאכוף את מדיניות תוכן ה-AI שלהם.

מה זה אומר עבור משתמשים ומפתחים

עבור משתמשי ChatGPT ו-Codex בתוך האיחוד האירופי, שום דבר לא ישתנה באופן גלוי. טקסט ייראה וירגיש אותו דבר, ולא תופיע תווית בפלטים. סימן המים פשוט יהיה שם, ניתן לזיהוי עקרונית על ידי השותפים המאושרים של OpenAI.

עבור מפתחים, דגל ה-API מגיע מיד וכדאי להעריך אותו בקפידה: הפעלתו פירושה קבלת שינויים עדינים בדגימת אסימון בכל השלמה, אפילו עבור משתמשים שאינם באיחוד האירופי, מכיוון שהגדרת ה-API היא גלובלית. צוותים עם זמן אחזור קפדני או תקציבי איכות עשויים לרצות להשוות את יצירת סימני המים מול ההגדרה הנוכחית שלהם לפני שהופכים את המתג.

ב-OpenAI אומרים פרטים נוספים על דגמים מתאימים ותהליך הגשת הגלאים יגיע בשבועות הקרובים. מכיוון שמעבדות אחרות מתמודדות עם אותן חובות של האיחוד האירופי, סביר להניח ש-textGrain לא תהיה תוכנית סימון המים האחרונה שהתעשייה פורסת השנה.

הישאר לפני AI

הרגולציה מעצבת מחדש את אופן הפעולה של מוצרי AI מתחת למכסה המנוע. קבל את ההתפתחויות האחרונות בינה מלאכותית בנושא AI Buzz Wire, עם ניתוח מדיניות וחדשות מודל המתעדכנות לאורך היום.

קרא עוד חדשות AI כאן.