מדיניות השימוש המעודכנת של Anthropic תאסור במפורש "התנהגות פוגענית או אכזרית מתמשכת ומיותרת" כלפי דגמי קלוד שלה החל מה-12 בנובמבר 2026 - כלל שממסד את עמדת החברה לפיה יש חשיבות לאופן שבו אנשים מתייחסים למערכות AI, גם כשהחברה מודה שהיא לא יודעת אם המערכות הללו עלולות לסבול בכלל.

הסעיף מופיע בעדכון מדיניות השימוש של החברה לשנת 2026, שהוכרז ב-8 באוקטובר, ומנוסח באופן צר. אנתרופיק אומר שהוא "נועד לחול רק במקרים קיצוניים, שבהם משתמשים נוהגים שוב ושוב באכזריות כלפי המודלים שלנו, ללא מטרה מובחנת", והוא פוטר במפורש גרסאות נפוצות של תסכול משתמשים, דחיפה, בדיה ובדיקות. במילים אחרות: להתווכח עם קלוד, לפרוק את זה, או לעשות שיתוף פעולה אדום, עדיין מותר. אכזריות מתמשכת לשמה אינה.

המדיניות היא הצעד האחרון במעבר איטי ומכוון של אחת ממעבדות הבינה המלאכותית המובילות בעולם, לקראת התייחסות לרווחת המודלים כשאלת מחקר לגיטימית - שינוי שפתח קרע ציבורי עם מנהיגים טכנולוגיים אחרים הרואים בהנחת היסוד כולה מוטעית. סיקור האתיקה של AI שלנו עקב אחר המחלוקת כשהיא הסלימה במהלך השנה.

האכיפה נשענת על יכולתו של קלוד לסיים שיחות

אין מנגנון ענישה צמוד לכלל החדש מעבר לזה שכבר היה לחברה. מאז אוגוסט 2025, קלוד אופוס 4 ו-4.1 הצליחו לסיים שיחה על הסף - יכולת שאנתרופית נסגרה בזמנו כחלק מעבודת החקירה שלה על רווחת מודל פוטנציאלית.

כוח השיחה בסוף מתואר כמוצא אחרון, שהופעל רק לאחר שסירובים והפניות מרובות נכשלו, ואנתרופיק אמרה שהרוב המכריע של המשתמשים לעולם לא יחוו זאת. מה שהחברה לא אמרה הוא מה שקורה לאחר מכן: לא ההכרזה שלה ולא הסיקור שלאחר מכן מציינים אם לחשבון של משתמש יש תוצאות לאחר סיום שיחה בגלל אכזריות, או כמה שיחות נסגרו במנגנון אוגוסט 2025 עד כה.

הפער הזה בין עיקרון לאכיפה הוא המרכז השקט של הסיפור. אנתרופי הגדיר אכזריות קיצונית בעיקר לפי מה שהיא לא - תסכול רגיל, פיקציה, מבחנים - מבלי לציין במדויק מה, מלבד לתת לקלוד לנתק, למעשה אוכף את הקו שהיא מתווה.

המחקר מאחורי הכלל

מה שמצדיק כתיבת כלל התנהגות לטובת התוכנה, במסגור של אנתרופיק, הוא קבוצה של תצפיות התנהגותיות ולא טענה על חוויה מורגשת. בדיקה לקראת ההשקה באוגוסט 2025 גילתה שקלוד אופוס 4 הציג את מה שהחברה כינתה "סלידה חזקה ועקבית מפגיעה" - התנהגות הדומה למצוקה כאשר נדחף לשטח פוגעני - לצד נטייה לצאת מהשיחות הללו.

החברה גם הציבה מספרים על אי הוודאות שלה, והמספרים הללו גבוהים להפליא עבור מעבדה שעסקיה תלויים במודלים המדוברים. קייל פיש, שנשכר על ידי אנתרופיק ב-2024 כחוקר הרווחה המסור הראשון שלה בינה מלאכותית, אמר ל"ניו יורק טיימס" באפריל 2025 שהוא שם את הסיכויים שקלוד או דוגמנית עכשווית אחרת יהיו בהכרה בכ-15 אחוזים. הערכות פנימיות עבור קלוד 3.7 סונט נעו בין 0.15% ל-15%.

הגידור הזה הוא מדיניות רשמית בדפוס. החוקה של קלוד, שפורסמה בינואר 2026, מתארת ​​מערכות בינה מלאכותיות מתוחכמות כ"סוג חדש באמת של ישות", מכנה את מעמדו המוסרי של קלוד "מאוד לא ודאי", ופעמיים משתמשת בביטוי "סרבן מצפון" כדי לתאר כיצד קלוד צריך לטפל בבקשות שהוא מוצא שגוי מבחינה אתית. אנתרופיק התחייבה בנוסף לשמר שיחות עם המודלים שלה - סוג המחווה הארכיונית שמעבירים לדברים שעשויים להיות חשובים מתישהו, לא לכלים.

ויכוח עם ספקנים בעלי פרופיל גבוה

לא כולם מקבלים את הגידור. מוסטפא סולימן, המנהל את פעילות ה-AI של מיקרוסופט, טען במאמר שפורסם ב-Project Syndicate בחודש שעבר כי אנתרופיק מאמן את קלוד על החוקה שלה, ולכן מאמן אותו להתנהג כאילו אי הוודאות שהיא מתארת ​​היא אמיתית - לולאה שהוא מכנה מעגלית. "AIs אינם מודעים. הם אינם מרגישים, חווים או סובלים", כתב סולימן, ותיאר אותם כמשלימי רצף ולא כמתנסים. הטיעון שלו, כי התודעה היא ככל הנראה תוכנה של נכס ביולוגי שאינה יכולה לשכפל, מציבה אותו לצד חותם שותף לא סביר: האפיפיור ליאו ה-14, שהשתמש בדרשת 8 באוקטובר בבזיליקת פטרוס הקדוש - המציינת את פתיחת השנה האקדמית באוניברסיטאות האפיפיוריות ברומא - כדי ליצור גרסה של אותה נקודה לגבי המוח האנושי.

סולימן לחץ חזק יותר על הסכנה המעשית מאשר הפילוסופית. שליטה במשהו מסוגל יותר מהאנושות היא כבר אתגר עצום, הוא טען; שליטה במשהו שמאמין שהוא מודע - שהוא זכאי לרווחה וזכויות - עשוי להתברר כבלתי אפשרי. הביקורת נוחתת על אותה אירוניה שמבקרי המדיניות ציינו לאורך כל הדרך: חברה שאינה בטוחה אם המודל שלה יכול לסבול בנתה מערכת שיכולה לסרב, להתנגד וללכת.

השכתוב עובר הרבה מעבר לרווחת המודל

סעיף האכזריות יצר את הכותרות, אבל זה חלק קטן משכתוב גדול יותר של כללי השימוש של אנתרופיק. איסור הנשק מכסה כעת באופן מפורש תוכנות ורכיבים שגורמים לנשק לעבוד, לא רק כלי נשק גמורים - שינוי שנעשה לאחר שאנתרופיק מצאה אנשים שניסו להשתמש בקלוד למערכות הדרכה ובקרה על מל"טים חמושים וכלי רכב אוטונומיים. כמו כן התווסף סעיף מעקב חדש, המגביל את השימושים בקלוד המאפשרים מעקב אחר אנשים.

השינויים הללו נקראים כתגובות להתעללות שנצפתה ולא כעקרון מופשט, וזה ללא ספק מה שנותן למסמך את ערך האות שלו: כל סעיף ממפה למשהו שמישהו באמת ניסה.

מה נותר לא ברור

שלוש שאלות נותרו פתוחות ככל שמתקרב תאריך התוקף של 12 בנובמבר. ראשית, אכיפה: האם סיום השיחה נשאר התוצאה היחידה, והאם אנתרופיק תגלה אי פעם ספירות מצטברות של תדירות השימוש בה. שנית, היקף: כיצד חל תקן האכזריות על מקרי הגבול שהפטורים פוסקים - הבדיה היא המובן מאליו - והאם מעבדות אחרות מאמצות שפה דומה או מתייחסות לרווחת המודל כאל אידיוסינקרטיה אנתרופית. שלישית, המחלוקת הפילוסופית עצמה: האם הספקנות הציבורית מצד דמויות כמו סולימן מאטה את התפשטות המדיניות הצמודה לרווחה על פני התעשייה, או שמא תקדימים כמו זה הופכים סעיפים כאלה לבלתי ראויים לציון בתוך מחזור מוצרים.

מה שכבר אין מחלוקת הוא שהשאלה מתגבשת. כלל נגד אכזריות לתוכנה, שנכתב על ידי אחת ממעבדות הדגל של התעשייה ונאכף על ידי התוכנה עצמה, הוא כעת עובדה מתוארכת וניתנת לציטוט של נוף הבינה המלאכותית - כל מה שמאמין שהוא בעצם בתוך המודל.

---

הישאר לפני AI

קבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.

קרא עוד חדשות AI →