אנתרופיק פרסמה בשבת סט מפורט של מדידות עצמיות שנועדו לאפשר לציבור, לעיתונאים ולממשלות לעקוב אחר המהירות שבה בינה מלאכותית מפותחת בפועל - כולל מדד ראשון מסוגו של כמה מהמחקר של החברה עצמה מתבצע כעת על ידי AI, והחשיפה שכ-30,000 סוכני בינה מלאכותית עושים מחקר ועבודה הנדסית בחברה בכל רגע נתון.

הפוסט, שכותרתו "מדידות להבנת קצב התפתחות הבינה המלאכותית בתוך מעבדות גבול", מגיע למרכז הטיעון התוצאתי ביותר בתעשייה: האם יש להאט בכוונה את פיתוח הגבולות. דריו אמודי קרא לתיאום "לקצב את הגבול", הצעה שזעזעה את השווקים, עוררה תביעה צרכנית בטענה לקצב קנוניה בין מעבדות גדולות, והניעה את הנשיא טראמפ להכריז על "כוח AI" המוקדש למניעת האטה כלשהי. המסגור של אנתרופיק מפורש לגבי ההקשר הזה: "ככל שהעולם שוקל להאט את קצב פיתוח הבינה המלאכותית, הציבור זקוק למידע נוסף."

שלוש מדידות למעקב אחר התקדמות בינה מלאכותית

החברה הציגה שלושה אזורי מדידה שלטענתה כל מעבדת חזית יכולה לפרסם באופן קבוע:

1. כמה מחקר ופיתוח בינה מלאכותית מבוצעת על ידי בינה מלאכותית בעצמה. אנתרופיק בנתה אב טיפוס "אינדקס אוטומציה של מחקר ופיתוח אנטרופי" על ידי קטלוג כל סוג של עבודות מחקר ופיתוח של בינה מלאכותית שנעשות בחברה, דירוג עד כמה כל משימה אוטומטית כרגע, וצירוף התוצאות. הדירוגים משתמשים בסולם "רמת האוטומציה" הציבורי של Epoch AI, אשר עובר מ-AL0 (ללא מעורבות בינה מלאכותית) ל-AL5 (AI פועל באופן אוטונומי לחלוטין ללא אדם בלולאה). בקנה מידה זה, AL3 פירושו AI "משתף פעולה" - עושה חלקים גדולים של עבודה בהנחיה אנושית קרובה - בעוד ש-AL4 פירושו AI "מוביל", ומשלים את רוב המשימה מקצה לקצה מהנחיה ברמה גבוהה בזמן שאדם מפקח.

מטרת המדד היא למדוד עד כמה כל מעבדה מתקרבת לשיפור עצמי רקורסיבי - מודל הבונה באופן אוטונומי לחלוטין את היורש שלו. Anthropic מציינת כי מודלים המאיצים את פיתוח הבינה המלאכותית "יכולים להפוך את זה למאתגר יותר עבור בני אדם להבין או לשלוט במערכות אלו".

2. עד כמה מפקחים על הפעולות של סוכני בינה מלאכותית. כאן מופיע הנתון של 30,000. נכון לאוגוסט 2026, כ-30,000 סוכנים עשו עבודת מחקר והנדסה בכל עת בתוך הפלטפורמה הפנימית הנפוצה ביותר של Anthropic, האצילו משימות זה לזה ועבדו באופן חצי אוטונומי לאורך זמן. החברה מודדת שלושה דברים לגבי פיקוח על אותם סוכנים: כיסוי (הנתח של פעולות סוכן שעוברות דרך מוניטור לפני או אחרי ביצוע), זמן הביקורת (המהירות שבה פעולות מסומנות נבדקות, תחילה על ידי מוניטור אוטומטי ולאחר מכן על ידי אדם), וקצב הסלמה (חלק הפעילויות שנחסמו, מנותבות מחדש או מסומנות לבדיקה).

נתוני הניטור של אנתרופיק עד כה מצביעים על כך שסוכנים בודדים ממעטים להתנהג כראוי - אך החברה מזהירה כי "כשיש מיליוני או מיליארדי סוכנים הפועלים במשק, אפילו אירועים נדירים יכולים להתרחש באופן קבוע".

3. אופן הקצאת המחשוב. המדידה השלישית עוקבת אחר אופן חלוקת משאבי המחשוב של המעבדה - הקלט הגולמי שמתאם עם יכולות המודל. יחד עם שני המדדים האחרים, אנתרופיק טוענת שזה נותן לאנשים מבחוץ דרך לתאם בין תשומות המודל לתפוקות המודל, תוך השלמת הערכות היכולות שהחברה כבר מפרסמת באמצעות דוחות הסיכון שלה למדיניות קנה מידה אחראי.

מספרים יעברו תחת האטה

הקו המכוון ביותר מבחינה פוליטית בפוסט מכוון ישירות לוויכוח המקצב: אנתרופיק מצהירה כי היא "תצפה שהמספרים הללו ישתנו אם היה תיאום על קצב הגבול, כפי שדרש מנכ"ל אנתרופי דריו אמודי. במילים אחרות, אם התעשייה באמת תאט את הקצב, המדדים האלה הם הדרך שבה הציבור יוכל לאמת זאת - ואם חברות טוענות שהן צועדות בזמן שהמספרים שלהן ממשיכים לטפס, המדידות יחשפו גם את זה.

אימות עצמאי הוא החלק החסר

אנתרופיק מכירה בחולשה המרכזית של מדדי דיווח עצמי: היא משתמשת במודלים משלה כדי להעריך את המערכות שלה, מה שאומר שמודל "השופט" יכול לחלוק את הנקודות העיוורות של המודל הנבדק. החברה גם מציינת את היעדר מתודולוגיה משותפת במעבדות, מה שמקשה על ההשוואות.

התרופה המוצעת שלה היא הטמעת מעריכים עצמאיים של צד שלישי מארגונים מרובים בתוך Anthropic, לתת להם גישה לתהליכים פנימיים, מערכות ונתונים הדומים למה שצוותי הערכת סיכונים פנימיים רואים. צדדים שלישיים אלה יאמתו את נוהלי הבטיחות, ידווחו על תקריות ויפקחו על המדדים החדשים. החברה טוענת כי METR, עמותת ההערכה, שיתפה בעבר באופן עצמאי את פלטפורמת הניטור הלא מקוונת שלה, וכי היא מתכננת לפרסם מדידות אלה באופן קבוע בצורה שאחרים יכולים לאמת.

המדידות מתחברות להצעת ה-Advanced AI Framework הרחבה יותר של Anthropic, שמגדירה "כללי הדרך" לשחרור מודלים חזיתיים, כולל חובות שקיפות שממשלות יכולות לדרוש - כגון דוחות סיכונים סטנדרטיים.

מבחן לכל התעשייה

המשמעות העמוקה יותר של הפוסט עשויה להיות תחרותית. אנתרופיק מאתגרת למעשה כל מעבדת חזית לפרסם את אותם המספרים, בטענה ש"כל מפתח חזית יכול לפרסם את האמצעים הללו באופן קבוע, תוך שימוש במתודולוגיה ציבורית". אם יריבים ירדו, הניגוד הופך לנקודת נתונים משלו בדיון הבטיחותי; אם הם יסכימו, התעשייה משיגה את המדד הנפוץ הראשון לכמה מהר ה-AI באמת מתקדם.

לעת עתה, המספרים מדווחים על ידי חברה עם עניין ברור בשיחת הקצב. אבל הם מייצגים משהו שחסר לו הדיון: מדידות קונקרטיות שניתן לחזור עליהן, שיראו אם הגבול מואץ, מחזיק יציב או בעצם מאט.

הישאר לפני AI

גילויים של מעבדת Frontier כמו זו נוחתים מדי שבוע. למחקר פורץ של AI וסיקור בתעשייה, עקוב אחר AI Buzz Wire.

קרא את החדשות האחרונות של AI →