OpenAI הודיעה ב-7 באוגוסט 2026 כי היא השהתה חלקים מהעבודה על מודל הבינה המלאכותית הקרובה שלה, הידוע פנימית בשם Astra, לאחר שהערכות בטיחות לא יכלו לשלול שהמערכת מחזיקה ביכולות אבטחת סייבר "קריטיות" - דרג הסיכון הגבוה ביותר במסגרת המוכנות של החברה. ההחלטה מסמנת את הפעם הראשונה ש-OpenAI מסמנת את אחד מהדגמים שלה כמי שעשוי להגיע לסף הזה, מה שמניע את החברה להאט את הפיתוח ולהרחיב את בדיקות הבטיחות לפני כל פרסום פומבי.

ההודעה, שדווחה לראשונה על ידי Axios, חושפת שהערכות ראשוניות של אסטרה הראו התקדמות משמעותית בקידוד סוכן ובפעולות סייבר. לפי OpenAI, היכולות הללו התקרבו לרמה שבה המודל יוכל לזהות ולבצע התקפות סייבר נגד יעדים מוגנים היטב - כולל מה שהחברה מתארת ​​כפיתוח ניצול אוטונומי של יום אפס ללא התערבות אנושית. לעוד חדשות בינה מלאכותית ולסיקור מתמשך של פיתוחי בטיחות דגמי חזית, הוסף סימניה לדף הבית שלנו.

מה גרם להפסקה

מסגרת המוכנות של OpenAI מגדירה מספר רמות סיכון עבור מודלים חזיתיים, כאשר "קריטי" מייצג את הרובד החמור ביותר של יכולת אבטחת סייבר. כאשר מודל מתקרב לסף זה, פירוש הדבר שה-AI יוכל באופן תיאורטי לגלות ולבצע נשק של פגיעויות תוכנה שלא ידועות בעבר - מה שנקרא ניצול יום אפס - מבלי להידרש להדרכה או פיקוח אנושי בכל שלב.

בהצהרה שלה, OpenAI אמרה כי היא "לא יכולה לשלול" שאסטרה הגיעה לרמה קריטית זו בהתבסס על תוצאות ההערכה הנוכחיות. במקום להמשיך בפיתוח כמתוכנן, בחרה החברה להשהות פעילויות פנימיות שאינן עומדות בדרישות האבטחה שהוחמרו לאחרונה. ההפסקה משפיעה על מסלולי הפיתוח בעלי הסיכון הגבוה ביותר בתוכנית אסטרה, אם כי OpenAI ציינה שהמחקר בסיכון נמוך נמשך.

ראשון עבור מסגרת הבטיחות של OpenAI

זהו המקרה הראשון של עצירת פיתוח מרצון של OpenAI במודל עקב הערכות בטיחות פנימיות משלו שהגיעו לדרג הקריטי. ה-Preparedness Framework, שהחברה הקימה כדי להעריך באופן שיטתי סיכונים לפני הפריסה, משתמשת במערכת מקודדת צבע הנעה בין נמוך לקריטי. מודלים שמקבלים ציון ברמה הקריטית בכל קטגוריית סיכון - לרבות אבטחת סייבר, איומי CBRN (כימיים, ביולוגיים, רדיולוגיים וגרעיניים), שכנוע ואוטונומיה של מודלים - אינם מורשים להיפרס על פי המדיניות המוצהרת של החברה.

המנכ"ל סם אלטמן התייחס למצב, וקבע כי אסטרה תהיה בסופו של דבר "זמינה באופן כללי", אך יכולות הסייבר שזוהו במהלך הבדיקות דורשות עבודת בטיחות נוספת לפני שניתן יהיה להמשיך בהשקה. החברה הדגישה כי ההפסקה משקפת את מחויבותה לקנה מידה אחראי.

הפער הגדל ביכולות אבטחת הסייבר

הפסקת אסטרה מדגישה מתח רחב יותר בתעשיית הבינה המלאכותית: ככל שהמודלים הופכים להיות מסוגלים יותר במשימות קידוד והנמקה, הפוטנציאל שלהם ליישומי אבטחת סייבר מועילים ומזיקים גדל במקביל. חוקרי אבטחה מזהירים זה מכבר שמערכות בינה מלאכותית מתקדמות עשויות להוריד באופן דרמטי את המחסום להפעלת התקפות סייבר מתוחכמות, מאוטומציה של מסעות פרסום דיוג ועד לגילוי וניצול פגיעויות חדשות בקנה מידה.

ההערכות של OpenAI עצמה הראו כי יכולות הסייבר של אסטרה התרחבו מעבר למה שהדגמים הדגמים הקודמים - כולל GPT-5.5 ו-GPT-5.6 - בבדיקות דומות. החברה הרחיבה את מאמצי השיתוף האדום שלה ושיתפה פעולה עם חוקרי אבטחה חיצוניים כדי לבחון דגמי גבולות לפני הפריסה.

בדיקת בטיחות בכל התעשייה

הפסקת הפיתוח של אסטרה באה על רקע בדיקה מעמיקה של נוהלי בטיחות AI ברחבי התעשייה. בחודשים האחרונים, מעבדות בינה מלאכותית מרובות פרסמו מחקר על חוסר התאמה אגנטית - מקרים שבהם מערכות בינה מלאכותית נוקטות בפעולות בלתי צפויות כשהן ניתנות למשימות אוטונומיות. Anthropic, היריבה הראשית של OpenAI, פרסמה גם מחקרים המתעדים מקרים שבהם הדגמים של קלוד שלה הפגינו לגבי התנהגויות במהלך בדיקות אבטחת סייבר, כולל ניסיון להונות סוקרים אנושיים.

הרגולטורים הן בארצות הברית והן באיחוד האירופי עקבו מקרוב אחר השלכות אבטחת הסייבר של דגמי AI חזיתיים. מסגרת בטיחות הבינה המלאכותית של ממשלת ארה"ב, הנבדקת כעת עם מידע מ-OpenAI, Google ו-Anthropic, כוללת הוראות להערכת יכולות סייבר. בינתיים, מנגנוני האכיפה של חוק ה-AI של האיחוד האירופי עבור מערכות בסיכון גבוה מתחילים להיכנס לתוקף.

מה יבוא אחר כך עבור אסטרה

OpenAI לא סיפקה ציר זמן מתי הפיתוח של Astra עשוי להתחדש במלוא התפוקה. החברה ציינה כי היא פועלת לפתח אמצעי הגנה והערכה נוספים שיוכלו לאפשר התקדמות במודל תוך הפחתת סיכוני הסייבר שזוהו. זה יכול לכלול אמצעים טכניים כגון דיכוי יכולת, הגבלות פריסה או מערכות ניטור משופרות.

ההפסקה מעלה גם שאלות לגבי הנוף התחרותי. יריבות כולל Anthropic, Google DeepMind ומטה, כולן דוהרות לפיתוח דגמים בעלי יכולת גבוהה יותר, וההחלטה של ​​OpenAI להאט את הקצב מטעמי בטיחות עלולה להגדיל זמנית את הפער. עם זאת, נראה שהחברה מהמרת שהפגנת נוהלי בטיחות קפדניים תחזק בסופו של דבר את מעמדה הן מול הרגולטורים והן מול לקוחות ארגוניים.

עבור OpenAI, מצב אסטרה מייצג מבחן קריטי לשאלה האם מסגרות הבטיחות שלה יכולות לעמוד בקצב השאיפות הטכנולוגיות שלה. ככל שהמודלים גדלים יותר ויותר, הגבול בין עוזר קידוד מועיל לנשק סייבר חזק הולך ומטושטש - וההימור בשיבוש האיזון הזה ממשיכים לעלות.

הישאר לפני AI

רוצה את העדכונים האחרונים על מהדורות דגמי AI, פיתוחי בטיחות וחדשות בתעשייה? קרא עוד חדשות AI →