OpenAI برخی از کارها را بر روی مدل نسل بعدی خود که در داخل به نام Astra نامیده می شود، پس از اینکه آزمایشات ایمنی داخلی ظاهر شد، آنچه که شرکت به عنوان خطرات امنیت سایبری حیاتی توصیف کرد، متوقف کرد. این تصمیم که اولین بار توسط رویترز در 7 آگوست 2026 گزارش شد و توسط Axios، The Guardian و وال استریت ژورنال تایید شد، یکی از مهم ترین تاخیرهای مدل را نشان می دهد که به طور خاص به آستانه قابلیت سایبری در یک آزمایشگاه بزرگ هوش مصنوعی مرتبط است. برای پوشش مداوم ایمنی مدل و صنعت هوش مصنوعی، [اخبار فوری هوش مصنوعی] ما را دنبال کنید (https://aibuzzwire.news).

مرز جدید قابلیت سایبری

این شرکت در یک پست وبلاگی که در همان روز با عنوان «پاسخ به مرز بعدی قابلیت‌های حیاتی سایبری» منتشر شد، این توقف را فاش کرد. به گفته OpenAI، ارزیابی‌های مدل Astra قابلیت‌هایی را شناسایی کرد که به بالاترین سطح از چارچوب آمادگی آن رسید - سیستمی که شرکت برای طبقه‌بندی خطرات در حوزه‌هایی مانند امنیت سایبری، متقاعدسازی و استقلال از آن استفاده می‌کند.

OpenAI جزئیات فنی کاملی از قابلیت‌های سایبری خاص درگیر را منتشر نکرد، این یک رویه رایج هنگام افشای خطرات مدل حساس است. با این حال، این شرکت یافته‌ها را به‌اندازه کافی مهم توصیف کرد که کند کردن جدول زمانی توسعه مدل و اجرای پادمان‌های اضافی قبل از انتشار احتمالی را تضمین کند. رویترز گزارش داد که OpenAI "یک خطر احتمالی حیاتی امنیت سایبری در مدل آینده را علامت گذاری کرده است" و به سمت "تشدید کنترل ها" حرکت کرده است.

چارچوب آمادگی به چه معناست

چارچوب آمادگی OpenAI برای ارزیابی مدل های مرزی در برابر آستانه های ریسک تعریف شده قبل از رسیدن به عموم طراحی شده است. این سیستم از یک مقیاس امتیازدهی استفاده می‌کند و مدل‌هایی که به سطح «بحرانی» در یک دامنه خاص نزدیک می‌شوند یا از آن فراتر می‌روند، بازبینی‌های اجباری، تیم قرمز اضافی، و - مانند مورد Astra - تاخیرهای احتمالی در استقرار را آغاز می‌کنند.

این چارچوب در سال 2023 ایجاد شد و به طور دوره ای به روز شده است. تحت ساختار فعلی آن، مدل‌ها باید ارزیابی‌های ایمنی را که سناریوهای سوءاستفاده احتمالی را شبیه‌سازی می‌کنند، پاک کنند. به طور خاص برای امنیت سایبری، ارزیابی‌ها ارزیابی می‌کنند که آیا یک مدل می‌تواند به طور معناداری به عملیات تهاجمی مانند کشف آسیب‌پذیری‌ها، نوشتن کد سوء استفاده یا انجام کمپین‌های فیشینگ در مقیاس بزرگ کمک کند.

این واقعیت که Astra سیگنال‌های آستانه بحرانی را ایجاد کرد که مدل‌های مرزی اکنون به سطوحی از قابلیت می‌رسند که در آن شکاف بین برنامه‌های مفید و مضر در حوزه سایبری در حال کاهش است - چالشی که کل صنعت با آن دست و پنجه نرم می‌کند.

چگونه این با تاخیرهای گذشته مقایسه می شود

تأخیرهای مدل به دلیل نگرانی‌های ایمنی در OpenAI بی‌سابقه نیستند، اما معمولاً بر روی خطراتی مانند تولید محتوای غیرمجاز یا تولید خروجی‌های فریبنده متمرکز شده‌اند. توقف Astra قابل توجه است زیرا به طور خاص با قابلیت های سایبری مرتبط است که به سطحی می رسد که خود شرکت آن را به عنوان بحرانی طبقه بندی می کند.

TechCrunch، که این داستان را تأیید کرد، خاطرنشان کرد که OpenAI «توسعه مدل Astra را به دلیل نگرانی‌های امنیتی کند کرد» و این تصمیم را به عنوان بخشی از رویکرد در حال تکامل شرکت برای مقیاس‌پذیری مسئولانه تعیین کرد. گاردین گزارش داد که OpenAI تصمیم گرفت به‌جای لغو کامل آن، «تعدادی از کارها» را روی مدل متوقف کند، و این نشان می‌دهد که شرکت قصد دارد توسعه را با پادمان‌های تقویت‌شده ادامه دهد.

پخش‌کننده عمومی ژاپن NHK نیز این توسعه را پوشش داد، که نشان‌دهنده اهمیت جهانی داستان با توجه به پایگاه کاربر بین‌المللی OpenAI و بررسی فزاینده ایمنی مدل مرزی در سراسر حوزه‌های قضایی است.

پیامدهای صنعت

تاخیر Astra در بحبوحه تشدید بحث در مورد چگونگی ارزیابی و افشای ریسک‌های مدل توسط شرکت‌های هوش مصنوعی آغاز می‌شود. قانون‌گذاران در ایالات متحده، اتحادیه اروپا و بریتانیا همگی برای شفافیت بیشتر در مورد قابلیت‌های مدل مرزی فشار آورده‌اند و چندین دولت مؤسسه‌های ایمنی هوش مصنوعی را به طور خاص برای آزمایش مدل‌های پیشرفته برای خطرات سایبری، بیولوژیکی و سایر خطرات ایجاد کرده‌اند.

تصمیم OpenAI برای افشای عمومی یافته‌های مربوط به قابلیت حیاتی - به جای حل بی سر و صدا آن در داخل - با روند گسترده‌تر صنعت به سمت شفافیت داوطلبانه همسو است. شرکت هایی از جمله Anthropic و Google DeepMind تعهدات آمادگی و مسئولیت پذیری مشابهی را منتشر کرده اند، اگرچه ویژگی های روش های ارزیابی آنها متفاوت است.

برای جامعه امنیت سایبری، این اپیزود بر نگرانی فزاینده تاکید می‌کند: با افزایش توانمندی مدل‌ها، اقدامات دفاعی و چارچوب‌های ارزیابی مورد نیاز برای همگام‌سازی نیز باید پیشرفت کنند. مدلی که می‌تواند آسیب‌پذیری‌های روز صفر را شناسایی کند یا بخش‌هایی از زنجیره حمله را خودکار کند، هم فرصتی برای تیم‌های امنیتی دفاعی و هم خطری در دستان اشتباه است.

بعدی برای Astra

OpenAI جدول زمانی اصلاح شده ای را برای انتشار Astra اعلام نکرده است. این شرکت نشان داد که توسعه با پادمان‌های اضافی ادامه خواهد یافت و نشان می‌دهد که این مدل ممکن است در نهایت پس از کاهش ریسک‌های شناسایی‌شده به‌اندازه کافی راه‌اندازی شود.

تحلیلگران صنعت به دقت زیر نظر خواهند داشت تا ببینند آیا این تأخیر کوتاه است - هفته‌ها یا ماه‌ها همکاری اضافی - یا نشان‌دهنده یک چالش اساسی‌تر در ارائه مدل‌هایی با قابلیت‌های سایبری در سطح بحرانی به بازار است.

این قسمت همچنین سوالات رقابتی را مطرح می کند. OpenAI با فشار رقبای خود از جمله Anthropic، Google، Meta و آزمایشگاه های نوظهور چینی مواجه است که همگی در حال رقابت برای عرضه مدل های توانمندتر هستند. تأخیر با انگیزه ایمنی، در حالی که مسئول است، می‌تواند در بازاری که به سرعت در حال حرکت است - تنشی که در قلب رقابت مدل‌های مرزی قرار دارد، زمین را تسلیم کند.

از هوش مصنوعی جلوتر بمانید

تلاقی قابلیت های هوش مصنوعی و امنیت در حال تبدیل شدن به یکی از داستان های تعیین کننده صنعت است. برای گزارش‌های واضح و منبع‌دار در مورد ایمنی مدل، پیشرفت‌های مرزی و شرکت‌هایی که این حوزه را شکل می‌دهند، صفحه اصلی ما را نشانه‌گذاری کنید و اخبار هوش مصنوعی → را در https://aibuzzwire.news بخوانید.