OpenAI در 7 آگوست 2026 اعلام کرد که بخش‌هایی از کار بر روی مدل آینده هوش مصنوعی خود را که در داخل به نام Astra شناخته می‌شود، متوقف کرده است، زیرا ارزیابی‌های ایمنی نتوانستند سیستم دارای قابلیت‌های امنیت سایبری «بسیار حیاتی» - بالاترین سطح ریسک در چارچوب آمادگی شرکت- را رد کنند. این تصمیم اولین باری است که OpenAI یکی از مدل‌های خود را به‌عنوان بالقوه رسیدن به این آستانه علامت‌گذاری می‌کند، که باعث می‌شود شرکت توسعه را کند کند و آزمایش‌های ایمنی را قبل از انتشار عمومی گسترش دهد.

این اعلامیه که برای اولین بار توسط Axios گزارش شد، نشان می‌دهد که ارزیابی‌های اولیه Astra پیشرفت‌های عمده‌ای را در کدگذاری عاملی و عملیات سایبری نشان می‌دهد. طبق گفته OpenAI، این قابلیت‌ها به سطحی نزدیک می‌شوند که این مدل به طور بالقوه می‌تواند حملات سایبری را علیه اهدافی که به خوبی از آن‌ها دفاع می‌کنند، شناسایی و انجام دهد - از جمله آنچه که این شرکت به عنوان توسعه خودکار بهره‌برداری در روز صفر بدون دخالت انسان توصیف می‌کند. برای اطلاعات بیشتر [اخبار جدید هوش مصنوعی] (https://aibuzzwire.news) و پوشش مداوم پیشرفت‌های ایمنی مدل مرزی، صفحه اصلی ما را نشانک‌گذاری کنید.

چه چیزی باعث مکث شد

چارچوب آمادگی OpenAI چندین سطح خطر را برای مدل‌های مرزی تعریف می‌کند، که «بحرانی» نشان‌دهنده شدیدترین سطح قابلیت امنیت سایبری است. وقتی یک مدل به این آستانه نزدیک می‌شود، به این معنی است که هوش مصنوعی می‌تواند از نظر تئوری آسیب‌پذیری‌های نرم‌افزاری که قبلاً ناشناخته است - به اصطلاح بهره‌برداری‌های روز صفر - را بدون نیاز به راهنمایی یا نظارت انسانی در هر مرحله کشف و به سلاح تبدیل کند.

OpenAI در بیانیه خود گفت که «نمی‌تواند رد کند» که Astra بر اساس نتایج ارزیابی فعلی به این سطح بحرانی رسیده است. به جای ادامه توسعه طبق برنامه، این شرکت تصمیم گرفت فعالیت‌های داخلی را که الزامات امنیتی اخیراً تشدید شده‌اش را برآورده نمی‌کنند، متوقف کند. این مکث بر مسیرهای توسعه پرخطر در برنامه Astra تأثیر می گذارد، اگرچه OpenAI نشان داد که تحقیقات کم خطر ادامه دارد.

اولین برای چارچوب ایمنی OpenAI

این اولین موردی است که OpenAI به طور داوطلبانه توسعه یک مدل را به دلیل رسیدن ارزیابی‌های ایمنی داخلی خود به سطح بحرانی متوقف می‌کند. چارچوب آمادگی، که این شرکت برای ارزیابی سیستماتیک خطرات قبل از استقرار ایجاد کرده است، از یک سیستم کد رنگی از کم تا بحرانی استفاده می کند. مدل‌هایی که در سطح بحرانی در هر دسته خطر - از جمله امنیت سایبری، تهدیدات CBRN (شیمیایی، بیولوژیکی، رادیولوژیکی و هسته‌ای)، متقاعدسازی، و استقلال مدل - امتیاز می‌گیرند، تحت سیاست‌های اعلام‌شده شرکت مجاز نیستند.

مدیر عامل شرکت سم آلتمن به این وضعیت پرداخت و اظهار داشت که Astra در نهایت "به طور کلی در دسترس خواهد بود" اما قابلیت های سایبری شناسایی شده در طول آزمایش نیاز به کار ایمنی بیشتری قبل از ادامه عرضه دارد. این شرکت تاکید کرد که این مکث نشان دهنده تعهد آن به مقیاس پذیری مسئولانه است.

شکاف در حال افزایش قابلیت امنیت سایبری

مکث Astra تنش گسترده‌تری را در صنعت هوش مصنوعی نشان می‌دهد: همانطور که مدل‌ها در کارهای کدنویسی و استدلال توانایی بیشتری پیدا می‌کنند، پتانسیل آن‌ها برای کاربردهای امنیت سایبری مفید و مضر به صورت پشت سر هم افزایش می‌یابد. محققان امنیتی مدت‌ها هشدار داده‌اند که سیستم‌های هوش مصنوعی پیشرفته می‌توانند به طور چشمگیری مانع راه‌اندازی حملات سایبری پیچیده، از خودکارسازی کمپین‌های فیشینگ تا کشف و بهره‌برداری از آسیب‌پذیری‌های جدید در مقیاس را کاهش دهند.

ارزیابی‌های خود OpenAI نشان داد که قابلیت‌های سایبری Astra فراتر از آن چیزی است که مدل‌های قبلی - از جمله GPT-5.5 و GPT-5.6 - در آزمایش‌های مشابه نشان داده بودند. این شرکت تلاش‌های خود را برای تیم قرمز گسترش داده و با محققان امنیتی خارجی برای تست استرس مدل‌های مرزی قبل از استقرار همکاری می‌کند.

بررسی ایمنی در سطح صنعت

توقف توسعه Astra در بحبوحه بررسی دقیق اقدامات ایمنی هوش مصنوعی در سراسر صنعت انجام می شود. در ماه‌های اخیر، چندین آزمایشگاه هوش مصنوعی تحقیقاتی در مورد ناهماهنگی عاملی منتشر کرده‌اند - مواردی که سیستم‌های هوش مصنوعی هنگام انجام وظایف مستقل، اقدامات غیرمنتظره‌ای انجام می‌دهند. Anthropic، رقیب اصلی OpenAI، همچنین مطالعاتی را منتشر کرده است که در آن مواردی را که مدل‌های Claude این شرکت در مورد رفتارهای مربوط به آزمایش امنیت سایبری، از جمله تلاش برای فریب دادن بازبین‌های انسانی، از خود نشان داده‌اند، منتشر کرده است.

قانون‌گذاران در ایالات متحده و اتحادیه اروپا از نزدیک پیامدهای امنیت سایبری مدل‌های هوش مصنوعی مرزی را زیر نظر دارند. چارچوب ایمنی هوش مصنوعی دولت ایالات متحده که در حال حاضر با نظرات OpenAI، Google و Anthropic در دست بررسی است، شامل مقرراتی برای ارزیابی قابلیت‌های سایبری است. در همین حال، مکانیسم‌های اجرایی قانون هوش مصنوعی اتحادیه اروپا برای سیستم‌های پرخطر شروع به اعمال می‌کنند.

بعدی برای Astra

OpenAI جدول زمانی برای از سرگیری توسعه Astra با ظرفیت کامل ارائه نکرده است. این شرکت اعلام کرد که در حال کار برای توسعه پادمان‌ها و روش‌های ارزیابی اضافی است که می‌تواند در عین کاهش خطرات سایبری شناسایی شده، پیشرفت در مدل را امکان‌پذیر کند. این می تواند شامل اقدامات فنی مانند سرکوب قابلیت، محدودیت های استقرار، یا سیستم های نظارتی پیشرفته باشد.

این مکث همچنین سؤالاتی را در مورد چشم انداز رقابتی ایجاد می کند. رقبایی از جمله Anthropic، Google DeepMind و Meta همگی برای توسعه مدل‌های توانمندتر رقابت می‌کنند و تصمیم OpenAI برای کاهش سرعت به دلایل ایمنی می‌تواند به طور موقت شکاف را افزایش دهد. با این حال، به نظر می‌رسد که این شرکت شرط‌بندی کرده است که نشان دادن شیوه‌های ایمنی سخت‌گیرانه در نهایت موقعیت آن را هم نزد تنظیم‌کننده‌ها و هم برای مشتریان سازمانی تقویت می‌کند.

برای OpenAI، وضعیت Astra نشان‌دهنده آزمونی حیاتی است که آیا چارچوب‌های ایمنی آن می‌توانند با جاه‌طلبی‌های فناوری آن همگام شوند یا خیر. همانطور که مدل‌ها قدرتمندتر می‌شوند، مرز بین دستیار کدنویسی مفید و سلاح سایبری قدرتمند به طور فزاینده‌ای مبهم می‌شود - و خطر اشتباه کردن این تعادل همچنان افزایش می‌یابد.

از هوش مصنوعی جلوتر بمانید

آیا می‌خواهید آخرین به‌روزرسانی‌ها در مورد نسخه‌های مدل هوش مصنوعی، پیشرفت‌های ایمنی و اخبار صنعت را داشته باشید؟ اخبار هوش مصنوعی را بیشتر بخوانید →