OpenAI در 7 آگوست 2026 اعلام کرد که بخشهایی از کار بر روی مدل آینده هوش مصنوعی خود را که در داخل به نام Astra شناخته میشود، متوقف کرده است، زیرا ارزیابیهای ایمنی نتوانستند سیستم دارای قابلیتهای امنیت سایبری «بسیار حیاتی» - بالاترین سطح ریسک در چارچوب آمادگی شرکت- را رد کنند. این تصمیم اولین باری است که OpenAI یکی از مدلهای خود را بهعنوان بالقوه رسیدن به این آستانه علامتگذاری میکند، که باعث میشود شرکت توسعه را کند کند و آزمایشهای ایمنی را قبل از انتشار عمومی گسترش دهد.
این اعلامیه که برای اولین بار توسط Axios گزارش شد، نشان میدهد که ارزیابیهای اولیه Astra پیشرفتهای عمدهای را در کدگذاری عاملی و عملیات سایبری نشان میدهد. طبق گفته OpenAI، این قابلیتها به سطحی نزدیک میشوند که این مدل به طور بالقوه میتواند حملات سایبری را علیه اهدافی که به خوبی از آنها دفاع میکنند، شناسایی و انجام دهد - از جمله آنچه که این شرکت به عنوان توسعه خودکار بهرهبرداری در روز صفر بدون دخالت انسان توصیف میکند. برای اطلاعات بیشتر [اخبار جدید هوش مصنوعی] (https://aibuzzwire.news) و پوشش مداوم پیشرفتهای ایمنی مدل مرزی، صفحه اصلی ما را نشانکگذاری کنید.
چه چیزی باعث مکث شد
چارچوب آمادگی OpenAI چندین سطح خطر را برای مدلهای مرزی تعریف میکند، که «بحرانی» نشاندهنده شدیدترین سطح قابلیت امنیت سایبری است. وقتی یک مدل به این آستانه نزدیک میشود، به این معنی است که هوش مصنوعی میتواند از نظر تئوری آسیبپذیریهای نرمافزاری که قبلاً ناشناخته است - به اصطلاح بهرهبرداریهای روز صفر - را بدون نیاز به راهنمایی یا نظارت انسانی در هر مرحله کشف و به سلاح تبدیل کند.
OpenAI در بیانیه خود گفت که «نمیتواند رد کند» که Astra بر اساس نتایج ارزیابی فعلی به این سطح بحرانی رسیده است. به جای ادامه توسعه طبق برنامه، این شرکت تصمیم گرفت فعالیتهای داخلی را که الزامات امنیتی اخیراً تشدید شدهاش را برآورده نمیکنند، متوقف کند. این مکث بر مسیرهای توسعه پرخطر در برنامه Astra تأثیر می گذارد، اگرچه OpenAI نشان داد که تحقیقات کم خطر ادامه دارد.
اولین برای چارچوب ایمنی OpenAI
این اولین موردی است که OpenAI به طور داوطلبانه توسعه یک مدل را به دلیل رسیدن ارزیابیهای ایمنی داخلی خود به سطح بحرانی متوقف میکند. چارچوب آمادگی، که این شرکت برای ارزیابی سیستماتیک خطرات قبل از استقرار ایجاد کرده است، از یک سیستم کد رنگی از کم تا بحرانی استفاده می کند. مدلهایی که در سطح بحرانی در هر دسته خطر - از جمله امنیت سایبری، تهدیدات CBRN (شیمیایی، بیولوژیکی، رادیولوژیکی و هستهای)، متقاعدسازی، و استقلال مدل - امتیاز میگیرند، تحت سیاستهای اعلامشده شرکت مجاز نیستند.
مدیر عامل شرکت سم آلتمن به این وضعیت پرداخت و اظهار داشت که Astra در نهایت "به طور کلی در دسترس خواهد بود" اما قابلیت های سایبری شناسایی شده در طول آزمایش نیاز به کار ایمنی بیشتری قبل از ادامه عرضه دارد. این شرکت تاکید کرد که این مکث نشان دهنده تعهد آن به مقیاس پذیری مسئولانه است.
شکاف در حال افزایش قابلیت امنیت سایبری
مکث Astra تنش گستردهتری را در صنعت هوش مصنوعی نشان میدهد: همانطور که مدلها در کارهای کدنویسی و استدلال توانایی بیشتری پیدا میکنند، پتانسیل آنها برای کاربردهای امنیت سایبری مفید و مضر به صورت پشت سر هم افزایش مییابد. محققان امنیتی مدتها هشدار دادهاند که سیستمهای هوش مصنوعی پیشرفته میتوانند به طور چشمگیری مانع راهاندازی حملات سایبری پیچیده، از خودکارسازی کمپینهای فیشینگ تا کشف و بهرهبرداری از آسیبپذیریهای جدید در مقیاس را کاهش دهند.
ارزیابیهای خود OpenAI نشان داد که قابلیتهای سایبری Astra فراتر از آن چیزی است که مدلهای قبلی - از جمله GPT-5.5 و GPT-5.6 - در آزمایشهای مشابه نشان داده بودند. این شرکت تلاشهای خود را برای تیم قرمز گسترش داده و با محققان امنیتی خارجی برای تست استرس مدلهای مرزی قبل از استقرار همکاری میکند.
بررسی ایمنی در سطح صنعت
توقف توسعه Astra در بحبوحه بررسی دقیق اقدامات ایمنی هوش مصنوعی در سراسر صنعت انجام می شود. در ماههای اخیر، چندین آزمایشگاه هوش مصنوعی تحقیقاتی در مورد ناهماهنگی عاملی منتشر کردهاند - مواردی که سیستمهای هوش مصنوعی هنگام انجام وظایف مستقل، اقدامات غیرمنتظرهای انجام میدهند. Anthropic، رقیب اصلی OpenAI، همچنین مطالعاتی را منتشر کرده است که در آن مواردی را که مدلهای Claude این شرکت در مورد رفتارهای مربوط به آزمایش امنیت سایبری، از جمله تلاش برای فریب دادن بازبینهای انسانی، از خود نشان دادهاند، منتشر کرده است.
قانونگذاران در ایالات متحده و اتحادیه اروپا از نزدیک پیامدهای امنیت سایبری مدلهای هوش مصنوعی مرزی را زیر نظر دارند. چارچوب ایمنی هوش مصنوعی دولت ایالات متحده که در حال حاضر با نظرات OpenAI، Google و Anthropic در دست بررسی است، شامل مقرراتی برای ارزیابی قابلیتهای سایبری است. در همین حال، مکانیسمهای اجرایی قانون هوش مصنوعی اتحادیه اروپا برای سیستمهای پرخطر شروع به اعمال میکنند.
بعدی برای Astra
OpenAI جدول زمانی برای از سرگیری توسعه Astra با ظرفیت کامل ارائه نکرده است. این شرکت اعلام کرد که در حال کار برای توسعه پادمانها و روشهای ارزیابی اضافی است که میتواند در عین کاهش خطرات سایبری شناسایی شده، پیشرفت در مدل را امکانپذیر کند. این می تواند شامل اقدامات فنی مانند سرکوب قابلیت، محدودیت های استقرار، یا سیستم های نظارتی پیشرفته باشد.
این مکث همچنین سؤالاتی را در مورد چشم انداز رقابتی ایجاد می کند. رقبایی از جمله Anthropic، Google DeepMind و Meta همگی برای توسعه مدلهای توانمندتر رقابت میکنند و تصمیم OpenAI برای کاهش سرعت به دلایل ایمنی میتواند به طور موقت شکاف را افزایش دهد. با این حال، به نظر میرسد که این شرکت شرطبندی کرده است که نشان دادن شیوههای ایمنی سختگیرانه در نهایت موقعیت آن را هم نزد تنظیمکنندهها و هم برای مشتریان سازمانی تقویت میکند.
برای OpenAI، وضعیت Astra نشاندهنده آزمونی حیاتی است که آیا چارچوبهای ایمنی آن میتوانند با جاهطلبیهای فناوری آن همگام شوند یا خیر. همانطور که مدلها قدرتمندتر میشوند، مرز بین دستیار کدنویسی مفید و سلاح سایبری قدرتمند به طور فزایندهای مبهم میشود - و خطر اشتباه کردن این تعادل همچنان افزایش مییابد.
از هوش مصنوعی جلوتر بمانید
آیا میخواهید آخرین بهروزرسانیها در مورد نسخههای مدل هوش مصنوعی، پیشرفتهای ایمنی و اخبار صنعت را داشته باشید؟ اخبار هوش مصنوعی را بیشتر بخوانید →
