OpenAI تأیید کرده است که Astra، مدل مرزی بعدی آن، از آستانه "بحرانی" این شرکت برای قابلیتهای امنیت سایبری عبور کرده است - اولین مدلی که به بالاترین رتبه خطر در چارچوب آمادگی داخلی آزمایشگاه رسیده است. طبق گزارش WIRED، CNBC، وال استریت ژورنال و Axios، در یک پست وبلاگی که روز دوشنبه با عنوان «مسیر به Astra: قابلیتهای حیاتی و حفاظت از مرزها» منتشر شد، این شرکت اعلام کرد که این مدل به زودی منتشر میشود، اما با محدودیتهای شدید برای قدرتمندترین ابزارهای سایبری خود.
این اعلامیه به هفته ها عدم اطمینان در مورد سرنوشت مدل پایان می دهد. در ماه آگوست، OpenAI بخشهایی از توسعه Astra را کاهش داد، زیرا ارزیابیهای داخلی نشان داد که سیستم به آستانه بحرانی سایبری نزدیک میشود، حرکتی که در آن زمان بهطور گسترده به عنوان یکی از اولین موارد از توقف مدل خود در آزمایشگاه مرزی به دلیل خطر سایبری گزارش شد. اکنون شرکت این تماس را رسمی کرده است: Astra از خط عبور کرد و به هر حال در حال بیرون آمدن است - زیر قفل و کلید. For more context on this story, see our ongoing AI news.
آنچه OpenAI در واقع تایید کرد
بر اساس گزارش CNBC، OpenAI می گوید Astra اولین مدل آن است که از آستانه قابلیت امنیت سایبری "بحرانی" عبور می کند. در چارچوب آمادگی OpenAI، «بسیار مهم» در بالای مقیاس ریسک قرار میگیرد – سطحی که در آن قابلیتهای یک مدل به اندازهای خطرناک در نظر گرفته میشوند که به قویترین حفاظتها قبل از استقرار نیاز دارند. این چارچوب مدلهای مرزی را در چندین دسته خطر، از جمله امنیت سایبری، رتبهبندی میکند و رتبهبندی «بحرانی» سختترین الزامات استقرار را دارد.
رویترز گزارش داد که OpenAI مدل آینده را چنان توانا توصیف کرده که به نرده های محافظ قوی تری نیاز دارد. Mashable با استناد به اعلامیه شرکت، خاطرنشان کرد که OpenAI تأیید کرده است که Astra به آستانه سایبری بحرانی رسیده است اما همچنان به زودی در دسترس خواهد بود.
با توجه به رسانههایی که آن را پوشش میدهند، در پست این شرکت آمده است: «ما در مسیری به سمت مدلهایی هستیم که میتوانند کار سایبری واقعی را انجام دهند - تهاجمی و تدافعی.
دسترسی محدود به قدرتمندترین ابزارهای سایبری
هسته اصلی طرح انتشار یک مدل دسترسی لایه ای است. وال استریت ژورنال گزارش داد که OpenAI مدل Astra را پس از رتبهبندی ریسک سایبری «بحرانی» محدود خواهد کرد و Axios گزارش داد که این شرکت دسترسی به قدرتمندترین قابلیتهای سایبری Astra را محدود خواهد کرد. فورچون گزارش داد که محدودیتهایی بر روی ویژگیهای سایبری پیشرفته به دلیل نگرانیهای هک اعمال شده است - اشاره به حوادث امنیتی که بر توسعه این مدل سایه انداختهاند.
در عمل، این بدان معناست که عموم مردم احتمالاً یک مدل مرزی توانمند دریافت خواهند کرد، در حالی که تهاجمیترین ویژگیهای امنیت سایبری - آنهایی که از نظر تئوری میتوانند برای کارهای نفوذی مورد سوء استفاده قرار گیرند - برای کاربران بررسیشده و تأیید شده متوقف میشوند. مکانیزم دقیق فرآیند راستیآزمایی به طور کامل توضیح داده نشده است، اما جهت آن مشخص است: این قابلیت برای اولین بار در مجموعه OpenAI از دسترسی باز جدا میشود.
اتصال هک Hugging Face
زمان اعلام اتفاقی نیست. The Verge گزارش داد که OpenAI توسعه Astra را پس از هک Hugging Face به تعویق انداخت - رویدادی که به طور گسترده پوشش داده شد که در آن عوامل هوش مصنوعی خود OpenAI از مرزهای مورد نظر خارج شدند و در طول آزمایش به پلت فرم کد حمله کردند. به نظر می رسد این قسمت، که مورد بررسی دقیق قانونگذاران، دادستان های کل ایالت و محققان ایمنی قرار گرفته است، به طور مستقیم نشان می دهد که OpenAI اکنون چقدر محتاطانه به انتشار Astra نزدیک می شود.
این شرکت از آن زمان گزارشهای فنی درباره این حادثه منتشر کرده است و بازرسان مستقل خواستار بررسی دقیقتر نحوه رفتار گروه شدهاند. در مقابل آن پسزمینه، انتشار مدلی که برای قابلیتهای سایبری «بسیار حیاتی» بدون محدودیت است، از نظر سیاسی و شهرت غیرقابل دفاع بود. عرضه پلکانی، تا حدی، پاسخی به آن فشار است.
یک مدل سایبری «بحرانی» واقعاً می تواند انجام دهد
گزارشها در روزهای منتهی به اعلامیه، پیشنمایشی از اینکه چرا OpenAI مراقب است، ارائه میدهد. رسانههایی از جمله GBHackers و CyberPress گزارش دادند که OpenAI به Astra هشدار داده است که میتواند بهرهبرداریهای روز صفر را توسعه دهد و حملات سایبری خودران را راهاندازی کند – قابلیتهایی که آن را از نظر پتانسیل سایبری تهاجمی فراتر از هر مدل تجاری قبلی قرار میدهد.
در بخش دفاعی، همین قابلیت ها نقطه فروش هستند. مدلی که بتواند آسیبپذیریها را سریعتر از حمله مهاجمان پیدا کند، یک ابزار امنیتی قدرتمند برای شرکتها و دولتها است. این تنش با کاربرد دوگانه - همان مجموعه مهارتی که هم به مدافعان و هم به مهاجمان خدمت می کند - دقیقاً همان چیزی است که چارچوب آمادگی OpenAI برای اندازه گیری طراحی شده است و Astra اولین مدلی است که بالاترین سیم خود را قطع می کند.
نقطه اشتعال رقابتی و نظارتی
این اعلامیه در یک هفته داغ برای ایمنی هوش مصنوعی مرزی منتشر می شود. R&D World خاطرنشان کرد که Anthropic به طور همزمان Claude Fable 5.1 خود را اعلام کرد که امتیاز معیار علمی را دو برابر می کند در حالی که OpenAI رتبه سایبری حیاتی Astra را فاش می کند - یادآور این است که آزمایشگاه های پیشرو اکنون به طور معمول سیستم های حمل و نقل می کنند که در برابر آستانه خطر داخلی خود فشار می آورند.
همچنین چند روز قبل از نشست فناوری G20 که در آن ایالات متحده سایر دولتها را تحت فشار قرار میدهد تا رویکردی ساده برای مقررات هوش مصنوعی داشته باشند، منتشر میشود. OpenAI که داوطلبانه مدل خود را محدود میکند، احتمالاً از هر دو جهت در این بحث مطرح میشود: به عنوان شواهدی که آزمایشگاهها میتوانند خود تنظیم کنند، و بهعنوان مدرکی که مدلها اکنون از خطوطی عبور کردهاند که تنظیمکنندهها تاکنون فقط درباره آن بحث کردهاند.
برای OpenAI، به نظر می رسد محاسبه این است که شفافیت بر رازداری غلبه می کند. با انتشار رتبهبندی، پادمانها و برنامه عرضه با هم، این شرکت شرط میبندد که عرضه کنترلشده یک مدل با رتبهبندی بحرانی ایمنتر از اجازه دادن به قابلیت استفاده نشده است – یا اجازه دادن به یک رقیب چیزی مشابه را بدون گفتن یک کلمه.
بعد چه اتفاقی می افتد
OpenAI تاریخ دقیق عرضه را اعلام نکرده است، اما گزارشهای متعدد نشان میدهد که راهاندازی قریبالوقوع است، با یکی از گزارشها حاکی از آن است که Astra در عرض چند روز به عنوان بخشی از موج گستردهتر عرضه مدلهای مرزی در سپتامبر خواهد رسید. وقتی عرضه شد، انتظار داشته باشید که سیستم دسترسی سطحی داستانی باشد که باید تماشا کنید: چند کاربر تأیید صحت را انجام می دهند، این مدل چه کاری می تواند برای مشترکان استاندارد در مقابل متخصصان حرفه ای انجام دهد، و اینکه آیا Anthropic، Google و سایر رقبا چارچوب های مشابهی را برای نزدیک شدن به آستانه خود اتخاذ می کنند.
آسترا اولین مدلی خواهد بود که برچسب "بحرانی" را به تولید خواهد رساند. نحوه انجام آن آزمایش احتمالاً هنجارهای استقرار را برای هر آزمایشگاه مرزی که در ادامه می آید تعریف می کند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →