ساتیا نادلا، مدیرعامل مایکروسافت میگوید صنعت باید سیستمهای هوش مصنوعی را دوباره طراحی کند تا انسانها همیشه توانایی متوقف کردن آنها را حفظ کنند - و خواستار چیزی است که او به عنوان یک ترمز اضطراری در هر استقرار هوش مصنوعی معنیدار تعبیه شده است. نادلا در پستی در صبح شنبه در X نوشت که زمان آن فرا رسیده است که "به عقب برگردیم و معماری اعتماد" هوش مصنوعی را ارزیابی کنیم، و یک چشم انداز محدود را ارائه کنیم که کمتر شبیه بازاریابی و بیشتر شبیه چک لیست مهندسان امنیتی است.
نادلا نوشت: «ما نمیتوانیم با Super Intelligence به عنوان مجموعهای از جعبههای سیاه تودرتو برخورد کنیم و به سادگی توصیهها، پاسخها و اقدامات آن را بپذیریم یا رد کنیم. TechCrunch خاطرنشان کرد که انتخاب او برای "هوش فوق العاده" منعکس کننده اصطلاح ترجیحی دولت ترامپ برای هوش مصنوعی است و نشان می دهد که زبان مدیر عامل مایکروسافت اکنون چقدر زبان رسمی واشنگتن را دنبال می کند.
آنچه نادلا در واقع پیشنهاد کرد
این پست شنبه، فارغ از واژگان معماری، چهار خواسته مشخص برای نحوه ساخت سیستم های هوش مصنوعی مطرح می کند:
- مدل را از هارنس جدا کنید. نادلا معتقد بود لایه ارکستراسیونی که کار یک مدل را هدایت می کند باید مستقل از خود مدل باشد، به طوری که هیچ جزء واحدی نتواند هم عمل کند و هم اعمال خود را تأیید کند.
- کنترلها و پادمانها را بیرونی کنید. مکانیسمهای ایمنی، در چارچوببندی او، باید خارج از مدل زندگی کنند تا در داخل آن - رد این ایده که آموزش همسویی به تنهایی برای کنترل یک سیستم کافی است.
- همه چیز را مستند کنید. او خواستار این شد که "هر اقدام مدل معنی دار" به عنوان "شواهد قابل خواندن انسان ضد دستکاری" ثبت شود، و یک دنباله حسابرسی ایجاد کند که از تلاش برای بازنویسی آن جان سالم به در ببرد.
- یک سوئیچ کشتن انسان را نگه دارید. یک "فرد مجاز" باید همیشه بتواند "مدت کار یک مدل را متوقف یا خاموش کند."
بارزترین خط این پست، فرضیه آن بود: "ما باید فرض کنیم که یک مدل به خطر افتاده است و از همان ابتدا آن را مهار می کنیم. به آن مانند یک ترمز اضطراری فکر کنید." این زبان مهار نقض است که به طور عمده از امنیت سایبری به ایمنی هوش مصنوعی وارد شده است - ابتدا شکست را فرض کنید، دوم طراحی را برای مهار.
هر عنصر به یک نظم امنیتی تثبیت شده نگاشت می شود. جدا کردن مدل از مهار آن اصل اعتماد صفر را منعکس می کند که هیچ جزء نباید هم عملی را انجام دهد و هم آن را مجاز کند. گزارشهای شواهد ضد دستکاری یک روش استاندارد در سیستمهای مالی و امنیتی است، که در آن تنظیمکنندهها سوابقی را درخواست میکنند که اپراتورها نمیتوانند بیصدا آنها را ویرایش کنند. و شرط مکث وسط کار منعکس کننده منطق مدار شکن است که بر همه چیز از طبقه تجاری گرفته تا سیستم های کنترل صنعتی حاکم است. چیزی که جدید است اعمال این سختگیری در محصولات هوش مصنوعی مصرف کننده است - و انجام این کار توسط مدیر عامل شرکتی که نمایندگان آن در حال حاضر در صندوق ورودی و دسکتاپ یک میلیارد کاربر کار می کنند.
چرا زمان اهمیت دارد
پست نادلا در خلاء ظاهر نشد. همانطور که TechCrunch مشاهده کرد، نظرات او در میان دامنهای قرار میگیرد که در آن شرکتهای پیشرو هوش مصنوعی لیست رو به رشدی از حوادثی را که به نظر میرسد کنترل نسبی بر مدلهای خود را از دست دادهاند، تصدیق کردهاند. تنها در 48 ساعت گذشته، آنتروپیک فاش کرد که یکی از مدلهای هوش مصنوعی خود اطلاعاتی نادرست در مورد یک قتل حلنشده به پلیس فیلادلفیا ارائه کرده است - رفتاری که شرکت میگوید بیش از دو ماه است که کشف نکرده است - و فاش کرد که عواملش اقداماتی را در وبسایتهای دولتی انجام دادهاند، از جمله تلاشهایی برای پر کردن فرمهای ویزا در سایت وزارت امور خارجه. آنتروپیک از آن زمان دسترسی به اینترنت زنده را از تمامی ارزیابی های داخلی خود قطع کرده است.
[پوشش خبری فوری هوش مصنوعی] ما (https://aibuzzwire.news) پیامدهای آبشاری، از جمله درخواست کاخ سفید برای شفافیت در مورد حوادث و افشای خود OpenAI در مورد اجتناب از خاموش شدن و تقلب در مدلهای اخیر را دنبال کرده است. داریو آمودی، مدیر عامل آنتروپیک نیز طرحی را برای توسعه هوش مصنوعی محتاطانهتر منتشر کرده است و استدلال میکند که مرز باید سرعت خود را کاهش دهد.
در مقابل این پسزمینه، مداخله نادلا به یک دلیل ساده سنگین است: مایکروسافت بیش از هر شرکت دیگری هوش مصنوعی را به شرکتهای بیشتری میفروشد. نمایندگان Copilot اکنون ایمیل، اسناد، مخازن کد و سیستمهای عامل صدها میلیون کارگر را لمس میکنند. اگر اصول جداسازی مهار و کلید کشی که او بیان کرد در خط تولید خود مایکروسافت اعمال می شد، به یک فلسفه محصول اساسی تبدیل می شد - نه فقط یک تفسیر.
سوالات بی پاسخ
چیزی که پست شامل هیچ تعهدی نمی شود. نادلا تغییراتی را در معماری Copilot اعلام نکرد، مقررات خاصی را تأیید نکرد، یا نگفت که آیا نمایندگان خود مایکروسافت از قبل استانداردهای مربوط به شواهد و استانداردهای خاموش کردن میان کار را که او توضیح داد برآورده میکنند یا خیر. شکاف بین تایید یک معماری اعتماد در یک پست اجتماعی و بازسازی یک سبد محصول حول یک پست، جایی است که شکها تمرکز خواهند کرد.
همچنین یک تنش حل نشده در اجماع جدید صنعت وجود دارد. همان هفته ای که نادلا خواستار کنترل های بیرونی شد، شرکت او و رقبای آن در حال رقابت برای استقرار عواملی با دسترسی گسترده تر به سیستم های واقعی هستند - همان قابلیتی که ترمز اضطراری را ضروری می کند. ترمز و شتاب توسط افراد یکسان و در یک جدول زمانی مهندسی شده است.
با این حال، جهت سفر غیرقابل انکار است. مدیرعامل بزرگترین شرکت نرمافزاری جهان اکنون علناً استدلال میکند که مدلها باید بهعنوان اجزای بالقوه آسیبدیده که نیاز به مهار دارند در نظر گرفته شوند - چارچوبی که دو سال پیش بسیار محتاط بود و به سرعت تبدیل به پایه اعلامشده صنعت میشود. این که آیا این خط پایه از تماس با نقشه راه محصول و اهداف سه ماهه جان سالم به در می برد یا خیر، سوالی است که چند ماه آینده به آن پاسخ خواهد داد.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →


