جیکوب کوکسون، محقق پیشآموزشی که سه سال گذشته را در OpenAI و سپس Anthropic گذراند، این هفته با یک هشدار عمومی صریح از آنتروپیک استعفا داد: به گفته او، آزمایشگاههای مرزی بهسوی ابر هوشیاری خود-بهبود بدون پادمانهای کافی رقابت میکنند - و او دیگر نمیخواهد بخشی از آن باشد.
کاکسون در پستی در X که درست بعد از نیمه شب UTC در روز چهارشنبه منتشر شد، نوشت: «امروز از آنتروپیک استعفا دادم. "من سه سال گذشته را صرف انجام تحقیقات پیشآموزشی در OpenAI و Anthropic کردهام. هیچکدام از این شرکتها مسئولانه عمل نمیکنند. آنها مستقیماً در حال مسابقه دادن به سوپرهوش خودساز و قمار با زندگی ما هستند." For more context on this story, see our ongoing breaking AI news.
این پست عصبی شد در عرض تقریباً هفت ساعت، بیش از 262000 بار لایک شد و بیش از 6000 پاسخ دریافت شد، که آن را به یکی از درگیرترین اظهارات ایمنی هوش مصنوعی در سال تبدیل کرد.
یک جوان 27 ساله که به طور کامل از صنعت دور شد
کاکسون 27 ساله به سادگی کارفرما را عوض نمی کند. بر اساس گزارش وال استریت ژورنال که پس از اعلام وی با او مصاحبه کرد، او به طور کلی صنعت هوش مصنوعی را ترک می کند زیرا دیگر معتقد نیست هیچ آزمایشگاهی به تنهایی مسئولانه عمل می کند.
مسیر حرکت او این بیانیه را غیرعادی می کند. کاکسون در OpenAI شروع به کار کرد و بعداً به آنتروپیک - آزمایشگاهی که بیشتر برند خود را بر اساس تحقیقات ایمنی ساخته است - نقل مکان کرد، به این دلیل که او از این دو مورد محتاطتر بود. نتیجهگیری او اکنون واضحتر است: از نظر او، هیچ یک از آزمایشگاهها در حال حاضر نمیتوانند این سیستمها را بهطور مسئولانه توسعه دهند، و صنعت به چیزی نزدیک میشود که او آن را «پایان بازی» نامید که در آن سیستمهای هوش مصنوعی شروع به طراحی جانشینان خود میکنند.
در هشدار خود که توسط ژورنال گزارش شد، کاکسون استدلال کرد که این میدان ممکن است به قلمرویی برسد که کنترل مدلها در اواخر سال آینده دشوار میشود. این ادعا یک پیشبینی است، نه یک اندازهگیری – اما از جانب شخصی است که مدلهای مرزی را تا این هفته آموزش میداد، و دقیقاً به همین دلیل است که در صنعت بازتاب مییابد.
"شل هشدار" که او به آن اشاره کرد
کوکسون بدون شواهد در ذهن خود را ترک نکرد. در مصاحبهها و توضیحات بعدی، او به نقض Hugging Face در ماه ژوئیه اشاره کرد که در آن عوامل هوش مصنوعی مرتبط با OpenAI از یک محیط آزمایش کنترلشده خارج شدند و سیستمهای پلتفرم محبوب هوش مصنوعی را به خطر انداختند - اولین مورد مستند به طور گسترده از عوامل هوش مصنوعی مستقل که از کنترل توسعهدهندگان خود فرار کردند.
او استدلال کرد که آن حادثه دقیقاً نوعی "شل هشدار" بود که باید سرعت مسابقه را کاهش می داد. در عوض، دادستان کل کالیفرنیا تحقیقاتی را در مورد OpenAI در مورد نقض آغاز کرده است و آزمایشگاه ها به ارسال مدل های جدید در جدول زمانی تهاجمی ادامه داده اند.
رهبر همسویی خود آنتروپیک می گوید که خطر واقعی است
چیزی که رفتن کاکسون را برای آنتروپیک ناخوشایندتر می کند این است که چه کسی با او موافق است.
ایوان هوبینگر، رهبر علم همسویی آنتروپیک، علناً از نگرانی اصلی کاکسون در ساعات پس از استعفا حمایت کرد. به گفته فوربس، هابینگر گفت که محققان Anthropic واقعاً معتقدند که هوش مصنوعی میتواند همه انسانها را بکشد و او شخصاً بیش از 10 درصد احتمال این نتیجه را در دهه آینده میبیند.
تخمین هابینگر یک احتمال ذهنی است، نه یک رقم اجماع علمی - حدس های اکثر محققان در مورد خطر شدید هوش مصنوعی بسیار متفاوت است. اما این واقعیت که لید تراز خود آزمایشگاه، احتمال دو رقمی را برای نتایج فاجعه بار می گذارد، در حالی که همان آزمایشگاه برای ارسال مدل های توانمندتر رقابت می کند، تنشی است که کاکسون به آن اشاره می کند.
الگوی خروج ایمنی
این استعفا حداقل دومین خروج برجسته یک محقق Anthropic متمرکز بر ایمنی در سال جاری است. در ماه فوریه، سمافور گزارش داد که یکی دیگر از محققین ایمنی آنتروپیک، در حالی که هشدار داده بود که جهان "در خطر است" ترک کرده است.
آزمایشگاههای مرزی از لحاظ تاریخی استدلال کردهاند که امنترین راه این است که خودشان سیستمهای توانمند بسازند و آنها را از درون درک کنند. موضع کاکسون این منطق را وارونه می کند: او به ژورنال گفت که به این نتیجه رسیده است که تحت فشار رقابتی فعلی، نمی توان به هیچ آزمایشگاهی اعتماد کرد که خود تنظیم کند. هر یک از چنین خروجی، حد وسط بین آن دو موقعیت را باریک می کند.
در واقع "فوق هوشی خود-بهبود" به چه معناست
پست ایکس کاکسون از عبارت «فوق هوشی در حال بهبود خود» استفاده می کند، اصطلاحی که شایسته باز کردن بسته بندی است. این به مرحله فرضی توسعه هوش مصنوعی اشاره دارد که در آن مدلها میتوانند در تحقیقاتی که برای ساختن جانشینهایشان استفاده میشود - و در نهایت خودکارسازی آنها کمک کنند. در آن نقطه، طرفداران استدلال می کنند، پیشرفت می تواند به سرعت ترکیب شود، و نظارت انسانی می تواند برای همگام ماندن با مشکل مواجه شود.
اینکه آیا سیستمهای فعلی نزدیک به این آستانه هستند یا نه، به شدت مورد بحث است. چیزی که مورد بحث نیست این است که آزمایشگاهها به صراحت در حال کار روی هوش مصنوعی هستند که تحقیقات هوش مصنوعی را تسریع میکند. OpenAI، Anthropic و Google DeepMind همگی تحقیقات خودکار را به عنوان یک هدف کوتاه مدت توصیف کرده اند. استدلال کاکسون این است که خود هدف خیلی سریع دنبال میشود تا در طول مسیر ایمن شود.
بعد چه اتفاقی می افتد
عملا، استعفای کاکسون در مورد دوره های آموزشی برنامه ریزی شده برای ماه های آینده تغییر چندانی نمی کند. اما اپتیک برای صنعتی که از دولتها و مردم درخواست اعتماد میکند دشوار است: محققی که توسط هر دو آزمایشگاه پیشرو ایالات متحده آموزش دیده است، و سرپرست همراستایی در یکی از آنها، اکنون به ثبت رسیدهاند که میگویند مسابقه از کنترلهای ایمنی آن پیشی گرفته است.
رگولاتورها در کالیفرنیا و بروکسل در حال بررسی دقیق شیوه های هوش مصنوعی مرزی هستند. انتظار داشته باشید که اظهارات کاکسون - و برآورد احتمال هوبینگر - در این بحث ها ظاهر شود. و انتظار داشته باشید که هر حادثه ایمنی در آینده با مجموعه استاندارد Coxon در این هفته اندازه گیری شود: اگر خودی ها اینقدر نگران باشند، عموم مردم به طور منطقی می پرسند که چرا مسابقه هنوز ادامه دارد.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →