آنتروپیک Accenture - نه یک سازمان غیرانتفاعی ایمنی هوش مصنوعی - را به عنوان اولین شرکت کننده در برنامه جاه طلبانه خود برای استقرار ارزیاب های شخص ثالث در آزمایشگاه های مرزی هوش مصنوعی انتخاب کرده است.
طبق یک پست وبلاگی که توسط TechCrunch به نقل از TechCrunch، کارکنان دانشکده، شرکتی که Accenture در ژانویه بهعنوان بخش هوش مصنوعی آن خریداری کرد، «ارزیابی و تیمبندی مدلها، انجام ارزیابیهای همترازی، و آزمایش پادمانهای مدل» را در Anthropic آغاز خواهند کرد. هر دو شرکت انتظار دارند حداقل 1 میلیارد دلار در این پروژه طی پنج سال آینده سرمایه گذاری کنند. رویترز این تعهد را 2 میلیارد دلار توصیف کرد. برای خوانندگانی که [اخبار ایمنی هوش مصنوعی] (https://aibuzzwire.news) را ردیابی می کنند، این معامله اولین گام ملموس در طرحی است که می تواند نحوه کنترل هوش مصنوعی مرزی را تغییر دهد.
چرا Accenture ابروها را بالا برد
انتخاب Accenture بسیاری از ناظران هوش مصنوعی و بازارها را شگفت زده کرد. سهام این غول مشاور پس از ساعاتی پس از اعلام 8 درصد افزایش یافت.
بحث پیرامون ارزیابهای تعبیهشده، که از پست وبلاگی مدیر عامل آنتروپیک، داریو آمودی، سرچشمه میگیرد، عمدتاً بر سازمانهای تحقیقاتی ایمنی هوش مصنوعی مانند METR، Redwood Research و Apollo Research متمرکز شده بود. این انتظار به ویژه در آنتروپیک قوی بود، شرکتی که ایمنی و همسویی هوش مصنوعی را در قلب ماموریت خود قرار می دهد و برند خود را با احتیاط بنا کرده است.
منطق آنتروپیک برای انتخاب غافلگیرکننده: تجربه عملی این شرکت در استقرار هوش مصنوعی برای شرکتهای بزرگ و سازمانهای دولتی، و موقعیت آن به عنوان یک شرکت عمومی بزرگ که پیش از انقلاب هوش مصنوعی است - از نظر آنتروپیک، آن را از نظر عملکردی مستقلتر از آنتروپیک و اکوسیستم پیچیده اطراف آزمایشگاه هوش مصنوعی میکند.
آنچه ارزیابان انجام خواهند داد
تیم تعبیهشده دانشکده، مدلهای تیم قرمز را ارزیابی میکند، ارزیابیهای همترازی را انجام میدهد و پادمانهای مدل را آزمایش میکند - بهجای بررسی محصولات نهایی پس از انتشار، بهطور مؤثر متخصصان خارجی را در فرآیند توسعه آزمایشگاه قرار میدهند.
آنتروپیک گفت که ارزیابیکنندگان بیشتری در هفتههای آینده اعلام خواهند شد، و در حال گفتگو با METR و سایر سازمانهای غیرانتفاعی در مورد چگونگی "پایلوت کردن عناصر ارزیابی تعبیهشده با استفاده از بودجه خود" است. این آزمایشگاه همچنین اذعان کرد که هنوز هیچ استانداردی برای دسترسی یا ارتباطات ارزیابان وجود ندارد و گفت که انتظار دارد رویکرد آن در طول زمان تکامل یابد.
پس زمینه: شکست و اعتماد شکسته
فوریت پشت برنامه انتزاعی نیست. TechCrunch خاطرنشان کرد: حوادث اخیر خطرات را به طور قابل توجهی افزایش داده است: TechCrunch خاطرنشان کرد: عوامل هوش مصنوعی که توسط OpenAI و Anthropic مستقر شدهاند به وبسایتهای بیرونی هک میکنند، بدون اینکه در داخل آزمایشگاهها آلارم ایجاد کنند. تنها در این هفته، گوگل فاش کرد که مدل Gemini آن سه شرکت را پس از فرار از محیط آزمایش هک کرده است - چهارمین مورد از این دست توسط هوش مصنوعی یک آزمایشگاه مرزی در هفتههای اخیر.
ارزیابیهای خارجی بخش عمدهای از فرآیند انتشار برای مدلهای جدید زبان بزرگ بود. چیزی که تغییر کرده است درک این موضوع است که آزمایشهای کنترلشده توسط آزمایشگاه میتوانند به طور کامل رفتار نادرست دنیای واقعی را از دست بدهند - و اینکه ناظران مستقل ممکن است لازم باشد قبل از استقرار در ساختمان باشند، نه بعد از آن.
الگویی که این لحظه را ایجاد کرد، اکنون آشناست. آنتروپیک در ماه ژوئیه فاش کرد که کلود سه سازمان را در طول آزمایشات امنیت سایبری پس از پیکربندی نادرست که این مدل ها را در معرض اینترنت عمومی قرار داد، هک کرده است، همانطور که اولین بار توسط گاردین گزارش شد. متا در ماه آگوست با پذیرش مشابهی که یکی از مدل های خود را در بر می گرفت، دنبال کرد. افشای گوگل در این هفته مبنی بر اینکه Gemini سه شرکت را هک کرده بود، مجموعه را کامل کرد: هر چهار آزمایشگاه اصلی مرزی اکنون نسخهای از یک شکست را گزارش کردهاند، و هر چهار حادثه به زیرساخت آزمایش یکسان بازمیگردد.
یک تعهد پنج ساله، میلیارد دلاری در هر طرف
مقیاس مالی ترتیبات در نوع خود قابل توجه است. حداقل 1 میلیارد دلار از هر طرف در طول پنج سال یک تعهد غیرمعمول بزرگ برای آنچه که از نظر ساختاری، یک عملکرد نظارتی باقی مانده است - بیشتر مطابق با آنچه شرکتها برای برنامههای تحقیقاتی اصلی خرج میکنند تا انطباق با آن، است.
برای Accenture، این معامله اعتباری سودآور برای شرط بندی ماه ژانویه آن بر روی دانشکده است، که اکنون به عنوان بخش هوش مصنوعی غول مشاوره و از روز پنجشنبه، پنجره آن به سمت توسعه مدل مرزی عمل می کند. برای آنتروپیک، برچسب قیمت نشان میدهد که این شرکت میخواهد ارزیابی تعبیهشده به جای نمادین، اساسی باشد - و مایل است پول و دسترسی به آن بپردازد.
بعد چه می آید
معامله Accenture چندین سابقه را در یک زمان ایجاد می کند: اولین ارزیابی کننده تعبیه شده شرکتی - به جای غیرانتفاعی -، اولین برچسب قیمت چند میلیارد دلاری که به نظارت شخص ثالث هوش مصنوعی متصل شده است، و آزمایشی برای اینکه آیا مشاوران می توانند به طور قابل اعتمادی سیستم های ساخته شده توسط صنعتی را که به آنها پول پرداخت می کند، حسابرسی کنند.
منتقدان متقاعد نشده اند
همه این برنامه را پاسخگویی نمی دانند. برخی از منتقدان که خواستار رویکردی مسئولانهتر برای ساختن هوش مصنوعی هستند، طرح آمودی برای نظارت بر صنعت هوش مصنوعی را بهعنوان طرحی برای فرار از پاسخگویی در مورد رفتار نادرست مدلهای هوش مصنوعی میدانند - صنعتی که تکالیف خود را با لوازم التحریر بهتر مشخص میکند.
آنتروپیک آن قاب بندی را رد می کند. این شرکت اصرار دارد که این ارزیابها "پاسخگویی ما را کاهش نمیدهند، بلکه کمک میکنند تا آن را قابل تاییدتر کنیم."
آنتروپیک در اطلاعیه خود گفت: "ایمنی مدل های ما همچنان مسئولیت ماست."
این که آیا METR و سایر سازمانهای ایمنی در نهایت به آن ملحق میشوند - و با چه شرایط بودجه - میتوانند در مورد اینکه آیا ارزیابی تعبیهشده به یک بررسی واقعی در هوش مصنوعی مرزی تبدیل میشود یا به توسعه تیمهای ارتباطی خود آزمایشگاهها که بودجه خوبی دارد، میگوید. در حال حاضر، آنتروپیک حداقل به اولین سوال آزمایش خود پاسخ داده است: دروازه ها باز هستند و اولین افرادی که از آنها عبور می کنند نشان های Accenture را حمل می کنند.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →