Google DeepMind مؤسسه جدیدی را راهاندازی کرده است که به گسترش گفتوگو درباره هوش عمومی مصنوعی اختصاص دارد – و مقالات افتتاحیه آن شامل پیشنهادی ملموس از Demis Hassabis برای سازمانی تحت رهبری ایالات متحده است که مدلهای هوش مصنوعی مرزی را قبل از استقرار ارزیابی میکند.
به گزارش TechCrunch، مؤسسه DeepMind که روز چهارشنبه توسط Google و Google DeepMind راه اندازی شد، شین لگ، یکی از بنیانگذاران DeepMind را به عنوان سردبیر خود، در کنار جیمز مانیکا، مدیر اجرایی Google و Demis Hassabis، رئیس Google DeepMind به عنوان مدیران فهرست می کند. For more context on this story, see our ongoing breaking AI news.
اتاقی برای مخالفت
هدف اعلام شده این موسسه نشان دادن اختلافات واقعی است - از جمله در خود گوگل. در این اطلاعیه آمده است: «آنها همیشه موافقت نخواهند کرد و احتمالاً نظر خود را تغییر خواهند داد، زیرا داده ها و اطلاعات بیشتری در مرزهای به سرعت در حال حرکت آشکار می شود.
مجموعه اول آن شامل چهار مقاله است که سیاستهای اقتصادی برای مدیریت اختلال AGI بالقوه، حفظ استدلال مدل قابل خواندن برای انسان، اصول شکوفایی انسان، و چارچوبی برای ارزیابی مدلهای هوش مصنوعی مرزی را پوشش میدهد.
نهادینه کردن اختلاف نظر آشکار یک حرکت غیرمعمول برای یک آزمایشگاه هوش مصنوعی شرکتی است که در آن پیامهای عمومی به شدت کنترل میشوند. با طراحی، این موسسه به محققان گوگل مکانی می دهد تا در مورد مواضعی بحث کنند که ممکن است با منافع تجاری شرکت - یا با یکدیگر در تضاد باشد.
مقاله شفافیت: "عمق سریال مات" را تماشا کنید
یکی از چهار مقاله، توسط محققان ایمنی DeepMind، روهین شاه و آنکا دراگان، استدلال میکند که کوچک شدن پنجره شفافیت هوش مصنوعی - توانایی دیدن و بررسی استدلال گام به گام مدل - اجتنابناپذیر نیست، حتی اگر معماریهای جدید نظارت بر قویترین مدلها را سختتر کنند.
نویسندگان می گویند که توسعه دهندگان و تنظیم کننده ها باید به طور مستقیم با مبادلات ایمنی مقابله کنند. به طور مشخص، این میتواند به معنای محدود کردن چیزی باشد که آنها آن را «عمق سریال مات» مینامند - میزان محاسبات متوالی که یک مدل میتواند بدون تولید یک ردپای استدلالی قابل خواندن انجام دهد - یا نیاز به توسعهدهندگان برای نشان دادن اینکه سیستمهای کمتر شفاف به اندازه سیستمهای قابل تفسیر قابل نظارت هستند.
این پیشنهاد قابل توجه است زیرا از دست دادن قابلیت تفسیر را به عنوان یک طرح و انتخاب خط مشی به جای یک پیامد اجتناب ناپذیر مقیاس تلقی می کند و دری را به روی الزاماتی باز می کند که می توانند در مقررات نوشته شوند.
پیشنهاد Hassabis: یک نهاد استاندارد مرزی ایالات متحده
مهم ترین مقاله ممکن است مقاله حسابیس باشد. او یک سازمان استانداردهای هوش مصنوعی به رهبری ایالات متحده را پیشنهاد می کند که وظیفه ارزیابی پیشرفته ترین مدل های هوش مصنوعی را دارد. بر اساس این چارچوب، توسعهدهندگان در ابتدا مدلها را تا 30 روز قبل از انتشار بهطور داوطلبانه برای بررسی ارسال میکنند. هنگامی که سیستم ارزیابی موثر ثابت شد، گذراندن آزمونهای آن میتواند به یک الزام برای استقرار مدلهای مرزی در ایالات متحده تبدیل شود.
این بدنه با طراحی ارزیابیها با مشورت شرکتهای هوش مصنوعی شروع میکند، اما در نهایت ارزیابیهای مستقل و فاش نشده - آنچه در این مقاله آزمایشهای "برگزارشده" نامیده میشود - ایجاد میکند تا از تطبیق مدلهای آزمایشگاهها با معیارهای شناختهشده جلوگیری کند، یک حالت شکست کاملاً مستند در رژیمهای ارزیابی عمومی.
Hassabis همچنین درها را برای تشدید باز گذاشت: این چارچوب می تواند "در صورت لزوم جدیت وضعیت" افزایش یابد، که به طور بالقوه شامل کاهش سرعت هماهنگ در میان توسعه دهندگان هوش مصنوعی مرزی می شود.
چرا دو مقاله دیگر مهم هستند
دو مقاله باقیمانده - در مورد سیاستهای اقتصادی برای مدیریت اختلال AGI و اصول شکوفایی انسان - مجموعهای را تکمیل میکنند که AGI را بهعنوان یک مشکل در سطح جامعه بهجای یک مشکل کاملاً فنی در نظر میگیرد. جابجایی اقتصادی برای مدت طولانی ملموس ترین نگرانی عمومی در مورد هوش مصنوعی پیشرفته بوده است، و چارچوب بندی آن در کنار سیاست ارزیابی و قابلیت تفسیر نشان می دهد که موسسه از سیاست گذاران می خواهد که این قطعات را به عنوان یک دستور کار به جای بحث های جداگانه ببینند.
این وسعت همچنین سیگنالی در مورد موقعیت گوگل است. این شرکت در حال رقابت برای مشتریان سازمانی و قراردادهای دولتی است در حالی که به طور همزمان استدلال می کند که سیستم های مرزی نیاز به نظارت خارجی دارند. انتشار تنش، به جای هموار کردن آن، فرض اصلی موسسه است.
از نگرانی تا پیشنهادات ملموس
این مقالات زمانی به دست میآیند که بحث ایمنی صنعت از بیانیههای نگرانی گسترده به سمت مکانیسمهای خاص تغییر میکند: الزامات افشا، بررسیهای بیرونی، و - اگر پادمانها عقب افتادند - کاهش سرعت هماهنگ. این تغییر در این هفته تسریع شد، زیرا رهبران صنعت عناصر درخواست داریو آمودی، مدیرعامل Anthropic را برای "سرعت" توسعه هوش مصنوعی مرزی، در TechCrunch تایید کردند.
زمان مهم است دولتها در هر دو سوی اقیانوس اطلس در حال بررسی نحوه نظارت بر سیستمهایی هستند که قابلیتهایشان سریعتر از زیرساختهای ارزیابی پیشرفت میکند. پیشنهادی که از یک آزمایشگاه پیشرو هوش مصنوعی سرچشمه میگیرد - و شامل بررسی قبل از انتشار با دندان است - به سیاستگذاران الگویی میدهد که خود صنعت به طور اسمی آن را تأیید کرده است، که از لحاظ تاریخی پیش نیازی برای مقررات معنادار هوش مصنوعی بوده است.
چه چیزی را تماشا کنیم
استقلال تحریریه این موسسه از گوگل اولین آزمون خواهد بود. اگر مقالات همچنان شامل مواضعی باشد که بر خلاف نقشه راه تجاری گوگل است - همانطور که مقاله شفافیت مسلماً انجام می دهد - محل برگزاری می تواند به یک مشارکت جدی در بحث خط مشی AGI تبدیل شود. اگر به سمت پیامرسانی شرکتی سوق پیدا کند، یک کانال روابط عمومی دیگر در یک میدان شلوغ خواهد بود.
در هر صورت، این ماده اکنون روی میز است: الزامات ارزیابی پیش از انتشار، آزمایشهای طولانی مدت، و حتی کاهش هماهنگ شده توسط یکی از قدرتمندترین چهرههای هوش مصنوعی بهطور علنی مورد بحث قرار میگیرند. سؤال دیگر این نیست که آیا مدلهای مرزی باید به طور مستقل ارزیابی شوند، بلکه این است که چه کسی ارزیابی را انجام میدهد - و بر اساس چه جدول زمانی.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →