Google DeepMind مؤسسه جدیدی را راه‌اندازی کرده است که به گسترش گفت‌وگو درباره هوش عمومی مصنوعی اختصاص دارد – و مقالات افتتاحیه آن شامل پیشنهادی ملموس از Demis Hassabis برای سازمانی تحت رهبری ایالات متحده است که مدل‌های هوش مصنوعی مرزی را قبل از استقرار ارزیابی می‌کند.

به گزارش TechCrunch، مؤسسه DeepMind که روز چهارشنبه توسط Google و Google DeepMind راه اندازی شد، شین لگ، یکی از بنیانگذاران DeepMind را به عنوان سردبیر خود، در کنار جیمز مانیکا، مدیر اجرایی Google و Demis Hassabis، رئیس Google DeepMind به عنوان مدیران فهرست می کند. For more context on this story, see our ongoing breaking AI news.

اتاقی برای مخالفت

هدف اعلام شده این موسسه نشان دادن اختلافات واقعی است - از جمله در خود گوگل. در این اطلاعیه آمده است: «آنها همیشه موافقت نخواهند کرد و احتمالاً نظر خود را تغییر خواهند داد، زیرا داده ها و اطلاعات بیشتری در مرزهای به سرعت در حال حرکت آشکار می شود.

مجموعه اول آن شامل چهار مقاله است که سیاست‌های اقتصادی برای مدیریت اختلال AGI بالقوه، حفظ استدلال مدل قابل خواندن برای انسان، اصول شکوفایی انسان، و چارچوبی برای ارزیابی مدل‌های هوش مصنوعی مرزی را پوشش می‌دهد.

نهادینه کردن اختلاف نظر آشکار یک حرکت غیرمعمول برای یک آزمایشگاه هوش مصنوعی شرکتی است که در آن پیام‌های عمومی به شدت کنترل می‌شوند. با طراحی، این موسسه به محققان گوگل مکانی می دهد تا در مورد مواضعی بحث کنند که ممکن است با منافع تجاری شرکت - یا با یکدیگر در تضاد باشد.

مقاله شفافیت: "عمق سریال مات" را تماشا کنید

یکی از چهار مقاله، توسط محققان ایمنی DeepMind، روهین شاه و آنکا دراگان، استدلال می‌کند که کوچک شدن پنجره شفافیت هوش مصنوعی - توانایی دیدن و بررسی استدلال گام به گام مدل - اجتناب‌ناپذیر نیست، حتی اگر معماری‌های جدید نظارت بر قوی‌ترین مدل‌ها را سخت‌تر کنند.

نویسندگان می گویند که توسعه دهندگان و تنظیم کننده ها باید به طور مستقیم با مبادلات ایمنی مقابله کنند. به طور مشخص، این می‌تواند به معنای محدود کردن چیزی باشد که آن‌ها آن را «عمق سریال مات» می‌نامند - میزان محاسبات متوالی که یک مدل می‌تواند بدون تولید یک ردپای استدلالی قابل خواندن انجام دهد - یا نیاز به توسعه‌دهندگان برای نشان دادن اینکه سیستم‌های کمتر شفاف به اندازه سیستم‌های قابل تفسیر قابل نظارت هستند.

این پیشنهاد قابل توجه است زیرا از دست دادن قابلیت تفسیر را به عنوان یک طرح و انتخاب خط مشی به جای یک پیامد اجتناب ناپذیر مقیاس تلقی می کند و دری را به روی الزاماتی باز می کند که می توانند در مقررات نوشته شوند.

پیشنهاد Hassabis: یک نهاد استاندارد مرزی ایالات متحده

مهم ترین مقاله ممکن است مقاله حسابیس باشد. او یک سازمان استانداردهای هوش مصنوعی به رهبری ایالات متحده را پیشنهاد می کند که وظیفه ارزیابی پیشرفته ترین مدل های هوش مصنوعی را دارد. بر اساس این چارچوب، توسعه‌دهندگان در ابتدا مدل‌ها را تا 30 روز قبل از انتشار به‌طور داوطلبانه برای بررسی ارسال می‌کنند. هنگامی که سیستم ارزیابی موثر ثابت شد، گذراندن آزمون‌های آن می‌تواند به یک الزام برای استقرار مدل‌های مرزی در ایالات متحده تبدیل شود.

این بدنه با طراحی ارزیابی‌ها با مشورت شرکت‌های هوش مصنوعی شروع می‌کند، اما در نهایت ارزیابی‌های مستقل و فاش نشده - آنچه در این مقاله آزمایش‌های "برگزارشده" نامیده می‌شود - ایجاد می‌کند تا از تطبیق مدل‌های آزمایشگاه‌ها با معیارهای شناخته‌شده جلوگیری کند، یک حالت شکست کاملاً مستند در رژیم‌های ارزیابی عمومی.

Hassabis همچنین درها را برای تشدید باز گذاشت: این چارچوب می تواند "در صورت لزوم جدیت وضعیت" افزایش یابد، که به طور بالقوه شامل کاهش سرعت هماهنگ در میان توسعه دهندگان هوش مصنوعی مرزی می شود.

چرا دو مقاله دیگر مهم هستند

دو مقاله باقی‌مانده - در مورد سیاست‌های اقتصادی برای مدیریت اختلال AGI و اصول شکوفایی انسان - مجموعه‌ای را تکمیل می‌کنند که AGI را به‌عنوان یک مشکل در سطح جامعه به‌جای یک مشکل کاملاً فنی در نظر می‌گیرد. جابجایی اقتصادی برای مدت طولانی ملموس ترین نگرانی عمومی در مورد هوش مصنوعی پیشرفته بوده است، و چارچوب بندی آن در کنار سیاست ارزیابی و قابلیت تفسیر نشان می دهد که موسسه از سیاست گذاران می خواهد که این قطعات را به عنوان یک دستور کار به جای بحث های جداگانه ببینند.

این وسعت همچنین سیگنالی در مورد موقعیت گوگل است. این شرکت در حال رقابت برای مشتریان سازمانی و قراردادهای دولتی است در حالی که به طور همزمان استدلال می کند که سیستم های مرزی نیاز به نظارت خارجی دارند. انتشار تنش، به جای هموار کردن آن، فرض اصلی موسسه است.

از نگرانی تا پیشنهادات ملموس

این مقالات زمانی به دست می‌آیند که بحث ایمنی صنعت از بیانیه‌های نگرانی گسترده به سمت مکانیسم‌های خاص تغییر می‌کند: الزامات افشا، بررسی‌های بیرونی، و - اگر پادمان‌ها عقب افتادند - کاهش سرعت هماهنگ. این تغییر در این هفته تسریع شد، زیرا رهبران صنعت عناصر درخواست داریو آمودی، مدیرعامل Anthropic را برای "سرعت" توسعه هوش مصنوعی مرزی، در TechCrunch تایید کردند.

زمان مهم است دولت‌ها در هر دو سوی اقیانوس اطلس در حال بررسی نحوه نظارت بر سیستم‌هایی هستند که قابلیت‌هایشان سریع‌تر از زیرساخت‌های ارزیابی پیشرفت می‌کند. پیشنهادی که از یک آزمایشگاه پیشرو هوش مصنوعی سرچشمه می‌گیرد - و شامل بررسی قبل از انتشار با دندان است - به سیاست‌گذاران الگویی می‌دهد که خود صنعت به طور اسمی آن را تأیید کرده است، که از لحاظ تاریخی پیش نیازی برای مقررات معنادار هوش مصنوعی بوده است.

چه چیزی را تماشا کنیم

استقلال تحریریه این موسسه از گوگل اولین آزمون خواهد بود. اگر مقالات همچنان شامل مواضعی باشد که بر خلاف نقشه راه تجاری گوگل است - همانطور که مقاله شفافیت مسلماً انجام می دهد - محل برگزاری می تواند به یک مشارکت جدی در بحث خط مشی AGI تبدیل شود. اگر به سمت پیام‌رسانی شرکتی سوق پیدا کند، یک کانال روابط عمومی دیگر در یک میدان شلوغ خواهد بود.

در هر صورت، این ماده اکنون روی میز است: الزامات ارزیابی پیش از انتشار، آزمایش‌های طولانی مدت، و حتی کاهش هماهنگ شده توسط یکی از قدرتمندترین چهره‌های هوش مصنوعی به‌طور علنی مورد بحث قرار می‌گیرند. سؤال دیگر این نیست که آیا مدل‌های مرزی باید به طور مستقل ارزیابی شوند، بلکه این است که چه کسی ارزیابی را انجام می‌دهد - و بر اساس چه جدول زمانی.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →