ریاضیدان دوم علناً OpenAI را به رفتار غیراخلاقی و "غیرصادقانه" در مورد داده های پشت موفقیت های مشهور ریاضیات متهم کرد و گفت که این شرکت نتوانسته ثابت کند که تعاملات خصوصی او با ChatGPT به نتایجی که ماه گذشته با هیاهو زیاد اعلام شد کمک نکرده است.
در یک سری پست در Mastodon که توسط The Verge در روز چهارشنبه گزارش شد، ریاضیدان Andreas Thom این نگرانی را مطرح کرد که مکالمات او و همکارانش با ChatGPT قبل از اعلام OpenAI ممکن است باعث موفقیت این مدل شده باشد. مداخله او تنها چند روز پس از آن صورت گرفت که پروفسور ریاضیات دانشگاه نیویورک Tristan Buckmaster علناً این سوال را مطرح کرد که آیا مدل های OpenAI از استفاده خودش از ابزار Codex شرکت سود برده اند یا خیر - و تبدیل لحظه ای از پیروزی برای آزمایشگاه به یک مناقشه جاری بر سر منشأ داده های آموزشی. For more context on this story, see our ongoing artificial intelligence updates.
از پیشرفت تا واکنش
در ماه آگوست، OpenAI اعلام کرد که سیستمش ده نتیجه قابل توجه در ریاضیات و علوم کامپیوتر نظری ایجاد کرده است که هر کدام با اثبات ناب تایید شده توسط ماشین بررسی شده اند - نقطه عطفی که این سایت در آن زمان به آن پرداخته بود، در کنار راه حل ادعایی شرکت برای مسئله جایزه هزاره. یکی از ده نتیجه وجود به اصطلاح گروههای غیرصوفی را اثبات کرد، که یک سوال طولانی در نظریه گروه است.
این نتیجه در مرکز بحث های جدید قرار دارد. طبق گزارش The Verge، OpenAI اذعان کرد که این اثبات به شدت بر اساس کارهای قبلی تام و همکار ریاضیدان Gábor Kun است - و پس از انتقاد محافل ریاضی به دلیل عدم پذیرش اولیه مشارکتهای اخیر آنها، این شرکت بیصدا نوشتههای خود را اصلاح کرد.
برای تام، این قدردانی یک سوال ناراحت کننده را ایجاد کرد: چگونه این مدل توانست تکنیک های خود و کان را با این جزئیات فرمان دهد؟
سوالی که تام می گوید بی پاسخ ماند
تام گفت که تحت تأثیر «تسلط دقیق OpenAI به تکنیکهای ما» قرار گرفته است، که به گفته او نه واضحترین و نه امیدوارکنندهترین مسیر برای رسیدن به راهحل در آن زمان بود. او به محققان OpenAI Sébastien Bubeck و Mark Sellke - دومی همچنین آماردان در هاروارد - ایمیل هایی نوشت و پرسید که آیا تعاملات او با ChatGPT "بخشی از داده های آموزشی بوده یا برای فرآیند استدلال قابل دسترسی است" و بنابراین می تواند در نتیجه نقش داشته باشد.
پاسخی که او دریافت کرد تنها به این موضوع میپردازد که آیا میتوان به مکالمههایش مستقیماً دسترسی پیدا کرد، نه اینکه آیا این مکالمات به مجموعهای از دادههای مورد استفاده برای آموزش و بهبود مدلهای شرکت وارد شده است. تام نوشت: «هیچ صلاحیت، توضیح یا مدرکی ارائه نشد. من این را حداقل به عنوان یک بی صداقتی می دانم.
در ادامه به نقل از The Verge، او این اتهام را تشدید کرد: "پاسخ قاطع سلکه، حداقل، غیر قابل توجیه گسترده و از نظر مادی گمراه کننده بود؛ نگاه کردن به گذشته آشکارا ناصادقانه بود."
بحث تام کمتر در مورد کاری است که OpenAI انجام داد تا اینکه چه کسی بار اثبات را به دوش میکشد. او گفت که محققان برای مهندسی معکوس خط لوله آموزشی شرکت مجهز نیستند. او نوشت: «فقط OpenAI دادههای مربوط به آن را دارد.» بنابراین اگر این شرکت میخواهد که دادههای کاربر در نتایج آن نقش داشته است را انکار کند، مسئولیت آن بر عهده OpenAI است که با افشای مجموعههای داده مربوطه و روشن کردن نحوه استفاده از تعاملات مشتری، آن را ثابت کند.
انکارهای دقیق OpenAI
به گزارش The Verge، این اختلاف بازتاب مدیریت شرکت در موفقیت ادعایی Navier-Stokes است، کاری که Buckmaster با Levent Alpöge، محقق Anthropic در مقام شخصی دنبال می کرد. در پست وبلاگی که این نتیجه را اعلام کرد، OpenAI اظهار داشت: "ما (محققان و عوامل) هیچ یک از کارهای آنها را تا زمانی که آن را به صورت عمومی منتشر نکردند به هیچ وجه ندیدیم - به ویژه، هیچ داده کاربر خاصی برای حل این مشکل در دسترس نبود."
اما همان پست یک کانال غیرمستقیم را پذیرفت: «در حالی که بعید است، نمیتوانیم رد کنیم که دادههای شناسایی نشده ناشی از استفاده آنها از محصولات ما به بهبود مدلهای ما کمک کرده است».
برای تام، این تمایز کل مشکل است. او نوشت: «هویت زدایی ممکن است یک نام را حذف کند؛ محتوای فکری یک ایده ریاضی را حذف نمی کند. OpenAI بلافاصله به درخواست The Verge برای اظهار نظر پاسخ نداد.
او افزود که اگر تحقیقات غیرعمومی ارائه شده توسط کاربران به بهبود مدل هایی کمک کند که شرکت پس از آن برای رقابت همان کاربران برای انتشار - بدون رضایت، افشای مناسب یا اعتبار - از آنها استفاده کند، «از نظر اخلاقی غیرقابل دفاع خواهد بود».
سردی بیش از ریاضیات
شرایط برگزاری جایزه هزاره کمک چندانی به آرامش اعصاب نکرده است. OpenAI گفته است که این مشکل را پس از شنیدن شایعات آنلاین مبنی بر اینکه محققان دیگر پیشرفتهای بزرگی داشتهاند، دنبال کرده است - بهطور مؤثری دانشگاهیان را برای رسیدن به نتیجهای که سالها وقت صرف کردهاند، مسابقه دادهاند.
بسیاری از محققان به The Verge گفتند که اگر ریاضیدانان به این باور برسند که حتی شایعات یک پیشرفت قریبالوقوع میتواند رقابتی را علیه یک غول فناوری با منابع خوب مشتاق برای شکوه شعلهور کند، نگران هستند که چنین رفتاری ریاضیات را به حالت مخفیتری سوق دهد. پوشش مرتبط The Verge - "پیشرفت حیله گر ریاضی OpenAI باعث ایجاد آرامش در دانشگاه می شود" - حال و هوای این حوزه را به تصویر کشید.
این اپیزود در لحظه حساسی برای شرکتهای هوش مصنوعی و جوامع تحقیقاتی که به طور فزایندهای با آنها مقابله میکنند، میگذرد. شایستگی هر نتیجه فردی هر چه باشد، عدم تقارن توصیف شده توسط تام ساختاری است: آزمایشگاه ها می توانند تعاملات کاربر را در مقیاس دریافت کنند، در حالی که افرادی که آن داده ها را تولید می کنند راهی برای بررسی آنچه که گرفته شده است ندارند. تا زمانی که شرکتها خطوط لوله آموزشی خود را برای بررسی دقیق باز نکنند یا دیوارهای آتش سخت و قابل تأیید را بین مکالمات مشتری و آموزش مدل اعمال کنند، هر عبارت «ما از دادههای شما استفاده نکردیم» یک ستاره ضمنی خواهد داشت – و هر پیشرفتی با ریاضیدانان و محققان در زمینههای دیگر به دنبال اثبات اثبات خواهد شد.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →