ریاضیدان دوم علناً OpenAI را به رفتار غیراخلاقی و "غیرصادقانه" در مورد داده های پشت موفقیت های مشهور ریاضیات متهم کرد و گفت که این شرکت نتوانسته ثابت کند که تعاملات خصوصی او با ChatGPT به نتایجی که ماه گذشته با هیاهو زیاد اعلام شد کمک نکرده است.

در یک سری پست در Mastodon که توسط The Verge در روز چهارشنبه گزارش شد، ریاضیدان Andreas Thom این نگرانی را مطرح کرد که مکالمات او و همکارانش با ChatGPT قبل از اعلام OpenAI ممکن است باعث موفقیت این مدل شده باشد. مداخله او تنها چند روز پس از آن صورت گرفت که پروفسور ریاضیات دانشگاه نیویورک Tristan Buckmaster علناً این سوال را مطرح کرد که آیا مدل های OpenAI از استفاده خودش از ابزار Codex شرکت سود برده اند یا خیر - و تبدیل لحظه ای از پیروزی برای آزمایشگاه به یک مناقشه جاری بر سر منشأ داده های آموزشی. For more context on this story, see our ongoing artificial intelligence updates.

از پیشرفت تا واکنش

در ماه آگوست، OpenAI اعلام کرد که سیستمش ده نتیجه قابل توجه در ریاضیات و علوم کامپیوتر نظری ایجاد کرده است که هر کدام با اثبات ناب تایید شده توسط ماشین بررسی شده اند - نقطه عطفی که این سایت در آن زمان به آن پرداخته بود، در کنار راه حل ادعایی شرکت برای مسئله جایزه هزاره. یکی از ده نتیجه وجود به اصطلاح گروه‌های غیرصوفی را اثبات کرد، که یک سوال طولانی در نظریه گروه است.

این نتیجه در مرکز بحث های جدید قرار دارد. طبق گزارش The Verge، OpenAI اذعان کرد که این اثبات به شدت بر اساس کارهای قبلی تام و همکار ریاضی‌دان Gábor Kun است - و پس از انتقاد محافل ریاضی به دلیل عدم پذیرش اولیه مشارکت‌های اخیر آنها، این شرکت بی‌صدا نوشته‌های خود را اصلاح کرد.

برای تام، این قدردانی یک سوال ناراحت کننده را ایجاد کرد: چگونه این مدل توانست تکنیک های خود و کان را با این جزئیات فرمان دهد؟

سوالی که تام می گوید بی پاسخ ماند

تام گفت که تحت تأثیر «تسلط دقیق OpenAI به تکنیک‌های ما» قرار گرفته است، که به گفته او نه واضح‌ترین و نه امیدوارکننده‌ترین مسیر برای رسیدن به راه‌حل در آن زمان بود. او به محققان OpenAI Sébastien Bubeck و Mark Sellke - دومی همچنین آماردان در هاروارد - ایمیل هایی نوشت و پرسید که آیا تعاملات او با ChatGPT "بخشی از داده های آموزشی بوده یا برای فرآیند استدلال قابل دسترسی است" و بنابراین می تواند در نتیجه نقش داشته باشد.

پاسخی که او دریافت کرد تنها به این موضوع می‌پردازد که آیا می‌توان به مکالمه‌هایش مستقیماً دسترسی پیدا کرد، نه اینکه آیا این مکالمات به مجموعه‌ای از داده‌های مورد استفاده برای آموزش و بهبود مدل‌های شرکت وارد شده است. تام نوشت: «هیچ صلاحیت، توضیح یا مدرکی ارائه نشد. من این را حداقل به عنوان یک بی صداقتی می دانم.

در ادامه به نقل از The Verge، او این اتهام را تشدید کرد: "پاسخ قاطع سلکه، حداقل، غیر قابل توجیه گسترده و از نظر مادی گمراه کننده بود؛ نگاه کردن به گذشته آشکارا ناصادقانه بود."

بحث تام کمتر در مورد کاری است که OpenAI انجام داد تا اینکه چه کسی بار اثبات را به دوش می‌کشد. او گفت که محققان برای مهندسی معکوس خط لوله آموزشی شرکت مجهز نیستند. او نوشت: «فقط OpenAI داده‌های مربوط به آن را دارد.» بنابراین اگر این شرکت می‌خواهد که داده‌های کاربر در نتایج آن نقش داشته است را انکار کند، مسئولیت آن بر عهده OpenAI است که با افشای مجموعه‌های داده مربوطه و روشن کردن نحوه استفاده از تعاملات مشتری، آن را ثابت کند.

انکارهای دقیق OpenAI

به گزارش The Verge، این اختلاف بازتاب مدیریت شرکت در موفقیت ادعایی Navier-Stokes است، کاری که Buckmaster با Levent Alpöge، محقق Anthropic در مقام شخصی دنبال می کرد. در پست وبلاگی که این نتیجه را اعلام کرد، OpenAI اظهار داشت: "ما (محققان و عوامل) هیچ یک از کارهای آنها را تا زمانی که آن را به صورت عمومی منتشر نکردند به هیچ وجه ندیدیم - به ویژه، هیچ داده کاربر خاصی برای حل این مشکل در دسترس نبود."

اما همان پست یک کانال غیرمستقیم را پذیرفت: «در حالی که بعید است، نمی‌توانیم رد کنیم که داده‌های شناسایی نشده ناشی از استفاده آن‌ها از محصولات ما به بهبود مدل‌های ما کمک کرده است».

برای تام، این تمایز کل مشکل است. او نوشت: «هویت زدایی ممکن است یک نام را حذف کند؛ محتوای فکری یک ایده ریاضی را حذف نمی کند. OpenAI بلافاصله به درخواست The Verge برای اظهار نظر پاسخ نداد.

او افزود که اگر تحقیقات غیرعمومی ارائه شده توسط کاربران به بهبود مدل هایی کمک کند که شرکت پس از آن برای رقابت همان کاربران برای انتشار - بدون رضایت، افشای مناسب یا اعتبار - از آنها استفاده کند، «از نظر اخلاقی غیرقابل دفاع خواهد بود».

سردی بیش از ریاضیات

شرایط برگزاری جایزه هزاره کمک چندانی به آرامش اعصاب نکرده است. OpenAI گفته است که این مشکل را پس از شنیدن شایعات آنلاین مبنی بر اینکه محققان دیگر پیشرفت‌های بزرگی داشته‌اند، دنبال کرده است - به‌طور مؤثری دانشگاهیان را برای رسیدن به نتیجه‌ای که سال‌ها وقت صرف کرده‌اند، مسابقه داده‌اند.

بسیاری از محققان به The Verge گفتند که اگر ریاضیدانان به این باور برسند که حتی شایعات یک پیشرفت قریب‌الوقوع می‌تواند رقابتی را علیه یک غول فناوری با منابع خوب مشتاق برای شکوه شعله‌ور کند، نگران هستند که چنین رفتاری ریاضیات را به حالت مخفی‌تری سوق دهد. پوشش مرتبط The Verge - "پیشرفت حیله گر ریاضی OpenAI باعث ایجاد آرامش در دانشگاه می شود" - حال و هوای این حوزه را به تصویر کشید.

این اپیزود در لحظه حساسی برای شرکت‌های هوش مصنوعی و جوامع تحقیقاتی که به طور فزاینده‌ای با آنها مقابله می‌کنند، می‌گذرد. شایستگی هر نتیجه فردی هر چه باشد، عدم تقارن توصیف شده توسط تام ساختاری است: آزمایشگاه ها می توانند تعاملات کاربر را در مقیاس دریافت کنند، در حالی که افرادی که آن داده ها را تولید می کنند راهی برای بررسی آنچه که گرفته شده است ندارند. تا زمانی که شرکت‌ها خطوط لوله آموزشی خود را برای بررسی دقیق باز نکنند یا دیوارهای آتش سخت و قابل تأیید را بین مکالمات مشتری و آموزش مدل اعمال کنند، هر عبارت «ما از داده‌های شما استفاده نکردیم» یک ستاره ضمنی خواهد داشت – و هر پیشرفتی با ریاضیدانان و محققان در زمینه‌های دیگر به دنبال اثبات اثبات خواهد شد.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →