امنیت، اخلاق و قوانین هوش مصنوعی

جنجال سرقت علمی OpenAI در حل معمای بزرگ ریاضیات

سرقت علمی OpenAI
💡نکته کلیدی و خلاصه این مقاله:

افشاگری کم‌سابقه استاد ریاضی دانشگاه نیویورک نشان می‌دهد که شرکت OpenAI متهم به سرقت ایده و رویکرد پژوهشگران برای اثبات یکی از مسائل تاریخی ریاضیات هزاره شده است؛ پرونده‌ای جنجالی که مرزهای اخلاق پژوهشی در...

افشاگری کم‌سابقه استاد ریاضی دانشگاه نیویورک نشان می‌دهد که شرکت OpenAI متهم به سرقت ایده و رویکرد پژوهشگران برای اثبات یکی از مسائل تاریخی ریاضیات هزاره شده است؛ پرونده‌ای جنجالی که مرزهای اخلاق پژوهشی در عصر هوش مصنوعی را به چالش کشیده و تردیدهایی جدی درباره نحوه دستیابی غول‌های فناوری به دستاوردهای علمی پدید آورده است.

تریستان باکمستر (Tristan Buckmaster)، استاد ریاضیات دانشگاه نیویورک (NYU)، از ارائه سه اثبات جدید خبر داد که نتایجی مقدماتی را درباره یکی از بزرگ‌ترین مسائل حل‌نشده در ریاضیات نظری در بر دارد. این دستاوردها حاصل همکاری او با لونت آلپوگه (Levent Alpöge)، پژوهشگر شاغل در Anthropic، است و با بهره‌گیری از مدل‌های هوش مصنوعی Codex و Claude حاصل شده که فی‌نفسه اهمیت فراوانی دارد؛ با این حال، این موفقیت علمی زیر سایه جنجالی کم‌سابقه پیرامون تلاش‌های OpenAI برای حل همان مسئله قرار گرفته است.

باکمستر در بیانیه‌ای که برای اعلام اثبات‌های خود منتشر کرد، نوشت: «این ماجرا بخش دیگری هم دارد؛ بخشی که صادقانه بگویم، از صمیم قلب آرزو می‌کردم هرگز ناچار نمی‌شدم فکرم را درگیر آن کنم.»

اتهام سرقت علمی OpenAI و واکنش‌های اولیه

در شرایطی که باکمستر و آلپوگه در حال نهایی‌کردن نتایج پژوهش خود بودند، متوجه شدند که «اطلاعات مربوط به روند پیشرفت ما به OpenAI درز کرده است». هنگامی که آن‌ها در این باره با OpenAI تماس گرفتند، به آن‌ها اعلام شد که OpenAI پیش از این موفق شده است مسئله اصلی را به‌طور کامل اثبات کند. اما زمانی که پرسش‌های موشکافانه‌ای را درباره زمان دقیق آغاز پژوهش‌های OpenAI روی این مسئله و همچنین میزان دخالت مستقیم نیروی انسانی مطرح کردند، پاسخ‌های دریافتی مبهم‌تر و طفره‌آمیزتر شد.

باکمستر می‌گوید: «مشخص شد که یک تیم کامل روی این مسئله متمرکز شده بودند و منابع پردازشی هنگفت و سرسام‌آوری به کار گرفته شده است… در نهایت پذیرفته شد که [نخستین پرامپت] تنها طی چند روز گذشته و دقیقا پس از آن ارسال شده که اطلاعات کار ما به دست OpenAI رسیده بود.»

در صورت صحت این ادعا، ماجرا نشان می‌دهد که تیم OpenAI به این نتیجه رسیده بود که رویکرد باکمستر و آلپوگه مسیر درستی است و سپس تصمیم گرفته با تکیه بر برتری مالی و توان پردازشی عظیم خود، پیش از دیگران به یک اثبات رسمی دست یابد؛ رویدادی که منتقدان آن را مصداق بارز سرقت علمی OpenAI از جامعه دانشگاهی می‌دانند.

سباستین بوبک (Sebastian Bubeck)، مدیر بخش تحقیقات ریاضیات در OpenAI، این اتهامات را «کذب و تحریک‌آمیز» خوانده است.

او پس از انتشار بیانیه باکمستر در یادداشتی نوشت: «برای شفاف‌سازی باید بگویم من با رعایت کامل هنجارهای آکادمیک وارد این گفتگو شدم و واقعا متأسفم که ماجرا به اینجا کشیده شده است. هر کسی مرا می‌شناسد می‌داند که استانداردهای دانشگاهی برایم بیشترین اهمیت را دارند.» بوبک همچنین اضافه کرد که به‌زودی بیانیه کامل‌تری در این باره منتشر خواهد کرد.

کانون مناقشه: معمای تاریخی معادلات ناویر-استوکس

کانون اصلی این مناقشه، مسئله «وجود و همواری معادلات ناویر-استوکس» (Navier-Stokes existence and smoothness) است؛ یکی از هفت «مسئله جایزه هزاره» (Millennium Prize problems) که از سوی مؤسسه ریاضیات کلی (Clay Mathematics Institute) تعیین شده و برای نخستین فرد یا گروهی که راهحلی برای هر یک از آن‌ها ارائه دهد، یک میلیون دلار پاداش در نظر گرفته شده است. معادلات ناویر-استوکس کاربرد گسترده‌ای در مکانیک سیالات دارند، اما از نظر تئوری و ریاضیات محض هنوز ناشناخته‌های زیادی پیرامون آن‌ها وجود دارد. دستیابی به راه‌حل این مسئله، پیشرفتی بنیادین در شناخت عمومی و پایه‌ای از فیزیک ریاضی به شمار خواهد رفت.

با وجود آن‌که ریاضیدانان پرشماری در پی حل این معما هستند، تاکتیک انتخابی باکمستر و همکارش بسیار نامعمول و کم‌سابقه است. به همین سبب، برای باکمستر به‌شدت سوءظن‌برانگیز بود که OpenAI نیز دقیقا در همان برهه زمانی به همان شیوه روی آورده باشد.

باکمستر در این باره تشریح کرد: «مسیر رسیدن به مسئله کلی (Clay problem) از طریق یک نیروی هموار (smooth force) — یعنی گزینه‌های c و d در بیان مسئله توسط ففرمن — همان راهی است که لوئیس و دیه‌گو گشودند و من و لونت نیز در سکوت تصمیم گرفته بودیم حل مسئله را از همین زاویه پیش ببریم.» او در ادامه افزود: «تقریبا تا جایی که می‌دانم هیچ شخص دیگری روی این رویکرد کار نمی‌کرد. این جهتی نیست که بتوان تنها ظرف چند روز و صرفا با دادن صورت مسئله به مدل به آن دست یافت.»

پشت‌پرده اختلافات؛ فشار برای حذف همکار و ابهام در استفاده از داده‌ها

هرچند آلپوگه در استخدام Anthropic است، اما این پژوهش را به نمایندگی از این شرکت پیش نمی‌برد. به همین سبب، این تیم دونفره ترکیبی از مدل‌های مختلف را به کار گرفتند و در کار خود عمدتا بر Codex متعلق به OpenAI متکی بودند. با این همه، به نظر می‌رسد وابستگی سازمانی آلپوگه به یک آزمایشگاه رقیب، نقطه حساسی برای OpenAI بوده است؛ تا جایی که باکمستر ادعا می‌کند بوبک به عنوان بخشی از یک مصالحه پیشنهادی، از او خواسته بود نام و سهم آلپوگه را از این دستاورد حذف کند.

به گفته باکمستر، هنگامی که او اصرار کرد تا این اختلاف علنی شود، بوبک در پاسخ به او گفته است: «چرا باید آینده شغلی‌ات را خراب کنی؟» باکمستر می‌گوید وقتی در برابر این حرف مقاومت نشان داد، بوبک در ادامه گفت: «اگر بنا بر همکاری نداری، پس دلیلی برای مسامحه وجود ندارد.»

باکمستر همچنین این نگرانی جدی را مطرح کرد که چون برای پیشبرد پروژه از Codex به‌صورت گسترده بهره برده بود، داده‌ها و اطلاعات ورودی کار او ممکن است مسیر تلاش‌های داخلی OpenAI برای حل مسئله را هموار کرده باشد. شرکت OpenAI این حق را برای خود محفوظ می‌دارد که مدل‌هایش را بر اساس تعاملات کاربران با Codex آموزش دهد، هرچند کاربران امکان انصراف (opt-out) از این سازوکار را دارند. در صورتی که تیم OpenAI مدلی را به کار گرفته باشد که بر روی پرامپت‌ها و تعاملات تخصصی باکمستر با Codex آموزش دیده است، کاملا محتمل خواهد بود که مدل هنگام پردازش مسئله‌ای مشابه، دستاوردهای پژوهشی او را بازتولید کرده باشد.

شرکت OpenAI تاکنون به درخواست‌های رسانه‌ای برای پاسخ به شبهات پیرامون سرقت علمی OpenAI واکنشی نشان نداده است.

صرف‌نظر از ابعاد این پرونده خاص، رویداد اخیر به بحث‌های جاری پیرامون اخلاق هوش مصنوعی در پژوهش‌های بنیادین ریاضیات و اهداف انحصاری شرکت‌ها دامن خواهد زد. از دید باکمستر، اصولی‌ترین رویکرد این است که تمام جزئیات این پژوهش شفاف‌سازی شود و در معرض داوری عموم قرار گیرد.

باکمستر در پایان خاطرنشان کرد: «من اثبات ارائه‌شده از سوی OpenAI را ندیده‌ام. نمی‌دانم مدل آن‌ها چه کاری انجام داده یا چگونه به آن رسیده است. نمی‌دانم آیا از داده‌های ما استفاده شده است یا خیر. من کسی را به چیزی متهم نمی‌کنم؛ من تنها آنچه را که به من گفته شد، زمان‌بندی آن، و پیشنهادی را که دادند بازگو می‌کنم. این‌ها را می‌گویم چون در غیر این صورت باید تن می‌دادم به این‌که مجموعه‌ای از بیانیه‌ها چیزی را ترویج کنند که خود می‌دانم حقیقت ندارد.»

همیار وب

تیم تحریریه همیار وب

مرجع تخصصی ابزارها، قالب‌ها و آموزش‌های عملی توسعه کسب‌وکار آنلاین مبتنی بر هوش مصنوعی و اتوماسیون.