در ادامه حواشی مربوط به دستاوردهای اخیر OpenAI در حل مسائل پیچیده علمی، اکنون پژوهشگر دیگری نیز این شرکت را به چالش کشیده است. پس از ابهامات مطرحشده درباره دستاورد ناویر-استوکس و ادعاهای «تریستان باکمستر»، یک ریاضیدان دیگر این شرکت هوش مصنوعی را به رفتار غیراخلاقی، «غیرصادقانه» و فقدان شفافیت درباره منبع دادههای آموزشی متهم کرد.
ماجرای جدید با پستهای «آندریاس تام»، ریاضیدان برجسته، در شبکه اجتماعی Mastodon آغاز شد. او ابراز نگرانی کرده است که تعاملات او و همکارانش با چتبات ChatGPT پیش از اعلام دستاوردهای بزرگ OpenAI، ممکن است به موفقیتهای اخیر این شرکت در حوزه ریاضی کمک کرده باشد. ماه گذشته میلادی، OpenAI ده دستاورد مهم علمی را معرفی کرد که یکی از آنها مستقیماً در حوزه تخصصی تام، یعنی «گروههای غیرسوفیک» (Non-sofic groups)، قرار داشت؛ ساختارهای ریاضی نامتناهی و پیچیدهای که امکان تقریب آنها با ساختارهای متناهی وجود ندارد.
پس از اعلام اولیه این نتیجه، انتقادهای گستردهای از سوی محافل دانشگاهی به OpenAI وارد شد، زیرا این شرکت در متن اولیه خود به مشارکتها و کارهای اخیر تام و همکارش «گابور کُن» اشاره نکرده بود. این شرکت در نهایت بدون سر و صدا گزارش خود را اصلاح و اعلام کرد که دستاوردش تا حد زیادی بر پایه کارهای قبلی تام و کُن ساخته شده است. بااینحال، تام میگوید تسلط دقیق و جزئی OpenAI بر تکنیکهای آنها او را شوکه کرده است، زیرا این تکنیکها در آن مقطع زمانی، نه بدیهیترین مسیر برای رسیدن به راهحل محسوب میشدند و نه امیدوارکنندهترین روش بودند.

ابهام در نحوه استفاده OpenAI از دادههای کاربران در حل مسائل ریاضی
تام توضیح داده که پس از اعتراض عمومی باکمستر درباره ماجرای ناویر-استوکس و احتمال استفاده از تاریخچه کارهایش در ابزار Codex، به این فکر افتاده است که تعاملات خود با این چتبات را ارزیابی کند. در پی این تردیدها، تام در ایمیلهایی به دو پژوهشگر ارشد OpenAI، یعنی «سباستین بوبک» و «مارک سلکی»، مستقیماً از آنها سؤال کرده که آیا مکالمات او با چتبات بخشی از دادههای آموزشی بوده یا در فرایند استدلال مدل در دسترس قرار گرفته است یا خیر.
پاسخ ارائهشده از سوی این شرکت نتوانست تام را قانع کند. به گفته او، پژوهشگران OpenAI تنها به این موضوع اشاره کردند که به گفتگوهای او به شکل مستقیم دسترسی پیدا نشده است، اما هیچ توضیحی درباره اینکه آیا این تعاملات وارد مجموعه عظیم دادههای آموزشی مدلها شدهاند یا نه، ارائه ندادند.
تام این رویکرد را نشانهای آشکار از عدم صداقت دانسته و اعلام کرده است که پاسخ دریافتی گمراهکننده بوده است. او تأکید دارد که پژوهشگران خارج از شرکت ابزار مهندسی معکوس برای بررسی خط لوله آموزش مدلها را ندارند و وظیفه OpenAI است که با شفافسازی مجموعهدادهها و مقررات دادهای، بیگناهی خود را اثبات کند.

این شیوه پاسخدهی مبهم، شباهت زیادی به موضعگیری OpenAI در ماجرای قبلی دارد. در آن پرونده نیز هرچند OpenAI دسترسی مستقیم به دادههای کاربر را رد کرد، اما رسماً اعتراف کرد که نمیتواند تأثیر غیرمستقیم دادههای ناشناسسازیشده را بر بهبود مدلها انکار کند.
به گفته تام، حذف هویت و نام افراد شاید روی کاغذ انجام شود، اما ماهیت فکری و بار علمی یک ایده ریاضی را از بین نمیبرد. به باور این پژوهشگر، اگر یک شرکت با استفاده از کار منتشرنشده کاربران مدلی را بهبود ببخشد و سپس با همان کاربران برای انتشار سریعتر نتیجه وارد رقابت شود، اقدامی کاملاً غیرقابل دفاع از نظر اخلاقی انجام داده است؛ رفتاری که در صورت تداوم، فضای باز علمی را به سمت پنهانکاری بیشتر سوق خواهد داد.
نظرات کاربران