۷۱۹ اثبات ریاضی هوش مصنوعی OpenAI زیر ذرهبین: آیا ناویر-استوکس در ترجمه گم شد؟
یک مقاله تازه میگوید اثبات ناویر-استوکس OpenAI با کد Lean آن مطابقت ندارد و این تردیدها درباره ۷۱۹ دستنوشته ریاضی هوش مصنوعی را برمیانگیزد.
ریاضیدانان در حال زیر سؤال بردن قابلیت اعتماد به ۷۱۹ دستنوشته ریاضی تولیدشده توسط هوش مصنوعی OpenAI هستند؛ این تردید پس از آن مطرح شد که مقالهای گفت اثبات پیشین ناویر-استوکس این شرکت با نسخه بررسیشده با رایانهاش مطابقت ندارد.
نکات کلیدی:
فهرست OpenAI پس از آنکه شرکت سه مقاله را به دلیل یک خطای علامت کنار گذاشت، از ۷۲۲ به ۷۱۹ دستنوشته کاهش یافت.
سه ریاضیدان مستقر در بریتانیا دو نقطه را مستند کردند که اثبات مکتوب ناویر-استوکس و کد Lean آن با هم اختلاف دارند.
نویسندگان اثبات را نادرست نمینامند، اما میگویند بررسی ماشینی نمیتواند جایگزین داوری همتا شود.
انتشار ریاضیات OpenAI
شرکت این مجموعه را در ۶ اکتبر منتشر کرد، و گزارشی که پنجشنبه منتشر شد نشان داد این مجموعه از دستورالعملهایی که یک هیئت مستقل از ریاضیدانان برای آزمایشگاههای هوش مصنوعی نوشته بود، تخطی کرده است. فهرست با ۷۲۲ دستنوشته آغاز شد. OpenAI یک روز بعد سه مورد را حذف کرد، پس از آنکه یک خطای علامت یکی از استدلالها و دو مقالهای را که به آن تکیه داشتند از کار انداخت.
این دستورالعملها که در ۲۹ سپتامبر توسط گروه مشورتی ریاضیات و هوش مصنوعی با ۹ عضو منتشر شد، با درخواستی آغاز میشود که آزمایشگاهها تست مسائل پیشرفته ریاضی را روی مدلهای انحصاری متوقف کنند. مخزن OpenAI میگوید این مقالات از ارزیابی یک مدل داخلی منتشرنشده روی مسائل پژوهشی باز به دست آمدهاند.
خلاصههایی از استدلال مدل فقط همراه ۱۰ نتیجه آمده است، و حدود ۴۲٪ از نتایج اصلی در Lean صوریسازی شدهاند؛ Lean یک زبان برنامهنویسی است که به رایانه اجازه میدهد یک اثبات را بررسی کند.
شکافهای اثبات ناویر-استوکس
الکساندر باستونیس از کینگز کالج لندن و فابیان چیرچلی و آندرس هانسن از دانشگاه کمبریج، اثبات ناویر-استوکسی را بررسی کردند که OpenAI در سپتامبر اعلام کرد. آنها دو نقطه را مستند کردند که استدلال مکتوب و کد Lean با هم اختلاف دارند، از جمله جایی که کد برآوردی ضعیفتر از آنچه مقاله میگوید را اثبات میکند.
نویسندگان گفتند ادعایی درباره درست بودن اثبات مکتوب ندارند. نکته آنها محدودتر است. آنها نوشتند Lean تأیید میکند که قضیه نهایی برقرار است، اما نمیتواند نشان دهد گامهای میانی که یک انسان میخواند درست هستند؛ بنابراین چنین اثباتهایی همچنان به داوری همتا نیاز دارند.
برنده مدال فیلدز، ترنس تائو، در ۶ اکتبر نوشت مسائلی توسط «پرامپتنویسان هوش مصنوعی» حل میشوند که خروجی را بهاندازه کافی نمیفهمند تا به پرسشها پاسخ دهند یا درباره آن سخنرانی کنند. ملانی مچت وود، استاد دانشگاه هاروارد و عضو گروه مشورتی، گفت هیچ انسانی هنگام انتشار چنین نتایجی آنها را نمیفهمد، «و اکنون کار آغاز میشود.»
مناقشه اثبات OpenAI
گروه مشورتی گفته است فقط جامعه گستردهتر ریاضی میتواند قضاوت کند OpenAI تا چه حد به توصیههایش پایبند بوده است. این بررسی پس از ماهی پرتنش میآید. OpenAI نتیجه ناویر-استوکس را در ۸ سپتامبر اعلام کرد که منجر به اختلافی بر سر اعتبار با تریستان باکمستر، ریاضیدان دانشگاه نیویورک، شد؛ و ۲۵ برنده مدال فیلدز سه روز بعد بیانیهای منتشر کردند و هشدار دادند نتایج تولید انبوه هوش مصنوعی میتواند به این رشته آسیب بزند.