OpenAI ۳۷۲ نتیجه‌ی ریاضی منتشر کرد؛ ریاضیدان‌ها چه می‌گویند؟

OpenAI ۳۷۲ نتیجه‌ی ریاضی را در گیت‌هاب گذاشت؛ از حدسِ کاکیا تا تردیدِ ریاضیدان‌ها. چه چیزی تأیید شده و چه نه.

OpenAI ۳۷۲ نتیجه‌ی ریاضی منتشر کرد؛ ریاضیدان‌ها چه می‌گویند؟

شرکت OpenAI شامگاهِ ۶ اکتبر ۲۰۲۶ (۱۴ مهر ۱۴۰۵) در گیت‌هابِ خود مجموعه‌ای به نامِ «math» با ۳۷۲ نتیجه‌ی ریاضی منتشر کرد و گفت هر کدام یک مسئله‌ی باز در ریاضیات یا علومِ رایانه را حل می‌کنند یا پیشرفتِ جدی در آن می‌سازند. از جمله ادعا شده حدسِ کاکیا در چهار بُعد حل شده است. ریاضیدان‌ها می‌گویند باید ماه‌ها بگذرد تا معلوم شود این نتیجه‌ها چقدر درست و تازه‌اند.

چه چیزی منتشر شد؟

طبقِ گزارشِ Scientific American، OpenAI مجموعه‌ای از ادعاهای ریاضی را با مدلی داخلی ساخته که هنوز برای عموم عرضه نشده است. در میانِ ادعاها این‌ها دیده می‌شود: حلِ حدسِ کاکیا در چهار بُعد، بهبودِ چند الگوریتمِ مهم و پیشرفت به سمتِ فرضیه‌ی ریمان. بخشِ بزرگی از نتیجه‌ها در زبانِ Lean، که منطقِ اثبات‌ها را ماشینی وارسی می‌کند، تأیید شده‌اند. نکته‌ی مهم: Lean فقط درستیِ استدلال را می‌سنجد؛ اینکه نتیجه واقعاً تازه، مهم یا مرتبط با همان مسئله‌ی معروف باشد را نشان نمی‌دهد.

چطور ساخته شد؟

سخنگوی OpenAI گفته تقریباً همه‌ی نتیجه‌ها از یک دستور (پرامپت) به یک عاملِ هوش مصنوعی به دست آمده‌اند، هرچند بعضی ممکن است چندبار تلاش لازم داشته‌اند. این برخلافِ ادعای قبلیِ شرکت درباره‌ی معادله‌ی ناویر–استوکس است که گفته می‌شد از یک «گروهِ ۱۰ هزار عاملی» با هزینه‌ی میلیونی ساخته شده. میانگینِ زمانِ محاسبه برای هر نتیجه حدود سه ساعتِ استفاده از ChatGPT Pro گزارش شده است. خودِ OpenAI هم می‌گوید بسیاری از نتیجه‌ها هنوز برای ریاضیدان‌های خودش کاملاً قابل‌فهم نیست.

ریاضیدان‌ها چه می‌گویند؟

  • اندرو ساترلند (MIT): تا مدل منتشر نشود و دیگران نتوانند نتیجه را تکرار کنند، ادعای «حلِ یک‌جا با یک عامل» را باید تأییدنشده دانست.
  • دانیل لیت (دانشگاه تورنتو): دلیلی نمی‌بیند پاسخ‌ها پنهان بماند و انتظار دارد به ریاضیات کمک کند.
  • ترنس تائو: سرعتِ تولیدِ نتیجه‌های ماشینی را «دیوانه‌کننده» خوانده است.

گروهی مشورتی که OpenAI در ۲۱ سپتامبر تشکیل داد، توصیه کرده مدل، پرامپت‌های دقیق و زمانِ محاسبه‌ی هر مسئله منتشر شود. OpenAI فقط میانگین‌ها را داده و پرامپت‌ها را نه؛ و گفته توصیه‌ها را جدی می‌گیرد ولی خود را به آن‌ها ملزم نمی‌داند. تعدادِ دقیقِ نتیجه‌ها هم در گزارش‌ها یکدست نیست: بیشترِ رسانه‌ها از ۳۷۲ نتیجه می‌گویند، ولی یک گزارش از ۷۲۲ دست‌نوشته در ۳۷۲ خانواده نوشته است.

این خبر برای کاربرِ فارسی‌زبان یعنی چه؟

برای بیشترِ ما، اثرِ این خبر مستقیم نیست، ولی پیامِ مهمی دارد: هوش مصنوعی دارد از «کمک به نوشتن و خلاصه‌کردن» به سمتِ پژوهشِ اصیل می‌رود، و در همان حال، راستی‌آزمایی مهم‌تر از همیشه شده است. اگر دانشجو یا پژوهشگر هستید، یاد بگیرید از ابزارها برای ایده و بررسی استفاده کنید ولی هر نتیجه را مستقل وارسی کنید. تا وقتی مدل و پرامپت‌ها منتشر نشده‌اند، هیچ‌کس بیرون از OpenAI نمی‌تواند ادعاها را تکرار کند.

برای تمرینِ حل مسئله و پرسش‌های علمی به فارسی، در هوش‌نو می‌توانید با GPT، Claude، Gemini و DeepSeek گفت‌وگو کنید و پاسخ‌ها را کنارِ هم بسنجید؛ ابزارها در ابزارهای هوش‌نو هستند. درباره‌ی تازه‌ترین مدل‌های OpenAI GPT-6.1 Sol را بخوانید.

سؤالات متداول

آیا حدسِ کاکیا واقعاً حل شده؟

OpenAI چنین ادعایی دارد و بخشی از اثبات‌ها در Lean تأیید شده‌اند، ولی داوریِ مستقلِ ریاضیدان‌ها هنوز انجام نشده است.

چرا گفته می‌شود «تأییدنشده»؟

چون مدل و پرامپت‌ها منتشر نشده و نتیجه‌ها را نمی‌توان از بیرون تکرار کرد.

Lean چیست؟

زبانی برای نوشتنِ اثبات‌های ریاضی که رایانه گام‌به‌گامِ منطقِ آن را بررسی می‌کند؛ ولی اهمیت و تازگیِ نتیجه را نمی‌سنجد.

منبع‌ها

نویسنده نعیم.ح