شرکت OpenAI شامگاهِ ۶ اکتبر ۲۰۲۶ (۱۴ مهر ۱۴۰۵) در گیتهابِ خود مجموعهای به نامِ «math» با ۳۷۲ نتیجهی ریاضی منتشر کرد و گفت هر کدام یک مسئلهی باز در ریاضیات یا علومِ رایانه را حل میکنند یا پیشرفتِ جدی در آن میسازند. از جمله ادعا شده حدسِ کاکیا در چهار بُعد حل شده است. ریاضیدانها میگویند باید ماهها بگذرد تا معلوم شود این نتیجهها چقدر درست و تازهاند.
چه چیزی منتشر شد؟
طبقِ گزارشِ Scientific American، OpenAI مجموعهای از ادعاهای ریاضی را با مدلی داخلی ساخته که هنوز برای عموم عرضه نشده است. در میانِ ادعاها اینها دیده میشود: حلِ حدسِ کاکیا در چهار بُعد، بهبودِ چند الگوریتمِ مهم و پیشرفت به سمتِ فرضیهی ریمان. بخشِ بزرگی از نتیجهها در زبانِ Lean، که منطقِ اثباتها را ماشینی وارسی میکند، تأیید شدهاند. نکتهی مهم: Lean فقط درستیِ استدلال را میسنجد؛ اینکه نتیجه واقعاً تازه، مهم یا مرتبط با همان مسئلهی معروف باشد را نشان نمیدهد.
چطور ساخته شد؟
سخنگوی OpenAI گفته تقریباً همهی نتیجهها از یک دستور (پرامپت) به یک عاملِ هوش مصنوعی به دست آمدهاند، هرچند بعضی ممکن است چندبار تلاش لازم داشتهاند. این برخلافِ ادعای قبلیِ شرکت دربارهی معادلهی ناویر–استوکس است که گفته میشد از یک «گروهِ ۱۰ هزار عاملی» با هزینهی میلیونی ساخته شده. میانگینِ زمانِ محاسبه برای هر نتیجه حدود سه ساعتِ استفاده از ChatGPT Pro گزارش شده است. خودِ OpenAI هم میگوید بسیاری از نتیجهها هنوز برای ریاضیدانهای خودش کاملاً قابلفهم نیست.
ریاضیدانها چه میگویند؟
- اندرو ساترلند (MIT): تا مدل منتشر نشود و دیگران نتوانند نتیجه را تکرار کنند، ادعای «حلِ یکجا با یک عامل» را باید تأییدنشده دانست.
- دانیل لیت (دانشگاه تورنتو): دلیلی نمیبیند پاسخها پنهان بماند و انتظار دارد به ریاضیات کمک کند.
- ترنس تائو: سرعتِ تولیدِ نتیجههای ماشینی را «دیوانهکننده» خوانده است.
گروهی مشورتی که OpenAI در ۲۱ سپتامبر تشکیل داد، توصیه کرده مدل، پرامپتهای دقیق و زمانِ محاسبهی هر مسئله منتشر شود. OpenAI فقط میانگینها را داده و پرامپتها را نه؛ و گفته توصیهها را جدی میگیرد ولی خود را به آنها ملزم نمیداند. تعدادِ دقیقِ نتیجهها هم در گزارشها یکدست نیست: بیشترِ رسانهها از ۳۷۲ نتیجه میگویند، ولی یک گزارش از ۷۲۲ دستنوشته در ۳۷۲ خانواده نوشته است.
این خبر برای کاربرِ فارسیزبان یعنی چه؟
برای بیشترِ ما، اثرِ این خبر مستقیم نیست، ولی پیامِ مهمی دارد: هوش مصنوعی دارد از «کمک به نوشتن و خلاصهکردن» به سمتِ پژوهشِ اصیل میرود، و در همان حال، راستیآزمایی مهمتر از همیشه شده است. اگر دانشجو یا پژوهشگر هستید، یاد بگیرید از ابزارها برای ایده و بررسی استفاده کنید ولی هر نتیجه را مستقل وارسی کنید. تا وقتی مدل و پرامپتها منتشر نشدهاند، هیچکس بیرون از OpenAI نمیتواند ادعاها را تکرار کند.
برای تمرینِ حل مسئله و پرسشهای علمی به فارسی، در هوشنو میتوانید با GPT، Claude، Gemini و DeepSeek گفتوگو کنید و پاسخها را کنارِ هم بسنجید؛ ابزارها در ابزارهای هوشنو هستند. دربارهی تازهترین مدلهای OpenAI GPT-6.1 Sol را بخوانید.
سؤالات متداول
آیا حدسِ کاکیا واقعاً حل شده؟
OpenAI چنین ادعایی دارد و بخشی از اثباتها در Lean تأیید شدهاند، ولی داوریِ مستقلِ ریاضیدانها هنوز انجام نشده است.
چرا گفته میشود «تأییدنشده»؟
چون مدل و پرامپتها منتشر نشده و نتیجهها را نمیتوان از بیرون تکرار کرد.
Lean چیست؟
زبانی برای نوشتنِ اثباتهای ریاضی که رایانه گامبهگامِ منطقِ آن را بررسی میکند؛ ولی اهمیت و تازگیِ نتیجه را نمیسنجد.