- بحسب النص الأصلي، تبلغ النتائج الرياضية المولدة بالذكاء الاصطناعي التي نشرتها OpenAI نحو 400 نتيجة، وتمتد عبر أكثر من 700 ورقة بحثية. وتشمل عدة مجالات، منها التوافقيات والهندسة ونظرية الأعداد وعلوم الحاسوب النظرية.
- قالت OpenAI إنها صاغت في لغة Lean نحو 300 من النتائج الرئيسية في 719 ورقة بحثية. وLean لغة برمجة تساعد الحاسوب على التحقق مما إذا كان البرهان صحيحا منطقيا. ويصف النص الأصلي ذلك بأنه نحو 42%.
- قال علماء الرياضيات إنه حتى مع وجود شيفرة Lean، يجب التحقق بشكل منفصل من أن البرهان يطابق فعلا ما تدعيه الورقة البحثية. كما وُجهت انتقادات إلى بعض الأوراق بسبب قصر قوائم المراجع وعدم كفاية الإحالات إلى المصادر.
- وصف عالم الرياضيات في جامعة ستانفورد جاريد دوكر ليتمان نتائج تتعلق بالتقدم نحو فرضية ريمان، وبحالة خاصة من تخمين هودج، ونتائج مرتبطة بتخمين كاكيا في 4 من الأبعاد بأنها مهمة. وهذا تقييم باحث تحدث إلى الصحفيين، ولا يؤكد النص أن التحقق من هذه النتائج قد اكتمل في وقت المصدر.
يلفتني الانتباه أن هناك ورقة بحثية قائمة مراجعها قصيرة. للتحقق مما إذا كان قد سقط استشهاد ما، يضطر المرء في النهاية إلى قراءة المخطوطات واحدة تلو الأخرى، لكن المقال لا يوضح بجلاء من سيراجع النتائج القريبة من 400 ولا بأي ترتيب. كما أن سحب 3 ورقة بحثية بسبب خطأ في الإشارة يوحي بأن النتائج المنشورة يصعب اعتبارها نهائية فورا. وأتساءل كيف تُبيّنون حالة التحقق في مختبركم عند الرجوع إلى مثل هذه المواد.