نشرت منصة Hugging Face نتائج تحدي «ICML 2026 Open Reproductions»، الذي يعد أضخم محاولة جماعية لإعادة إنتاج أبحاث مؤتمر علمي عبر وكلاء الذكاء الاصطناعي والأكواد البرمجية الآلية. شهد المؤتمر قبول آلاف الأبحاث، مدفوعاً بتسارع وتيرة النشر الذي تقوده أدوات الذكاء الاصطناعي، بينما ظلت طاقة المراجعة البشرية التقليدية عاجزة عن مواكبة هذا الكم الهائل.

شارك في التحدي مئات الأفراد باستخدام أرصدة حوسبة من Hugging Face لإجراء آلاف الاختبارات السحابية. وأسفرت النتائج عن التحقق بشكل مستقل من ادعاءات في نحو 51 بالمئة من الأبحاث التي تم فحصها، بينما تعرضت ادعاءات في 23 بالمئة من الأبحاث للتفنيد أو التشكيك، في حين تراوحت بقية النتائج بين أدلة محدودة أو تعذر إثباتها.

أظهرت المراجعات الدقيقة أخطاء رياضية وبرمجية محددة في بعض الأوراق المقبولة، شملت خللاً في إثباتات نظرية، واستخدام بيانات أو خوارزميات تخالف النصوص النظرية المنشورة، إضافة إلى مبالغات في مقاييس تقييم النماذج الناتجة عن تضمن البيانات رموز حشو وتشتيت.

أكد المنظمون أن الاعتماد المطلق على وكلاء الذكاء الاصطناعي يواجه عقبات تتمثل في الوقوع بحلقات مفرغة أو إسقاط فهم النطاقات الواسعة، مما يجعل الإشراف البشرى موجهاً أساسياً للنجاح، حيث تظهر أفضل النتائج عبر توجيه الباحثين للوكلاء وتحديد بيئة العمل الصحيحة.