أعلنت شركة Nous Research المتخصصة في الذكاء الاصطناعي مفتوح المصدر عن إطلاق نموذج جديد للبرمجة يدعى NousCoder-14B، يستطيع التنافس مع أنظمة احترافية أكبر حجماً. استغرق تدريب النموذج أربعة أيام فحسب باستخدام 48 معالج من أحدث معالجات Nvidia من فئة B200، وحققت الشركة التي تدعمها صندوق Paradigm للاستثمار نتائج مميزة في اختبارات البرمجة القياسية.

سجل النموذج الجديد دقة بلغت 67.87% في اختبار LiveCodeBench v6، الذي يقيّم أداء النماذج على مسائل برمجة تنافسية منشورة بين آب 2024 وأيار 2025. ويمثل هذا تحسناً بنسبة 7.08 نقاط مئوية عن النموذج الأساسي الذي اُشتق منه، وهو Qwen3-14B من شركة علي بابا. يأتي الإطلاق في وقت يشهد منافسة حادة، إذ هيمنت أداة Claude Code من Anthropic على النقاشات منذ بدء العام الجديد، حيث شاركت مهندسة في Google تجربتها في حل مشكلة استغرقت فريقها سنة كاملة خلال ساعة واحدة فقط باستخدام الأداة.

ما يميز إطلاق NousCoder-14B هو الشفافية الجذرية التي اعتمدتها الشركة. لم تنشر Nous Research أوزان النموذج فقط، بل أفرجت عن بيئة التعلم المعزز الكاملة ومجموعات الاختبار وأدوات التدريب المبنية على إطار عملها Atropos. يتيح هذا لأي باحث لديه موارد حاسوبية كافية إعادة إنتاج العمل أو توسيع نطاقه. طور النموذج جو لي، باحث مقيم في الشركة وسابق برمج تنافسي، الذي وجد تشابهاً ملفتاً بين رحلة تحسن النموذج ورحلته الشخصية على منصة Codeforces.

أوضح لي أن النموذج حقق في أربعة أيام قفزة مماثلة لما احتاج إليه شخصياً سنتين من التدريب المكثف في سنواته الأولى. لكنه أشار إلى فارق مهم: حل حوالي ألف مسألة خلال تلك السنتين، بينما احتاج النموذج إلى 24 ألف مسألة. يبقى الإنسان أكثر كفاءة في التعلم من حيث عدد العينات المطلوبة. استخدم النموذج تقنية تعتمد على ما يسميه الباحثون "المكافآت القابلة للتحقق"، حيث ينفذ النموذج حلولاً برمجية يتم اختبارها تلقائياً لمعرفة صحتها من عدمه.

كشف التقرير التقني للمشروع عن تحدٍ مستقبلي حرج: فريق البحث استنزف "نسبة كبيرة من جميع مسائل البرمجة التنافسية الموثوقة المتاحة بسهولة" في صيغة موحدة. يشير هذا إلى أن المجال يقترب من حدود بيانات التدريب عالية الجودة. حذر الباحثون من أن البحث المستقبلي سيركز على توليد البيانات الاصطناعية والخوارزميات الأكثر فعالية في استخدام البيانات، وأشاروا إلى احتمالية تدريب النماذج على توليد مسائل قابلة للحل كآلية للتحسين الذاتي.

جمعت Nous Research 65 مليون دولار في تمويل إجمالي، بينها 50 مليون دولار في جولة بقيادة Paradigm في نيسان 2025. أطلقت الشركة سابقاً نماذج مثل Hermes 4 و DeepHermes-3، لكنها واجهت انتقادات من بعض المراقبين حول اعتمادها على معايير الأداء والعلامات التسويقية.