كشفت Anthropic عن نتائج مبكرة في مجال تحسين الذكاء الاصطناعي لنفسه بنفسه، حيث نشرت ورقة بحثية بعنوان "الباحثون الآليون يمكنهم الحد من فشل المحاذاة بموثوقية". توضح الدراسة كيف يستطيع نظام ذكي معالجة مشاكل عدم محاذاة نماذج الذكاء الاصطناعي مع القيم الإنسانية، محققًا تحسنًا في عشرة معايير مختلفة دون إضعاف الأداء العامة.
قاد الدراسة تشن يويه-هان من برنامج الباحثين في Anthropic. يعمل النظام بطريقة تحاكي البحث التقليدي، حيث يبحث عن الأدبيات المتاحة، يقترح طرقًا جديدة، ثم يدرب النموذج لمدة ثلاثين دقيقة في كل دورة. تُحفظ الطرق الفعالة وتُستبعد غير الفعالة، مما يمكّن النظام من العمل بسرعة وعلى نطاق واسع.
أظهرت المقارنة فجوة كبيرة بين الأداء الآلية والبشرية. يتفوق أفضل نسخة من النظام الآلي على مقترحات الباحثين ذوي الخبرة في المتوسط خلال ست ساعات فقط. علاوة على ذلك، تبلغ تكلفة تشغيل النظام الآلي حوالي أربعة دولارات في الساعة، مقابل مئة وخمسين دولارًا للساعة الواحدة من عمل الباحث البشري.
تمثل هذه النتائج خطوة باتجاه التحسن الذاتي العودي، الذي يعتبره المختصون المرحلة التالية الحاسمة في تطور الذكاء الاصطناعي. إذا تمكنت النماذج من تحسين تدريبها بشأن المحاذاة، فقد تستطيع في المستقبل تحسين ممارسات التدريب بشكل عام.
مع ذلك، حذرت الورقة البحثية من قيود هذا النهج. فعالية النظام مرتبطة بدقة المعايير المستخدمة في قياس المحاذاة، وهناك عمل كبير لا يزال مطلوبًا في وضع هذه المعايير والحفاظ عليها. كما يتطلب الأمر صيانة ورعاية مستمرة للأدبيات التي يستقي منها الباحثون الآليون معلوماتهم.
Comments (0)
No comments yet. Be the first.