Hugging Face Journal Club: Direct On-Policy Distillation
يناقش فريق أبحاث Hugging Face ورقة علمية تقترح طريقة فعّالة لنقل فوائد التعلم المعزز من نماذج صغيرة إلى نماذج أكبر بكثير. بدلاً م…
دروس وفيديوهات تعليمية مجانية في الذكاء الاصطناعي والبرمجة وعلم البيانات
يناقش فريق أبحاث Hugging Face ورقة علمية تقترح طريقة فعّالة لنقل فوائد التعلم المعزز من نماذج صغيرة إلى نماذج أكبر بكثير. بدلاً م…
يناقش فريق البحث في هوجينج فيس ورقة علمية تكتشف قانون توسع مشترك بين التدريب المسبق للنماذج والتعلم المعزز. يتعرّف المشاهد على كي…
يكمل كارباثي بناء makemore باستخدام شبكة عصبية متعددة الطبقات MLP، ويربطها بنهج التعلم اللغوي المستوحى من نموذج Bengio الكلاسيكي.
يستعرض كارباثي دوال التنشيط، التدرجات، ومشكلة التشبع، ثم يقدم تطبيع الدفعات BatchNorm وهي تقنية محورية في تدريب الشبكات العميقة.
يتعمق كارباثي في مهارات التعلّم العكسي اليدوي من أجل الدقة والتحكم الكامل في حساب التدرجات، وهي مهارة أساسية لفهم التعلم العميق ب…
دورة شاملة لبناء إطار عمل كامل للتعلم المعزز من الصفر باستخدام لغة C. ستتعلم كيفية بناء محرك الاشتقاق التلقائي والرسم البياني الح…