معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 1-40 من 86 نتيجة — صفحة 1 / 3
التقييم والشرح (40)
اختبار MMLU المتعدد
MMLU
اختبار فهم اللغة متعدد المهام والمواضيع.
اختبار GSM8K الرياضي
GSM8K
اختبار لحل مسائل رياضيات متعددة الخطوات.
اختبار ARC التحدي
ARC Benchmark
اختبار مرجعي لقياس قدرات التفكير.
اختبار HellaSwag
HellaSwag
اختبار استكمال الجمل بشكل ذكي وسليم.
اختبار WinoGrande
WinoGrande
اختبار لفهم اللغة العامة والتعرف.
اختبار BigBench
BIG-Bench
مجموعة مهام متنوعة لتقييم قدرات الذكاء الاصطناعي.
تقييم MT-Bench للمحادثات
MT-Bench
تقييم النماذج في المحادثات متعددة الجولات.
ساحة الروبوتات المحادثة
Chatbot Arena
منصة مقارنة النماذج عبر التصويت البشري المباشر.
اختبار SWE-bench
SWE-bench
اختبار حل مشكلات البرمجيات الحقيقية.
اختبار MMMU المتعدد الوسائط
MMMU
اختبار فهم متعدد الوسائط للصور والنصوص.
اختبار GPQA المتخصص
GPQA
اختبار أسئلة متخصصة عالية الصعوبة.
تقييم IFEval للتعليمات
IFEval
تقييم الامتثال لتعليمات المستخدم المحددة.
تقييم AlpacaEval للردود
AlpacaEval
تقييم جودة الردود المولدة من النماذج.
جدول ترتيب نماذج اللغة الكبيرة
LLM Leaderboard
ترتيب النماذج حسب الأداء على اختبارات معيارية.
تشفير SHAP
SHAP Values
قيم Shapley لشرح تنبؤات النموذج.
شرح LIME المحلي
LIME
شرح تنبؤات النموذج بشكل محلي ومبسط.
التصور للانتباه
Attention Visualization
تصور آليات الانتباه لفهم تركيز النموذج.
فحص الطبقات
Probing
فحص ما يتعلمه النموذج في طبقاته المختلفة.
إسناد الميزات
Feature Attribution
إسناد أهمية الميزات المختلفة للتنبؤات.
مسح المفاهيم
Concept Erasure
مسح مفاهيم معينة من النموذج لتغيير سلوكه.
ترقيع التفعيلات
Activation Patching
استبدال التفعيلات لفهم تأثيرها على النتائج.
التفسير الآلي للنماذج
Mechanistic Interpretability
فهم الآليات الداخلية الدقيقة للنماذج العصبية.
تحليل الدوائر الداخلية
Circuit Analysis
تحليل الدوائر الداخلية للنماذج لفهم عملها.
الشفاطات الذاتية الخاملة
Sparse Autoencoders
مشفرات ذاتية خاملة لاستخراج الميزات المخفية.
قابلية تفسير التعلم العميق
Deep Learning Explainability
شرح قرارات التعلم العميق والشبكات العميقة.
الشرح التخيلي
Counterfactual Explanations
شرح ماذا لو تغير الإدخال لنتيجة مختلفة.
الشرح القائم على المفاهيم
Concept-based Explanations
شرح قرارات النموذج بناءً على المفاهيم الدلالية.
مقاييس ضبط الثقة
Calibration Metrics
مقاييس لضبط ثقة النموذج في تنبؤاته.
مقاييس الانحدار المتقدمة
Advanced Regression Metrics
مقاييس متقدمة لتقييم نماذج الانحدار.
مقاييس التجزئة
Segmentation Metrics
مقاييس لتقييم أداء التجزئة الصورية.
مقاييس كشف الأجسام
Detection Metrics
مقاييس لتقييم أداء كشف الأجسام.
اختبار متانة النموذج
Robustness Testing
اختبار متانة النموذج في مواجهة الضوضاء.
تقييم عدالة النموذج
Fairness Evaluation
تقييم عدالة النموذج وخلوه من التحيز.
خط أنابيب تفسير النماذج
Interpretability Pipeline
خط أنابيب شامل لشرح وتفسير النماذج.
الاختبار السلوكي للنماذج
CheckList Testing
اختبار سلوكي شامل لفحص سلوك النماذج.
تقييم ثغرات التعلم الآلي
ML Vulnerability Assessment
تقييم ثغرات نماذج التعلم الآلي الأمنية.
تحليل التحيز النشط
Active Bias Analysis
اكتشاف وقياس التحيزات في النموذج عبر اختبارات نشطة ومنتشرة.
اختيار العتبة
Threshold Selection
اختيار قيمة عتبة يفصل عندها النموذج بين الفئات أو بين الاكتشاف الصحيح والخطأ، ويوازن بين الدقة والاسترجاع وفق هدف المهمة.
أهمية الميزات
Feature Importance
تعيين درجة لكل ميزة تدل على مدى مساهمتها في تنبؤ النموذج، فيُعرف المتغيرات الأكثر تأثيرًا ويُتحقق من سلامة القرار وأسبابه.
النموذج البديل
Surrogate Model
نموذج بسيط قابل للتفسير يُدرَّب على تقليد مخرجات نموذج معقد، فيشرح قرارات الأخير بقواعد مفهومة للإنسان.