معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 41-80 من 351 نتيجة — صفحة 2 / 9
التقييم والشرح (40)
جدول ترتيب نماذج اللغة الكبيرة
LLM Leaderboard
ترتيب النماذج حسب الأداء على اختبارات معيارية.
تشفير SHAP
SHAP Values
قيم Shapley لشرح تنبؤات النموذج.
شرح LIME المحلي
LIME
شرح تنبؤات النموذج بشكل محلي ومبسط.
التصور للانتباه
Attention Visualization
تصور آليات الانتباه لفهم تركيز النموذج.
فحص الطبقات
Probing
فحص ما يتعلمه النموذج في طبقاته المختلفة.
إسناد الميزات
Feature Attribution
إسناد أهمية الميزات المختلفة للتنبؤات.
مسح المفاهيم
Concept Erasure
مسح مفاهيم معينة من النموذج لتغيير سلوكه.
ترقيع التفعيلات
Activation Patching
استبدال التفعيلات لفهم تأثيرها على النتائج.
التفسير الآلي للنماذج
Mechanistic Interpretability
فهم الآليات الداخلية الدقيقة للنماذج العصبية.
تحليل الدوائر الداخلية
Circuit Analysis
تحليل الدوائر الداخلية للنماذج لفهم عملها.
الشفاطات الذاتية الخاملة
Sparse Autoencoders
مشفرات ذاتية خاملة لاستخراج الميزات المخفية.
قابلية تفسير التعلم العميق
Deep Learning Explainability
شرح قرارات التعلم العميق والشبكات العميقة.
الشرح التخيلي
Counterfactual Explanations
شرح ماذا لو تغير الإدخال لنتيجة مختلفة.
الشرح القائم على المفاهيم
Concept-based Explanations
شرح قرارات النموذج بناءً على المفاهيم الدلالية.
مقاييس ضبط الثقة
Calibration Metrics
مقاييس لضبط ثقة النموذج في تنبؤاته.
مقاييس الانحدار المتقدمة
Advanced Regression Metrics
مقاييس متقدمة لتقييم نماذج الانحدار.
مقاييس التجزئة
Segmentation Metrics
مقاييس لتقييم أداء التجزئة الصورية.
مقاييس كشف الأجسام
Detection Metrics
مقاييس لتقييم أداء كشف الأجسام.
اختبار متانة النموذج
Robustness Testing
اختبار متانة النموذج في مواجهة الضوضاء.
تقييم عدالة النموذج
Fairness Evaluation
تقييم عدالة النموذج وخلوه من التحيز.
خط أنابيب تفسير النماذج
Interpretability Pipeline
خط أنابيب شامل لشرح وتفسير النماذج.
الاختبار السلوكي للنماذج
CheckList Testing
اختبار سلوكي شامل لفحص سلوك النماذج.
تقييم ثغرات التعلم الآلي
ML Vulnerability Assessment
تقييم ثغرات نماذج التعلم الآلي الأمنية.
معيار MMLU
MMLU Benchmark
معيار تقييم شامل يختبر المعرفة العامة عبر 57 مادة أكاديمية مختلفة.
معيار HumanEval
HumanEval Benchmark
معيار تقييم يقيس قدرة النماذج على كتابة أكواد برمجية صحيحة وفعّالة.
معيار GSM8K
GSM8K Benchmark
معيار تقييم للتفكير الرياضي يحتوي على 8500 سؤال حسابي بمستوى المدارس.
معيار HellaSwag
HellaSwag Benchmark
معيار تقييم يختبر قدرة النماذج على إكمال جمل سياقية بشكل منطقي.
تحليل التحيز النشط
Active Bias Analysis
اكتشاف وقياس التحيزات في النموذج عبر اختبارات نشطة ومنتشرة.
اختيار العتبة
Threshold Selection
اختيار قيمة عتبة يفصل عندها النموذج بين الفئات أو بين الاكتشاف الصحيح والخطأ، ويوازن بين الدقة والاسترجاع وفق هدف المهمة.
أهمية الميزات
Feature Importance
تعيين درجة لكل ميزة تدل على مدى مساهمتها في تنبؤ النموذج، فيُعرف المتغيرات الأكثر تأثيرًا ويُتحقق من سلامة القرار وأسبابه.
النموذج البديل
Surrogate Model
نموذج بسيط قابل للتفسير يُدرَّب على تقليد مخرجات نموذج معقد، فيشرح قرارات الأخير بقواعد مفهومة للإنسان.
قواعد القرار
Decision Rules
قواعد «إن … فإن …» مستخلصة من سلوك النموذج تصف شروط الوصول إلى كل نتيجة، فيسهل التحقق من منطقية القرار وثباته.
حدود القرار
Decision Boundaries
الحدود التي يفصل عندها المصنّف بين الفئات في فضاء الميزات، ودراسة شكلها تكشف أين يخطئ النموذج وما إذا كانت ثقته مبالغًا فيها.
التفسير القائم على الأمثلة
Example-Based Explanation
تفسير قرار النموذج بإحضار الأمثلة التدريبية الأكثر شبهاً بالإدخال، وكأن النموذج يقول «صُنفت هكذا لأنها تشبه هذه الأمثلة».
تحليل الحساسية
Sensitivity Analysis
قياس مدى تغير مخرجات النموذج عند إزاحة الميزات أو البنود بمقادير صغيرة، فيُعرف المتغيرات الحساسة التي تستوجب الحذر في استخدامها.
تحليل الاضطراب
Perturbation Analysis
تعديل مدخلات النموذج بتحويرات مقصودة كالحذف أو إضافة ضجيج لملاحظة استقرار المخرجات، وكشف الاعتماد المفرط أو الهش في التصرف.
الثبات التفسيري
Explanation Stability
ثبات شرح قرار النموذج عند تقريب المثيلات أو تغيير عينة التدريب قليلًا، ويكون التفسير موثوقًا إذا لم يتقلب مع تذبذب طفيف.
اكتمال التفسير
Explanation Completeness
مدى تغطية عناصر التفسير لعوامل القرار الفعلية، بحيث لا تُهمل جوانب جوهرية هي التي قادت النموذج إلى نتيجته.
صحة الحقائق
Factuality
دقة الحقائق المقدمة في مخرجات النظام وقربها مما يكون منطقيًا وقابلًا للتحقق، وهو مقياس محوري لموثوقية نماذج اللغة.
الهلوسة
Hallucination
ظاهرة ظهور مخرجات خيالية غير مدعومة بالمدخلات وتتوهمها النماذج، ويُقاس مدى حدوثها ويُصارعها بالتوثيق والضبط.