معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 1-40 من 103 نتيجة — صفحة 1 / 3
البيانات والاسترجاع (40)
الذكاء الاصطناعي المتمحور حول البيانات
Data-Centric AI
تحسين جودة البيانات بدلاً من النموذج.
تصنيف البيانات يدوياً
Human Annotation
تصنيف البيانات وتوسيمها يدوياً بواسطة البشر.
البيانات الاصطناعية
Synthetic Data
بيانات مولدة اصطناعياً لتدريب النماذج.
التعلم النشط
Active Learning
تعلم يختار البيانات الأكثر أهمية للتصنيف.
معالجة أخطاء البيانات
Data-Centric Debugging
إصلاح مشاكل البيانات بدلاً من تعديل النموذج.
انتشار التسميات
Label Propagation
انتشار التسميات في بيانات غير معلمة.
الإشراف الضعيف
Weak Supervision
استخدام تسميات ضعيفة أو غير دقيقة لتدريب النماذج.
إكثار البيانات النصية
Text Augmentation
إكثار البيانات النصية لتنويع التدريب وتحسين الأداء.
إطار عمل Snorkel
Snorkel
إطار لإنشاء بيانات معلمة ضعيفة برمجياً.
مقاييس جودة البيانات
Data Quality Metrics
مقاييس لتقييم جودة ودقة البيانات المستخدمة في التدريب.
إصدارية البيانات
Data Versioning
إدارة وإصدار إصدارات مختلفة من مجموعات البيانات.
التقييم المتمحور حول البيانات
Data-Centric Evaluation
تقييم تأثير جودة البيانات على أداء النموذج.
التصنيف البرمجي
Programmatic Labeling
تصنيف البيانات بشكل برمجي باستخدام قواعد.
تقطير مجموعات البيانات
Dataset Distillation
تقطير مجموعات البيانات لتقليل الحجم مع الحفاظ على المعلومات.
تقسيم البيانات التكيفي
Adaptive Data Partitioning
تقسيم البيانات بشكل تكيّفي لتحسين توزيع الحمل.
التشابه الكوسيني
Cosine Similarity
مقياس تشابه بين متجهين يحسب جيب تمام الزاوية بينهما ويراوح بين 1 و1، ويُستخدم لمقارنة التضمينات واسترجاع المتجهات الأقرب دلاليًا.
توثيق المصادر
Source Citation
إرفاق كل مقطع ينتجه النظام المستند إلى الاسترجاع بمرجعه الأصلي في الوثائق، فيستطيع المستخدم تدقيق المعلومة والاطمئنان لمصداقية الإجابة.
الاسترجاع متعدد القفزات
Multi-Hop Retrieval
استرجاع يُجزَّأ فيه السؤال إلى أسئلة فرعية ويُبحث في كل خطوة عن أدلة، ثم تُجمع الأدلة المتتالية للإجابة على سؤال مركّب يتطلب ربط معلومات من مواضع متعددة.
ترتيب الوثائق
Document Ranking
ترتيب الوثائق المسترجعة وفق درجة تشابهها مع الاستعلام، فيُعرض الأقرب أولًا وتُحسم المنافسة بين المقاطع المتقاربة دلاليًا.
تجميع الاسترجاع
Retrieval Fusion
الجمع بين نتائج عدة مصادر استرجاع أو استعلامات متوازية في قائمة موحّدة بمعايير وأوزان متفق عليها، لتحسين الترتيب ورفع تغطية المعلومة الصحيحة.
تجزئة الوحدات
Unit Chunking
تقطيع المستندات إلى قطع صغيرة متناسقة قبل فهرستها، فيسهل مطابقتها للاستعلام ويسترد النظام قطعة الأدق دون اقتطاع المعنى.
الاسترجاع السياقي
Contextual Retrieval
استرجاع يُثري كل قطعة قبل تخزينها بوصف سياقي يستند إلى المستند الكامل، فيتحسن تمييز القطع المتشابهة ويقل الخلط في المعنى.
المساحة المتجهية
Vector Space
فضاء رياضي تُمثَّل فيه الكلمات والجمل متجهات عددية، ويكون القرب فيها معبرًا عن التشابه الدلالي، وعليه تُبنى عمليات البحث والتجميع ومقارنة الدلالات.
استيعاب البيانات
Data Ingestion
استقبال البيانات من مصادر خارجية متنوعة وتحويلها إلى صيغة موحدة وتخزينها الأولي في مسار البيانات، بشكل آلي أو بجدولة زمنية.
تحويل البيانات
Data Transformation
تحويل البيانات الخام من شكلها الأصلي إلى شكل ملائم للتحليل أو التدريب من تنظيف وإعادة تنسيق وحساب ميزات وتخزين بنيوي.
تخزين البيانات
Data Storage
استبقاء البيانات في مخزن منظم ومهيّأ للمعالجة والاسترجاع، مع موازنة بين كلفة التخزين وسرعة الوصول واشتراطات الأمان.
استرجاع البيانات
Data Retrieval
استخراج البيانات المطلوبة من المخزن وفق معايير محددة بسرعة ودقة، وتهيئتها للاستخدام الفوري في التحليل أو العرض.
تقسيم البيانات الموزّع
Data Partitioning
توزيع مجموعة بيانات كبيرة على أقسام مترابطة تبعًا لمعايير منطقية أو زمنية، لتسهيل الوصول والمعالجة المتوازية دون فقدان الترابط بينها.
دورة حياة البيانات
Data Lifecycle
مراحل حياة البيانات من الاستحواذ والتنقية والتخزين والاستخدام والأرشفة إلى الإتلاف النهائي، مع ضوابط تتبع في كل مرحلة.
النسخ الاحتياطي للبيانات
Data Backup
إنشاء نسخ من البيانات على فترات منتظمة وفي مواقع منفصلة، لاستعادتها عند التلف أو فقدان النسخة الرئيسية دون خسارة دائمة.
أرشفة البيانات
Data Archiving
نقل البيانات القديمة غير النشطة إلى تخزين منخفض الكلفة مع بقاء إمكان وصول منظم إليها، تلبيةً لمتطلبات الامتثال دون إبطاء الأنظمة النشطة.
البيانات الاصطناعية الصوتية
Synthetic Speech Data
بيانات كلام مولّدة اصطناعيًا بأصوات ولهجات متغيرة، لإثراء تدريب أنظمة الكلام دون الاعتماد كليًا على تسجيلات بشرية مكلفة.
البيانات الاصطناعية الفيديو
Synthetic Video Data
مقاطع فيديو مولّدة بنمذجة مشاهد وسلوكيات في بيئات محاكاة، لتدريب الرؤية الحاسوبية على مواقف نادرة أو خطيرة يصعب الحصول عليها حقيقيًا.
تنقية الاصطناع
Synthetic Refinement
تحسين البيانات المُولَّدة بتحويرات وضبط لرفع واقعيتها وتباينها، فيرتفع أثرها في تدريب نماذج أكثر متانة.
تحقق الاصطناع
Synthetic Validation
التحقق من جودة البيانات الاصطناعية ومطابقتها للتوزيع الحقيقي قبل استخدامها في التدريب، تفاديًا لانحياز قد تنقلها بيانات مولدة.
تسمية الاصطناع
Synthetic Labeling
إنتاج البيانات الاصطناعية أو تسميتها آليًا بالاستناد إلى معرفة التوليد نفسها، لتوفير تسميات نظيفة دون يَدٍ بشرية مكلفة.
إحصاءات الاصطناع
Synthetic Statistics
قياس خصائص البيانات المولدة من توزيع وتباين وارتباطات ومقارنتها بإحصاءات البيانات الحقيقية لضمان تماثل صفاتها قبل الاعتماد عليها.
أخذ العينات الاصطناعي
Synthetic Sampling
توليد عينات اصطناعية مستهدفة لمواقف معينة أو نادرة، أو لمعالجة توازن المجموعات المتوازنة، وفق توزيع مرغوب فيه.
الترميز الاصطناعي
Synthetic Encoding
ترميز البيانات الحقيقية أو مدّها بطرائق اصطناعية كالتحوير أو المزج، لرفع تنوع التدريب دون تكرار للبيانات الأصلية.
مزج العينات
Sample Mixing
دمج أمثلة تدريب متعددة أو مزج خصائصها لإنتاج أمثلة جديدة أبسط، يحسن الاستمرارية والتعميم ويُعد أساس تقنيات من قبيل mixup.