معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 41-80 من 238 نتيجة — صفحة 2 / 6
الرؤية والكلام (40)
إصدار DINOv2 المحسّن
DINOv2
إصدار محسّن من DINO للتعلم البصري.
نموذج Florence-2 المتقدم
Florence-2
نموذج متعدد المهام البصرية المتقدم من Microsoft.
نموذج SAM 2 المحسّن
SAM 2
نموذج تقسيم محسن للصور والفيديو.
وصف الصور تلقائياً
Image Captioning
وصف الصور تلقائياً باستخدام نصوص وصفية.
الإجابة عن أسئلة الصور
VQA
الإجابة عن أسئلة حول الصور باستخدام الذكاء الاصطناعي.
التمثيل التسلسلي للصور
Sequential Image Representation
تمثيل الصور كتسلسل من الرقائق لمعالجتها بنماذج اللغة.
تمثيل الصور متعدد الأوضاع
Multi-Modal Image Representation
تمثيل الصور مع السياق النصي لفهم المحتوى البصري والتواصلي.
تصنيف الصور
Image Classification
تصنيف الصور إلى فئات معرفة مسبقًا من خلال تعلم الأنماط البصرية، وهو أساس كثير من تطبيقات الرؤية الحاسوبية العملية.
التعرف على الوجوه
Face Recognition
التعرف على هوية الأشخاص من صور أو مقاطع وجوههم عبر استخراج سمات مميزة ومقارنتها بقاعدة بيانات معروفة، ويطبق في الأمان والتحقق والتوثيق.
التحقق البصري للهوية
Visual Identity Verification
التحقق من هوية الشخص من صورة وجهه أو مقاطع بصرية بمطابقة بصمته الوجهية، ويوفر طبقة إثبات تشبه شهادة المعاينة البصرية.
نمذجة الظل
Shadow Modeling
نمذجة شكل الظلال وسلوكها الضوئي في الصور والمشهد، لتحسين فهم التكوين المكاني وإعادة بناء الصور وإدماج العناصر فيها بشكل مقنع.
استعادة الألوان
Color Restoration
إعادة الألوان الصحيحة إلى صور قد بُهتت أو تغيرت بإزالة انزياحات اللون وتوازن الإضاءة، سواء عبر التدريب المعتمد على أمثلة أو القواعد الفيزيائية.
مطابقة الصور
Image Matching
مطابقة صورتين لنفس المشهد أو الكائن رغم اختلاف زاوية الالتقاط أو الإضاءة أو المقياس، وهو أساس التجميع البانورامي والتعرف على الأشياء.
تحليل الحركة
Motion Analysis
تحليل حركة الأجسام أو الأشخاص عبر تسلسل الأطر الزمنية لاستخراج مساراتها وأنماط سلوكها، ويطبق في المراقبة والرياضة والتفاعل البشري الروبوتي.
التصنيف الصوتي
Audio Classification
تصنيف الإشارات الصوتية إلى فئات كالكلام أو الموسيقى أو المؤثرات، عبر استخراج ميزات طيفية وزمنية وتعلم حدود الفئات.
التقاط الصوت
Audio Capture
التقاط الإشارة الصوتية من مصدرها وتحويلها إلى صيغة رقمية صالحة للمعالجة، بمراعاة جودة الميكروفون وضبط الكسب وتقليل التشويش.
تحليل الرنين
Resonance Analysis
تحليل ترددات الرنين في الصوت أو الآلات أو الغرف لاستنتاج خصائص المصدر، ويُستخدم في ضبط الصوت ومعالجة المواد.
المدى الترددي
Frequency Range
النطاق الترددي الذي تتراوح فيه الإشارة الصوتية أو الجهاز، ويحدد القدرة على تمثيل الترددات المنخفضة والعالية وإعادة إنتاجها بشكل أمين.
تعديل النطق
Articulation Adjustment
تعديل خصائص النطق كالدرجة والإيقاع والرنين لتحسين وضوح الكلام أو تغيير خصائصه المتحدثية ضمن تركيب كلامي مقصود.
كشف المشاعر
Emotion Detection
كشف الحالة العاطفية من الإشارات الصوتية أو الوجهية أو اللغوية، كتصنيف الكلام إلى فرح أو حزن أو غضب، ويستعمل في خدمة العملاء والصحة.
نسخ الموسيقى
Music Transcription
تحويل التسجيل الموسيقي إلى نوتة موسيقية مكتوبة، إذ يحدد النغمات والإيقاع والآلات من الصوت، ويسهل إعادة المونتاج والتعليم.
إيقاع الكلام
Speech Rhythm
تنظيم زمني للكلام يشمل سرعة المقاطع ومواضع الوقف ووزن العبارات، ويكون مفتاحًا للطبيعة والوضوح والفهم الطبيعي للكلام المركب.
التوطين الصوتي
Sound Localization
تحديد اتجاه مصدر الصوت وموقعه اعتمادًا على اختلاف وصول الإشارة بين الأذنين أو الميكروفونات، ويطبق في السمعيات والروبوتات.
تصنيع الأصوات
Sound Synthesis
توليد أصوات جديدة من نموذج رياضي للخصائص الطيفية والزمنية، كتصنيع أصوات آلات أو نغمات طبيعية أو كلام تركيبي.
التتبع متعدد الأجسام
Multi-Object Tracking
تتبع مسارات عدة أجسام متحركة عبر تسلسل الأطر وتمييزها عن بعضها معًا، فيتم الحفاظ على هوية كل جسم خلال المعالجة والمشاهد المزدحمة.
التعرف مفتوح المفردات
Open-Vocabulary Recognition
التعرف على الأشياء أو عوائد الفئات غير المحدودة مسبقًا بشكامل القائمة، عبر مطابقة المرئي بالوصف النصي أو فضاء مفتوح، فألهم ثنائية الفئات.
التعلم البصري ذاتي الإشراف
Self-Supervised Vision
تعلم البصر من الصور نفسها عبر إعطاء أهداف ذاتية من الصور كإعادة بناء أو تنبؤ، فيغني النموذج عن التسميات البشرية المكلفة.
فهم المشهد
Scene Understanding
فهم المشهد الشامل من المحتوى المرئي: ما الأشياء، ومعها العلاقات والسياقات والأنشطة، ليشكل وعاءً لاتخاذ القرار في النظم الذكية.
استعادة الصور
Image Restoration
الترميم الكامل للصور التالفة أو المفقودة منها أو المشوهة، عبر إعادة بناء المناطق المفقودة وجعل النتيجة طبيعية ونسيجية متناسقة.
التعرف التلقائي على الكلام
Automatic Speech Recognition
تحويل الإشارة الصوتية الكلامية تلقائيًا إلى نص مكتوب، بفك رموز الأصوات إلى كلمات مع مراعاة اللهجات والخلفية الضوضائية.
تركيب الكلام
Speech Synthesis
تركيب كلام اصطناعي طبيعي من النص، فتولَّد إشارات صوتية تحاكي النطق البشري بالنبرة والإيقاع والوضوح.
إزالة الضوضاء
Speech Denoising
تنقية الكلام بفصل الإشارة الصوتية المرادة عن الضوضاء والتشويش المحيط، فيرتفع وضوحه ويسهل تحليله أو سماعه.
كشف النشاط الصوتي
Voice Activity Detection
كشف وجود أو غياب نشاط كلامي في إشارة صوتية، ليُفصل فترات الكلام عن الصمت والضوضاء ويُدار تشغيل النظم الصوتية بكفاءة.
نمذجة الصوت
Audio Modeling
نمذجة الخصائص الطيفية والزمنية للصوت بتدريب نماذج تلتقط بنيته الدلالية، فيُبنى عليها التصنيف والتوليد وعزل المصادر.
توليد المؤثرات الصوتية
Sound Effect Generation
توليد مؤثرات صوتية غير موجودة في التسجيل الأصلي بصورة مقنعة حسب الوصف أو الفعل المراد، لإثراء المحتوى والألعاب والسينما.
سؤال-إجابة بصرية
Visual Question Answering
الإجابة عن سؤال حول محتوى صورة.
وحدة التعلم البصري المتقابلة
CLIP
نموذج يربط الصور بالنصوص في فضاء واحد لتشابه شامل.
التمييز بين المتحدثين
Speaker Diarization
تحديد من تحدث ومتى ضمن تسجيل يتضمن عدة أصوات.
تحويل الصوت
Voice Conversion
نقل صوت المستخدم إلى صوت شخص آخر مع حفظ الكلام والمضمون.
تحديد مولد الصور
Deepfake Detection
تمييز المحتوى المصطحب المزور آليًا عن الحقيقي.