معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 1-40 من 238 نتيجة — صفحة 1 / 6
الرؤية والكلام (40)
معالجة الصوت
Audio Processing
تحليل الإشارات الصوتية بالخوارزميات.
التعرف على الكلام
Speech Recognition
تحويل الصوت إلى نصوص مكتوبة.
معالجة الصور
Image Processing
تحليل وتحسين الصور الرقمية.
كشف الأجسام
Object Detection
تحديد مواقع الأجسام في الصور.
التمييز البصري
Visual Recognition
التعرف على الأنماط في المحتوى البصري.
التقسيم الدلالي
Semantic Segmentation
تصنيف كل بكسل في الصورة ضمن فئة دلالية.
تقدير العمق
Depth Estimation
تقدير المسافة والعمق من صورة ثنائية الأبعاد.
الرؤية المجهرية
Stereo Vision
استخدام صورتين لإدراك العمق والمسافات.
التدفق البصري
Optical Flow
اكتشاف حركة الأجسام بين إطارات الفيديو.
تقدير الوضعية
Pose Estimation
تحديد مواقع المفاصل والعضلات في الصور.
التعرف الضوئي على الحروف
Optical Character Recognition
تحويل النصوص في الصور إلى نصوص رقمية.
إعادة بناء المشهد
Scene Reconstruction
إعادة بناء المشهد ثلاثي الأبعاد من الصور.
التقسيم الشامل
Panoptic Segmentation
دمج التقسيم الكلي والدلالي في عملية واحدة.
التقسيم بالكيانات
Instance Segmentation
تمييز كل كيان في الصورة بشكل منفصل.
التوطين البصري
Visual Grounding
ربط الوصف النصي بالمناطق المقابلة في الصورة.
فهم مقاطع الفيديو
Video Understanding
فهم محتوى وسياق مقاطع الفيديو تلقائياً.
حقول الإشعاع العصبية
Neural Radiance Fields
تمثيل مشهد ثلاثي الأبعاد بشبكة عصبية.
الشبكات التوليدية البصرية
Visual GANs
شبكات توليدية متعارضة لإنشاء محتوى بصري.
اكتشاف المناطق الملفتة
Saliency Detection
تحديد المناطق التي تلفت الانتباه في الصور.
اكتشاف الشذوذ البصري
Visual Anomaly Detection
اكتشاف الانحرافات والشذوذ في الصور والفيديو.
تحويل النص إلى كلام
Text-to-Speech
تحويل النص إلى كلام مسموع.
تحويل الكلام إلى نص
Speech-to-Text
تحويل الكلام المسموع إلى نص مكتوب.
التعرف على المتحدث
Speaker Recognition
التعرف على هوية المتحدث من صوته.
التفريغ التلقائي
Automatic Transcription
تفريغ التسجيلات الصوتية إلى نص مكتوب تلقائياً.
تحليل نبرة الصوت
Prosody Analysis
تحليل نبرة ونبرة الصوت لاكتشاف المشاعر والنوايا.
تصنيف الأصوات
Sound Classification
تصنيف الأصوات المختلفة في ملفات الصوت.
تحسين الكلام
Speech Enhancement
تحسين جودة الإشارات الصوتية ووضوح الكلام.
تقليل الضوضاء
Noise Reduction
إزالة الضوضاء غير المرغوب منها من الإشارات الصوتية.
ترجمة الكلام
Speech Translation
ترجمة الكلام المنطوق في الوقت الحقيقي.
استنساخ الصوت
Voice Cloning
إنشاء نسخة صوتية تشبه صوت شخص معين.
كشف الكلمات المفتاحية
Keyword Spotting
اكتشاف كلمات محددة في التدفقات الصوتية.
أنظمة الحوار
Dialogue Systems
أنظمة تفاعلية للحوار التلقائي مع المستخدم.
تركيب الصوت
Audio Synthesis
توليد أصوات طبيعية جديدة باستخدام الذكاء الاصطناعي.
رسم خريطة تفعيل الفئات
CAM
تعلم تفعيل الفئات لتفسير قرارات التصنيف.
تحسين Grad-CAM
Grad-CAM
تحسينات على خريطة تفعيل الفئات باستخدام التدرجات.
تعلم DINO البصري الذاتي
DINO Vision
تعلم ذاتي للتمثيلات البصرية باستخدام DINO.
نموذج Florence المتعدد المهام
Florence
نموذج متعدد المهام البصرية من Microsoft.
محولات الرؤية
ViT
محولات متخصصة للمعالجة البصرية والصور.
كشف الأجسام DETR
DETR
كشف الأجسام باستخدام المحولات.
الشفاطات الذاتية المقنّنة
MAE
مشفرات ذاتية مقنّنة للتعلم البصري.