معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 81-120 من 477 نتيجة — صفحة 3 / 12
بنية النماذج والتحسين (40)
الانتباه الخامل
Sparse Attention
انتباه خامل لتحسين الكفاءة الحسابية والذاكرة.
الانتباه الخطي
Linear Attention
انتباه خطي لتقليل التعقيد الحسابي.
الانتباه بالنافذة
Windowed Attention
انتباه بنافذة محدودة لتقليل التعقيد الحسابي.
انتباه المرساة
Attention Sink
طريقة لتقليل استهلاك الذاكرة عبر رموز المرساة.
شبكة التغذية الأمامية المحصنة
Gated FFN
شبكة تغذية أمامية ببوابات لتنظيم تدفق المعلومات.
تنفيذ الانتباه والشبكة بالتزامن
Parallel Attention FFN
تنفيذ الانتباه والشبكة الأمامية بالتزامن لتسريع التدريب.
المعالجة المسبقة بالقطعة
Chunked Prefill
معالجة المدخلات الطويلة على أجزاء متتالية.
الانتباه الشعاعي
Radix Attention
انتباه شعاعي لتحسين استخدام الحساب المتكرر.
الانتباه الهجين
Hybrid Attention
دمج أنواع مختلفة من آليات الانتباه لتحسين الأداء.
ضغط التخزين المؤقت
KV Cache Compression
ضغط التخزين المؤقت لتحسين الكفاءة.
قص النموذج
Model Pruning
قص الأوزان غير الضرورية لتقليل الحجم.
القص المنظم
Structured Pruning
قص منظمة للطبقات والأعصاب غير الضرورية.
مشاركة الأوزان
Weight Sharing
مشاركة الأوزان بين الطبقات لتقليل المعلمات.
تخزين النماذج المؤقتة
Model Caching
تخزين النماذج المؤقتة لتسريع الاستجابة.
الدفع المستمر
Continuous Batching
دفع متواصل لتحسين كفاءة الخادم.
تحسين المعالجة المسبقة
Prefill Optimization
تحسين مرحلة المعالجة المسبقة للمدخلات.
تحسين الاستخراج التسلسلي
Decode Optimization
تحسين مرحلة التوليد التسلسلي.
تعددية النموذج للاستدلال
Inference Model Parallelism
توزيع أجزاء النموذج أثناء الاستدلال.
خادم vLLM الفعال
vLLM
خادم فعال لاستدلال نماذج اللغة.
تحسين TensorRT-LLM
TensorRT-LLM
تحسين NVIDIA لاستدلال نماذج اللغة.
إطار SGLang للتوليد
SGLang
إطار توليد متسلسل فعال.
تنفيذ llama.cpp
llama.cpp
تنفيذ فعال لنماذج Llama بلغة C.
التحويل الكمي GGUF
GGUF Quantization
تحويل كمي بتنسيق GGUF للنماذج.
التحويل الكمي GPTQ
GPTQ Quantization
تحويل كمي GPTQ للنماذج الكبيرة.
التحويل الكمي AWQ
AWQ Quantization
تحويل كمي فعال بالوزن النشط.
التشكيل الديناميكي للدفعات
Dynamic Batching
تشكيل دفعات ديناميكي لتحسينthroughput.
جدولة طلبات الاستدلال
Request Scheduling
جدولة طلبات الاستدلال لتحسين أداء الخادم.
تجميع النموذج
Model Compilation
تجميع النموذج لتحسين الأداء والاستدلال.
تحليل أداء الاستدلال
Inference Profiling
تحليل أداء الاستدلال لتحديد العوائق.
الاستدلال الجماعي
Batch Inference
استدلال جماعي للبيانات لتحسين الكفاءة.
الاستدلال في الوقت الحقيقي
Real-time Inference
استدلال في الوقت الحقيقي لتطبيقات الاستجابة السريعة.
تحسين تكلفة الاستدلال
Inference Cost Optimization
تحسين تكلفة عملية الاستدلال والحساب.
تحسين زمن الاستجابة
Latency Optimization
تحسين زمن استجابة النظام لطلبات المستخدمين.
تحسين معدل المعالجة
Throughput Optimization
تحسين معدل المعالجة الإجمالي للنظام.
الاستدلال الفعال في الذاكرة
Memory-efficient Inference
استدلال فعال في استخدام موارد الذاكرة.
الشبكات المدعمة بالذاكرة
Memory Networks
شبكات عصبية مدعمة بذاكرة خارجية لتخزين المعلومات.
الشبكات التوأم
Siamese Networks
شبكات توأم للمقارنة بين عينات مشابهة.
شبكات الكبسولات
Capsule Networks
شبكات الكبسولات لفهم العلاقات المكانية.
الشبكات العصبية للرسوم البيانية
GNN
شبكات عصبية متخصصة للرسوم البيانية.
المعادلات التفاضلية العصبية
Neural ODE
شبكات عصبية كمعادلات تفاضلية عادية.