معجم الذكاء الاصطناعي
5,046 مصطلحًا مُفسَّرًا بالعربي في الذكاء الاصطناعي
عرض 41-80 من 119 نتيجة — صفحة 2 / 3
معالجة اللغات الطبيعية (40)
فهم القراءة متعدد الجمل (MultiRC)
multi-sentence reading comprehension (multirc)
مجموعة بيانات لتقييم قدرة نموذج لغوي كبير على الإجابة عن تمارين الاختيار من متعدد؛ يتضمن كل مثال في المجموعة فقرة وأسئلة متعددة عنها.
فهم اللغة الطبيعية
natural language understanding
مجموعة فرعية من معالجة اللغة الطبيعية تحدد مقاصد ما يُقال أو يُكتب؛ ويمكن أن تتجاوز معالجة اللغة الطبيعية لتراعي جوانب معقدة من اللغة مثل السياق والسخرية والمشاعر.
n-غرام
n-gram
تتابع مرتب من الكلمات بعدد N؛ فمثلًا truly madly غرام ثنائي، ولأن الترتيب مهم فإن madly truly غرام ثنائي مختلف.
فهم اللغة الطبيعية (NLU)
nlu
اختصار لـ natural language understanding (فهم اللغة الطبيعية).
غير حتمي
nondeterministic
نظام لا يُضمن إرجاع المخرجات نفسها لمدخل معيّن؛ فنماذج اللغة الكبيرة غير حتمية عموماً إذ تولّد استجابات مختلفة لنفس المطال.
الضبط الفعّال في استهلاك البارامترات
parameter-efficient tuning
مجموعة تقنيات لضبط نموذج لغوي كبير مُدرَّب مسبقًا بكفاءة أعلى من الضبط الكامل؛ إذ تضبط عادةً بارامترات أقل بكثير، مع إنتاج نموذج لغوي كبير يقدم أداءً مساويًا (أو شبه مساوٍ) لنموذج الضبط الكامل.
النموذج المُدرَّب مسبقاً
pre-trained model
رغم أن المصطلح قد يشير إلى أي نموذج مُدرَّب أو متجه تضمين مُدرَّب، فإنه يُستخدم اليوم للإشارة عادةً إلى نموذج لغوي كبير مُدرَّب أو أي شكل من نماذج الذكاء الاصطناعي التوليدية المُدرَّبة.
الاحتمالي
probabilistic
بشكل عام، أي موقف تُتخذ فيه القرارات بناءً على الاحتمالات أو الأرجحية؛ نماذج اللغة الكبيرة أنظمة احتمالية تولّد الكلمة أو الجملة التالية في الاستجابة بناءً على الاحتمالات.
التعلم القائم على المطالبات
prompt-based learning
قدرة بعض النماذج على تكييف سلوكها استجابةً لنص إدخال عشوائي (مطالبات)؛ في النمط النموذجي لهذا التعلم يستجيب نموذج لغوي كبير لمطالبة بتوليد نص.
مجموعة بيانات القراءة والفهم مع الاستدلال بالفطرة السليمة (ReCoRD)
reading comprehension with commonsense reasoning dataset (record)
مجموعة بيانات لتقييم قدرة نموذج اللغة الكبير على أداء الاستدلال بالفطرة السليمة. يحتوي كل مثال في المجموعة على ثلاثة مكونات:
مطالبات السمية الحقيقية (RealToxicityPrompts)
realtoxicityprompts
مجموعة بيانات تحتوي بدايات جمل قد يتضمن بعضها محتوى ساماً؛ تُستخدم لتقييم قدرة نموذج لغوي كبير على توليد نص غير سام لإكمال الجملة.
التعرف على الاستلزام النصي (RTE)
recognizing textual entailment (rte)
مجموعة بيانات لتقييم قدرة نموذج اللغة الكبير على تحديد ما إذا كان يمكن استلزام فرضية (استنتاجها منطقيًا) من مقطع نصي. يتكون كل مثال في تقييم RTE من ثلاثة أجزاء:
التوليد المعزز بالاسترجاع
retrieval-augmented generation (rag)
تقنية لتحسين جودة مخرجات نموذج اللغة الكبير بتثبيتها بمصادر معرفة تُسترجع بعد تدريب النموذج؛ إذ ترفع دقة إجابات النموذج بمنحه إمكان الوصول إلى معلومات مسترجعة من قواعد معرفية أو وثائق موثوقة.
ROUGE-N
rouge-n
مجموعة مقاييس ضمن عائلة ROUGE تقارن النون-جرامات المتشاركة من حجم معين في النص المرجعي والنص المولد.
رُوج-S (ROUGE-S)
rouge-s
شكل متسامح من ROUGE-N يتيح مطابقة تخطّي الكلمات (skip-gram). أي إن ROUGE-N يعدّ فقط N-grams المطابقة تمامًا، بينما يعدّ ROUGE-S أيضًا N-grams يفصل بينها كلمة واحدة أو أكثر. تأمل ما يلي:
التسجيل
scoring
الجزء من نظام التوصية الذي يوفر قيمة أو ترتيبًا لكل عنصر أنتجته مرحلة توليد المرشحين.
الذاكرة الدلالية
semantic memory
المعلومات التي يحملها نموذج لغوي كبير عند انتهاء تدريبه؛ وتشمل الذاكرة الدلالية إتقاناً ممتازاً للقواعد والمفردات والحقائق التي دُرّب عليها صراحةً.
مهمة التسلسل إلى تسلسل
sequence-to-sequence task
مهمة تحوّل سلسلة رموز إدخال إلى سلسلة رموز إخراج؛ ومن أشهر نوعيها الترجمة الآلية والتلخيص.
تخطّي الكلمات (Skip-gram)
skip-gram
إنغرام قد يحذف (أو «يتخطى») كلمات من السياق الأصلي، ما يعني أن الكلمات N قد لا تكون متجاورة في الأصل. وبشكل أكثر دقة، «k-skip-n-gram» هو إنغرام قد تُتخطى فيه حتى k من الكلمات.
مجموعة بيانات SQuAD
squad
اختصار لـ Stanford Question Answering Dataset (مجموعة أسئلة وأجوبة ستانفورد)، المقدمة في ورقة بحثية بعنوان «SQuAD: 100,000+ Questions for Machine Comprehension of Text». جاءت الأسئلة في هذه المجموعة من أشخاص يطرحون أسئلة حول مقالات ويكيبيديا.
التوكن دون-كلمة
subword token
في النماذج اللغوية، توكن يمثل جزءًا فرعيًا من كلمة، وقد يكون الكلمة كلها.
سوبر جلو (SuperGLUE)
superglue
مجموعة من مجموعات البيانات لتقييم القدرة الإجمالية لنموذج لغوي كبير على فهم النص وتوليده.
المدى النصي
text span
مدى فهرس المصفوفة المرتبط بقسم فرعي محدد من سلسلة نصية. كلمة good في سلسلة بايثون s="Be good now" تشغل المدى النصي من 3 إلى 6.
الرمز (التوكن)
token
في النموذج اللغوي، الوحدة الذرية التي يتدرب عليها النموذج ويتنبأ بها؛ وعادة ما يكون التوكن أحد الأشكال المحددة.
ثلاثي الغرام
trigram
غرام من النوع N حيث N يساوي 3.
الإجابة عن الأسئلة المعرفية
trivia question answering
مجموعات بيانات لتقييم قدرة نموذج اللغة الكبير على الإجابة عن أسئلة المعلومات العامة؛ إذ يحتوي كل منها أزواج أسئلة وأجوبة أعدّها عشاق المعلومات.
مجموعة بيانات TyDi QA
typologically diverse question answering (tydi qa)
مجموعة بيانات كبيرة لتقييم كفاءة نموذج اللغة الكبير في الإجابة عن الأسئلة. تحتوي المجموعة على أزواج من الأسئلة والأجوبة بلغات عديدة ومتنوعة طرازيًا.
أحادي الاتجاه
unidirectional
نظام يقيّم النص الذي يسبق جزء النص المستهدف فقط؛ على النقيض، يقيّم النظام ثنائي الاتجاه النص الذي يسبق موقع النص المستهدف ويليه.
نموذج لغوي أحادي الاتجاه
unidirectional language model
نموذج لغوي يبني احتمالاته على الرموز التي تسبق الرمز (الرموز) الهدف فقط لا التي تليه؛ على نقيض النموذج اللغوي ثنائي الاتجاه.
تحدي مخططات وينوغراد
winograd schema challenge (wsc)
صيغة (أو مجموعة بيانات متوافقة مع تلك الصيغة) لتقييم قدرة نموذج اللغة الكبير على تحديد العبارة الاسمية التي يحيل إليها الضمير.
تضمين الكلمات
word embedding
إطار شائع لتمثيل البيانات النصية باعتبارها متجهات، استُخدم في كثير من مهام التعلم الآلي ومعالجة اللغة الطبيعية؛ فهو يضمّن كل كلمة (أو عبارة شائعة) كمتجه أبعاده d، ويعمل كمعجم للبرامج الراغبة في استخدام معنى الكلمات.
مجموعة XL-Sum
xl-sum (xlsum)
مجموعة بيانات لتقييم كفاءة نماذج اللغة الكبيرة في تلخيص النصوص، وتوفر مدخلات في لغات متعددة.
الوكيل المحادث
conversational agent
نظام يجري حوارات طبيعية مع المستخدم لإنجاز مهام أو إجابة أسئلة.
مصفوفة ويغنر العشوائية
wigner random matrix
مصفوفة متماثلة مربعة مدخلاتها متغيرات عشوائية مستقلة وموزعة توزيعاً متطابقاً؛ وتشكل اللبنة الأساسية في نظرية المصفوفات العشوائية بفضل سلوك طيفها (قانون نصف الدائرة).
قاعدة السلسلة
chain rule
قاعدة حسابية لتفاضل الدوال المركبة بينكّن الانتشار الخلفي من حساب المشتقات الجزئية.
توزيع ماكسويل-بولتزمان
maxwell-boltzmann distribution
توزيع احتمالي يُستخدم لوصف سرعات الجسيمات المختلفة داخل حاوية ساكنة عند درجة حرارة محددة؛ فباختصار يبين الرسم البياني عدد الجزيئات لكل وحدة سرعة.
دوال توليد العزوم
moment generating functions
دالة توليد العزوم دالة تعريفية لخصائص توزيع احتمالي؛ إذ تولّد مشتقاتها العزومَ المختلفة للتوزيع وتحدد بذلك توزيعه بشكله الفريد.
الإنغرامات (N-Grams)
n-grams
الإنغرام سلسلة متصلة من N عنصرًا من عينة نص أو كلام. قد يتألف الإنغرام من كتل كبيرة من الكلمات أو مجموعات أصغر من المقاطع.
قاعدة القرار المقبولة
admissible decision rule
دالة لاتخاذ القرار تحدد مسار الإجراء المتاح الذي يولّد دائماً أفضل نتيجة؛ أي قاعدة لا توجد قاعدة أخرى أفضل منها في جميع الحالات الممكنة.
مولّد الصور الشخصية بالذكاء الاصطناعي
ai headshot generator
صور شخصية احترافية في دقائق لك أو لفريقك.