بحث من Nvidia يقترح نقل حالة KV Cache بين نماذج مختلفة باستخدام تحويلات خطية بدل إعادة احتساب السياق من الصفر. في التجارب، حققت الطريقة تسارعًا كبيرًا مع الاحتفاظ بجزء مرتفع من دقة النموذج الهدف، خصوصًا داخل عائلات نماذج متقاربة. إذا ثبتت عمليًا على نطاق واسع فقد تخفض كلفة أنظمة توجيه الطلبات بين نماذج متعددة.
باحثون يميزون بين أضرار الذكاء الاصطناعي الحالية ومخاطر الفناء النظرية
بحسب Businesstoday، يعرض التقرير أن باحثون يميزون بين أضرار الذكاء الاصطناعي الحالية ومخاطر الفناء النظرية. وتقدم المادة النتائج في سياقها العملي، مع…
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.