بحث من Nvidia يقترح نقل حالة KV Cache بين نماذج مختلفة باستخدام تحويلات خطية بدل إعادة احتساب السياق من الصفر. في التجارب، حققت الطريقة تسارعًا كبيرًا مع الاحتفاظ بجزء مرتفع من دقة النموذج الهدف، خصوصًا داخل عائلات نماذج متقاربة. إذا ثبتت عمليًا على نطاق واسع فقد تخفض كلفة أنظمة توجيه الطلبات بين نماذج متعددة.