طورت شركة OneAdvanced، المتخصصة في تقديم برمجيات الإدارة للقطاعات المنظمة، نظاماً متقدماً لنشر وكلاء الذكاء الاصطناعي على بنية حوسبة سيادية بالكامل في المملكة المتحدة. اختارت الشركة استضافة نماذج Llama 4 Maverick و Llama Guard 4 ذاتياً على منصة Amazon SageMaker AI، بدلاً من الاعتماد على الخدمات المدارة، لضمان عدم مغادرة بيانات العملاء للحدود البريطانية.

يشمل الحل أربعة مكونات رئيسية: نظام vLLM لتشغيل النماذج على معالجات p5.48xlarge في منطقة لندن، وأكثر من 50 وكيل متخصص يعمل على Amazon ECS مع تخزين الإعدادات في DynamoDB، وأنظمة استرجاع مستندات معتمدة على قواعد PostgreSQL مع امتداد pgvector، وأدوات تعمل على Amazon ECS. تحمي نموذج Llama Guard 4 المدخلات من المحتوى الضار قبل وصولها للنموذج الرئيسي.

تمكنت الشركة من بناء مكتبتها الضخمة من الوكلاء في ثلاثة أسابيع فقط، حيث تم تطوير معظم الوكلاء في أقل من يوم واحد. غطت هذه الوكلاء تطبيقات متنوعة في الرعاية الصحية والقانون والموارد البشرية واللوجستيات، بما فيها مساعد الحوادث الطبية وملخص نقاط السلامة السريرية وأداة مقارنة المستندات.

اختارت OneAdvanced إطار عمل Strands Agents SDK بعد تقييم خيارات متعددة، لأنه يتبنى نهجاً موجهاً بالنموذج ويدعم التفاعلات الحوارية والمقابلات، مما سمح بالانتقال السريع من الفكرة إلى النشر الفعلي. بنت الشركة أيضاً أداة بدون أكواد لإنشاء وكلاء جديد، تمكن مديري المنتجات والمحللين من تصميم وكلاء دون الحاجة لكتابة أكواد برمجية.

يستخدم النظام نموذج التضمين intfloat/multilingual-e5-large-instruct للدعم متعدد اللغات، وطورت OneAdvanced نظام استرجاع مستندات خاص بها اسمه "Llamadex" يمنحها تحكماً كاملاً على عملية البحث والاسترجاع. يدعم النظام نوافذ سياق موسعة بحجم 120 ألف إلى 128 ألف رمز لمعالجة الملفات الضخمة والحوارات متعددة الجولات.