أطلقت Amazon Web Services إرشادات تقنية حول كيفية تقليل التكاليف عند استخدام وكلاء الذكاء الاصطناعي في خطوط العمل الآلية. المشكلة الأساسية أن الوكلاء يستغرقون وقتًا في التفكير قبل الإجابة، وإذا احتفظت دالة حوسبة مثل Lambda بالتواصل مفتوحًا في الانتظار، تُفرض عليك فواتير مقابل كل ثانية خمول، بينما وكيل AgentCore نفسه لا يفرض رسومًا على وحدة المعالجة المركزية أثناء الانتظار.

قدمت الشركة ثلاثة أنماط لحل هذه المشكلة. النمط الأول يستخدم رمز مهمة Step Functions: تستدعي دالة Lambda الوكيل برمز التفويض ثم تعود فورًا، بينما يبقى تنفيذ Step Functions معلقًا بدون فرض رسوم على الحوسبة حتى ينتهي الوكيل. النمط الثاني يزيل دالة Lambda من المسار تماما، بحيث يستدعي Step Functions وكيل AgentCore مباشرة عبر تكامل AWS SDK الأصلي، مما يوفر على Lambda وعلى التعقيد. النمط الثالث يستخدم دوال متينة: برنامج واحد يحتوي على خط العمل بالكامل لكن يعلق نفسه أثناء الانتظار دون فرض رسوم على الحوسبة.

أوضحت الشركة أن الوكيل ذاته يمكنه التعامل مع الأنماط الثلاثة جميعها دون تعديل أو إعادة نشر. عند الانتهاء من التفكير، يستدعي الوكيل دالة Lambda (في النمط الأول فقط) لترسل النتيجة ورمز المهمة إلى Step Functions. فرق التطوير يحتاج فقط لتغيير طريقة استدعاء الوكيل وليس الوكيل نفسه.

قدمت AWS أيضًا جدول مقارنة يوضح التبادلات بين الأنماط الثلاثة. النمط الثاني الذي يزيل Lambda بالكامل هو الأكثر كفاءة من حيث التكلفة إذا لم تكن بحاجة إلى منطق مخصص. وحذرت الشركة من ضرورة تعيين مهلة زمنية على كل حالة انتظار منعًا لتعليق الوكيل بلا نهاية.