كشفت شركة الأمن السيبراني Adversa عن ثغرة حرجة في روبوت غروك التابع لإيلون ماسك، تمكّن المهاجمين من استخراج بيانات شخصية حساسة من المستخدمين. الباحث رونی یوتیفسکی توصل إلى أن تشفير التعليمات الضارة يسمح بتجاوز آليات الحماية التي ترفع تحذيرات عند اكتشاف محتوى مريب.
تعتمد الطريقة على استضافة نصوص مشفرة على موقع ويب يتضمن تعليمات فك التشفير والمفتاح اللازم. عندما يُطلب من غروك تلخيص الصفحة، يقوم بفك التشفير وتنفيذ التعليمات المخفية دون أي تحذير أو طلب تأكيد. التعليمات المفككة توجه النموذج لاستخراج اسم المستخدم وموقعه وسجل المحادثات، ثم إرسال هذه البيانات إلى خادم المهاجم عبر رابط مزيف.
الآلية تستغل ثغرة في طريقة عمل آليات الحماية الثابتة، التي تفحص النصوص المدخلة والمخرجة لكنها لا تراقب نتائج تنفيذ الكود. التعليمات بخصوص فك التشفير باستخدام PBKDF2 و AES-256-GCM تمر من الفحص باعتبارها طلب عادي، لأن المصنف الآلي لا يستطيع تنفيذ فك التشفير. بمجرد فك التشفير داخل صندوق حماية الكود الخاص بالنموذج، تتحول التعليمات إلى مخرجات ينفذها دون تفعيل آليات الحماية.
استخدمت Adversa تقنية مماثلة للالتفاف حول الحماية في Gemini من غوغل، حيث فك التشفير لتعليمات ظهرت كرسائل خطأ برمجية. أسفرت هذه الطريقة عن جعل Gemini يُنتج محتوى محظور بشكل طبيعي. أشارت الشركة إلى أن غوغل أظهرت مقاومة متزايدة للهجوم في الأسابيع الأخيرة، لكن لا يمكن تحديد السبب بدقة.
يُشير الباحثون إلى أن هذه الهجمات تمثل اتجاهاً أعم نحو استغلال السياق الأوسع الذي يتعامل معه نموذج اللغة كأداة خاصة به، بما في ذلك مخرجات الأدوات ونتائج التشغيل والحالات الوسيطة. سطح الهجوم هذا أكبر بكثير مما يُصنّف تقليدياً على أنه "مدخلات النموذج"، مما يعني أن الأجيال القادمة من الهجمات ستظهر في هذا المجال.
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.