أعلنت غوغل ديبماينds عن مبادرة لحل مشكلة أساسية في تقييم نماذج الذكاء الاصطناعي، تتمثل في اطلاع النموذج على أسئلة الاختبار خلال مرحلة التدريب، مما يجعل النتائج غير موثوقة حتى لو حققت درجة مثالية.
تعتمد الحل على تقنية تشفيرية تحمي بيانات الاختبار في صندوق رقمي محصن، بحيث يستحيل على النموذج الوصول إليها لاحقًا لتحسين أدائه فيها. في المرحلة التجريبية، تختبر الشركة نموذجًا من عائلة جيميني فلاش لايت ضد معايير سرية، بالتعاون مع معهد سنغافورة لسلامة الذكاء الاصطناعي وشركاء آخرين.
تاريخيًا، واجهت التقييمات الحساسة الخارجية معضلة صعبة: إما أن تسلم المقيمون أسئلتهم لمزود النموذج فيراها مسبقًا، أو يسلم مزود النموذج أوزانه الداخلية ويخاطر بملكيته الفكرية. كمثال على هذا التضارب، تأخر تقييم معيار ARC-AGI لنموذج Fable 5 من Anthropic بسبب سياسة الشركة بحفظ بيانات نماذجها الأقوى لمدة 30 يومًا فقط.
تستخدم غوغل تقنية Confidential Space من محفظة الحوسبة الآمنة لديها، بحيث تتحقق تشفيرًا من بقاء بيانات الاختبار والنموذج محميين لمالكيهما. المقيم لا يرى أوزان جيميني، وغوغل لا ترى أسئلة الاختبار. وتمثل الحماية التقنية والتشفيرية قفزة كبيرة عن الاعتماد السابق على بروتوكولات عدم التسجيل والضمانات التعاقدية وحدها.
ترى غوغل أن هذه الخطوة حاسمة خاصة للتقييمات الحساسة جدًا، كاختبارات الأمن السيبراني والتقييمات التي تجريها الجهات الحكومية. يمكن للمنظمات المستقلة اختبار النماذج المتقدمة بصرامة دون التضحية بسيادة بيانات الاختبار أو أمانها. تأمل الشركة أن تحدد هذه المبادرة معايير جديدة لمراقبة النماذج وتساهم في بناء أنظمة ذكاء اصطناعي أكثر موثوقية وثقة.
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.