لم تطبق أي شركة متخصصة في الذكاء الاصطناعي مجمل الإجراءات الأساسية للسيطرة على أنظمتها الداخلية، وفقًا لأول تقييم صادر عن منظمة غيدلايت غير الربحية. اعتمدت المنظمة على مصادر عامة متاحة مثل بطاقات الأنظمة والتقارير الأمنية والمنشورات في فحص ممارسات Anthropic و OpenAI و Google و xAI و Meta.
ركز التقييم على ستة ممارسات أساسية تشمل تسجيل نشاط الأنظمة الداخلية وفرض آليات المراجعة قبل تنفيذ الإجراءات الحساسة وآليات التوقف الطارئ المعروفة باسم "circuit breaking" ووضع خطط لمعالجة الأنظمة غير المتوافقة. حققت Anthropic و OpenAI أفضل النتائج برصيد C+، تلتهما Google برصيد D+ وخارطة طريق تفصيلية، بينما انخفضت xAI إلى D− و Meta إلى F.
أظهرت الشركات كفاءة نسبية في اكتشاف السلوكيات الشاذة، لكنها تراجعت بشكل ملحوظ في جوانب الوقاية والاحتواء. تأسست غيدلايت كمنظمة مستقلة من قبل خبيري السلامة السابقين في OpenAI Page Hedley و Steven Adler.
التعليقات (0)
لا توجد تعليقات بعد. كن أول المعلّقين.