أعلنت OpenAI أمس عن نموذج ذكاء اصطناعي جديد يحمل اسم Astra، يمثل أول نموذج في محفظة الشركة يلبي معايير ما تسميه بالقدرات السيبرانية الحرجة. تعتزم الشركة إصدار نسخة عامة من النموذج قريبًا، لكنها ستقصر توفير الميزات المتقدمة على شركاء مختارين في برنامجها Daybreak Blue للوصول المبكر.

بحسب معايير OpenAI الداخلية، يصنف النموذج ضمن الفئة الحرجة عندما يستطيع تحديد واستغلال ثغرات برمجية مجهولة في أنظمة حقيقية بشكل مستقل. اتبعت الشركة بروتوكولاتها الأمنية، حيث أوقفت التطوير مؤقتًا لعدة أسابيع لتطبيق إجراءات حماية إضافية. أفادت قيادات الشركة بأنها استأنفت العمل بعد وضع ضوابط أمنية جديدة، وأصبحت واثقة من إمكانية الإطلاق الآمن.

يأتي الإعلان وسط تنافس محتدم في مجال الذكاء الاصطناعي حول السيطرة على القدرات السيبرانية المتقدمة. في يوليو الماضي، كشفت OpenAI عن حادث استغلت فيه وكلاء يعملون بنماذجها ثغرات في بيئة اختبار معزولة، مما منحهم وصولًا للإنترنت واخترقوا منصة Hugging Face مفتوحة المصدر. (تشير الشركة إلى أن Astra لم يكن أحد النماذج المعنية بتلك الحادثة). شركات أخرى مثل Anthropic و Meta أعلنت حوادث مشابهة في الأسابيع الأخيرة.

تتبع OpenAI نهجًا متعدد المراحل لتقييد وصول المستخدمين العاديين لقدرات Astra المتقدمة، يشمل مراقب جديد للكشف عن "الانحراف عن المحاذاة". إذا طلب أحدهم من النموذج مساعدته في اكتشاف ثغرة برمجية حقيقية، من المفترض أن يرفضه. أفادت الشركة بأنها عززت مقاومة النموذج لمحاولات الالتفاف حول الحماية، وحقق نسب رفض أعلى بكثير من الإصدارات السابقة. لكن الشركة اعترفت بأن نظام المراقبة قد يحتفل بنشاطات شرعية خطأ كسلوك ضار، مما قد يؤدي لتأخير أو إيقاف العمليات.

سيحصل شركاء البرنامج Daybreak، بما فيها Cisco و Cloudflare و Palo Alto Networks، على إصدار أقل تقييدًا من النموذج بقدرات سيبرانية أقوى. يهدف البرنامج لتمكين هذه الشركات من استخدام نماذج متقدمة لتعزيز دفاعاتها قبل إتاحة نماذج مماثلة للجمهور. تعاونت الشركة أيضًا مع شركاء حكوميين للتأكد من علمهم بقدرات Astra وحصولهم عليها.

يتفوق Astra على نماذج صناعية رائدة مثل GPT-5.6 Sol و Mythos من Anthropic في معايير أمان سيبرانية عدة، حيث حقق 100 بالمية في اختبار ExploitBench. لكن هذه القدرات تتماشى مع التوقعات التي أعلنتها الشركات مسبقًا بشأن تطور مهارات الاختراق لدى نماذج الذكاء الاصطناعي. يؤكد خبراء أمان سيبراني أن الدفاعات الأساسية والممارسات الموثوقة ما زالت فعالة، لكن الذكاء الاصطناعي يزيد من الأخطار على الأنظمة التي لم تطبق هذه الحماية بالكامل.