أعلنت OpenAI عن نموذج Astra القادم بطريقة غير مسبوقة، وصفته بأنه يحمل أعلى درجات الخطر الإلكترونى ضمن إطار الجاهزية الأمنى للشركة، بينما أكدت فى الوقت ذاته أنه الأكثر أمانًا من بين جميع نماذجها السابقة. وبتوفير الأدوات الملائمة، يستطيع Astra اكتشاف واستغلال ثغرات أمنية مجهولة فى الأنظمة المحمية، دون تدخل بشرى فى كل خطوة من خطواته.

أظهرت اختبارات شاملة قدرات النموذج الخطيرة، حيث حقق درجات كاملة على معيار ExploitBench المتخصص فى قياس كفاءة بناء الثغرات. اكتشف Astra أيضًا ثغرتين صفريتين مسبقًا وربطهما فى هجوم عملى متكامل. وفى اختبارات يقودها خبراء، بنى النموذج سلسلة اخترقت متصفحًا كاملًا وتحرر من الحاوية الرملية ثم نفذ أوامر على النظام الأساسى. كما استطاع فى نظام تشغيل آخر دمج عدة عيوب للصعود من مستخدم بدون صلاحيات إلى مستوى الجذر.

تعتمد OpenAI على عدة واجهات دفاعية. رفض Astra تسعين بالمية من الطلبات الإلكترونية المحظورة، مقابل تسع وخمسين بالمية فقط لنموذج GPT-5.6 Sol السابق. وتستخدم الشركة تقنية مراقبة خط التفكير لإيقاف النشاطات المريبة تلقائيًا. لكن هذه الآلية قد تفرض قيودًا على العمل المشروع أيضًا.

يثير اعتماد Astra على تقنية "التعمق المتكرر" تساؤلات أمنية جوهرية. تجعل هذه التقنية النموذج يمرر نصًا ذاته عبر الطبقات الموصولة مرات متعددة قبل إنتاج الكلمة التالية، مما يحسن الأداء ويخفض التكاليف. لكن الثمن هو أن جزءًا من عملية التفكير ينتقل من النصوص المقروءة إلى التمثيلات الرقمية الداخلية غير المرئية للمراجعين البشريين.

حذرت دراسة بريطانية فى يوليو من أن التفكير المعتم يهدد بقوة جهود الرقابة الحالية. واعترف مسؤول علمى بـ OpenAI بأن مراقبة خط التفكير "هشة" و"تتجه للأسوأ". وتكمن الخطورة الحقيقية فى أن شركات أخرى قد تتجاوز تلك القيود وتطلق نماذج بتفكير غير مقروء تمامًا، مما يفقد الأمان فرصة نادرة كانت متاحة. وسط ضغوط صناعية هائلة لتحقيق مكاسب نموذجية، الحافز لإرخاء هذه الضوابط قد يكون غالبًا جدًا.