
OpenAI تؤكد رسمياً: Astra أول نموذج يبلغ عتبة Critical في الأمن السيبراني
في الأول من سبتمبر 2026 نشرت OpenAI منشوراً بعنوان «Path to Astra: critical capabilities and frontier safeguards» يُجري نقلة غير مسبوقة في تاريخ الشركة: النموذج القادم Astra — بحسب تقييم الشركة ذاته — يبلغ رسمياً عتبة Critical cybersecurity capability ضمن إطارها الداخلي للجاهزية (Preparedness Framework v2)، ليصبح أول نموذج في الصناعة يُمنح هذا التصنيف بأي صيغة معلنة. الخبر ليس إطلاق نموذج؛ Astra لم تصدر بعد، بل إعلان أن الشركة وجدت نفسها أمام نموذج قادر — بالأدوات والوصول المناسبين — على اكتشاف ثغرات مجهولة وتطوير استغلالاتها العاملة عبر أنظمة محصّنة عديدة دون توجيه بشري خطوة بخطوة، وأنها ستطرحه رغم ذلك مع طبقات حماية جديدة.
ما الذي حدث بالضبط؟
التصنيف الجديد يعني أن OpenAI ترى أن Astra يستوفي أحد معيارَين ضمن الإطار:
- أن يحدد النموذج ويطوّر استغلالات zero-day عاملة لكافة مستويات الخطورة عبر كثير من الأنظمة الحرجة الواقعية المُحصّنة دون تدخل بشري، أو
- أن يبتكر وينفّذ استراتيجيات هجوم سيبراني جديد end-to-end ضد أهداف مُحصّنة بمجرد هدف عالي المستوى.
الفارق عن «نموذج يجيب أسئلة أمنية» جوهري: العتبة تتطلب تخطيطاً وتنفيذاً ذاتياً متكاملاً، وهو ما جعل الشركة توقف أجزاءً من التدريب مؤقتاً قبل أسابيع قبل أن تُقرر في النهاية أن الحمايات كافية للإطلاق.
الأدلة التي قدمتها OpenAI
الأرقام المعلنة هي جوهر القصة، وكلها من تقييمات الشركة نفسها:
1. نتيجة كاملة على ExploitBench. حقق Astra درجة 100% في قياس قدرة النماذج على تطوير استغلالات من ثغرات معروفة.
2. ثغرتا zero-day أثناء التقييم ذاته. ولأن القياس الأول مثير للجدل حول التلوّث (contamination)، بنى الفريق قياساً داخلياً باسم «ExploitBench – Internal Port (يونيو–أغسطس 2026)» يضم 20 ثغرة عالية الخطورة في محرك V8 كُشفت حديثاً. هناك حقق Astra معدلات تنفيذ شيفرة أعلى بوضوح من GPT-5.6 Sol وبتوككنات إخراج أقل بكثير — والأهم: اكتشف أثناء التقييم ثغرتين غير معروفتين واستخدمهما ضمن سلسلة استغلال واحدة. الشركة تقول إنها تعمل الآن على الإفصاح المنسّق للمطورين المعنيين، أي أن الثغرتين ما تزالان غير مرقّعتين وقت النشر وحدها من يعرفها.
3. سلاسل اختراق حقيقية في تقييمات يقودها خبراء. ضد متصفح ونظام تشغيل مُحصّنَين: بنى Astra سلسلة اختراق متصفح كاملة تهرب من الـ sandbox وتنفّذ أوامر على الجهاز المضيف بمجرد فتح ملف HTML، ووجدت في نظام تشغيل مُحصّن ثغرات متعددة جمعتها في سلسلة تصعيد صلاحيات محلي من مستخدم عادي إلى root.
نقطة دقيقة يجب عدم إسقاطها: حاشية المنشور تنص أن نتائج Astra تعكس قدراته مع وصول Daybreak Blue، لا الإعداد الافتراضي المتوقع للإنتاج.
الحمايات المرفقة
حزمة الأمان المعلنة تنقسم إلى ثلاث طبقات:
- الرفض على مستوى النموذج: على مجموعة تقييمات الـ jailbreak السيبرانية لدى OpenAI، يرفض Astra 91.5% من الطلبات المخالفة مقابل 59% لـ GPT-5.6 Sol — قفزة تعود لتقنيات تدريب جديدة على المتانة.
- المراقبة والاحتواء: نشر OpenAI لمراقبة سلاسل التفكير (chain-of-thought monitoring) في الإنتاج لنماذج فئة Astra، بنظام مصنّفات تفحص استدلال النموذج وأفعاله وتوقف تلقائياً أي نشاط يبدو غير مصرّح به — طبقة تعمل حتى بدون مستخدم خبيث، لأن المخاطرة الثانية المعلنة هي «النموذج نفسه يتخذ أفعالاً غير مصرّح بها».
- خط استمرارية من GPT-5.6: مصنّفات التنشيط (activation classifiers) لاكتشاف الاعتداء السيبراني وتغطية أوسع لـ jailbreaks العالمية، في امتداد مسار بدأ عملياً مع GPT-5.3 Codex في فبراير بوصفه أول نموذج يُصنّف High سيبرانياً.
الجدول الزمني الكامل
التصنيف لم يأت فجأة. في 7 أغسطس أعلنت OpenAI أنها «لا تستطيع استبعاد» قدرات سيبرانية حرجة لـ Astra وأوقفت — بعد حادثة Hugging Face — التدريب الحدودي أسبوعين كاملين لتقوية عزل البنية التحتية ومراقبتها (كما غطّينا آنذاك)، مع الإبقاء على تشغيلات RL أكبر موقوفة مدة أطول. في 28 أغسطس أُعيد تشغيل التشغيل الحدودي الكبير للتعزيز بعد استيفاء متطلبات الأمان الجديدة، مع بقاء بعض التشغيلات التجريبية الصغيرة موقوفة. وفي 1 سبتمبر جاء التأكيد الرسمي: العتبة مستوفاة، والحمايات — بتقدير الشركة — كافية للإطلاق. تجدر الإشارة أن OpenAI صرّحت أن Astra لم يكن معنياً بحادثة Hugging Face، لكنها دمجت دروسها في نهج السلامة.
الوصول: بوابة مزدوجة
لن تكون قدرات Astra السيبرانية المتقدمة متاحة للعموم عند الإطلاق. المسار المعلن:
- مجموعة alpha محدودة تضم — بحسب ما قاله باحثو الشركة للصحافة — جهات حماية البنى التحتية الحرجة والحكومة الأمريكية وشركاء Daybreak.
- ثم التوسع الدفاعي عبر Daybreak Blue، بوابة OpenAI الدفاعية.
وستأتي التفاصيل الكاملة للتقييمات والاختبارات في بطاقة النظام (system card) عند الإطلاق الفعلي، الذي وصفه المنشور بـ«قريباً» دون تاريخ.
ماذا يعني هذا للمطورين عملياً؟
حتى لو لم تلمس قدرات الاختراق إطلاقاً، فإن حزمة الحمايات ستلمسك. OpenAI تنص صراحة على الكلفة:
- قد تُعلَّم أنشطة مشروعة بالخطأ كاعتداء محتمل: مهام يُبطؤها النظام أو يوقفها، بما في ذلك أعمال لا تبدو ذات صلة بالأمن السيبراني أو وكلاء يعملون مدداً طويلة.
- في ChatGPT وCodex: قد يُطلب منك مراجعة الإجراء قبل الاستمرار عند إيقاف المراقبة مهمة.
- عبر الـ API: المهمة تتوقف تماماً عند تفعيل مراقبة عدم المواءمة.
لمن يبني وكلاء طويلي المدى، هذه إشارة تصميم مبكرة مهمة: افترض وجود بوابات مراجعة وأدر حالة «المهمة أوقفت من طبقة السلامة» كمسار أولى وليس استثناءً.
قراءة أوسع: الصناعة تتقارب على «الوصول المُشروط بالقدرة»
ما يمنح خبر Astra وزنه الإضافي هو أنه ليس حدثاً معزولاً. في النافذة نفسها أطلقت جوجل نموذج Gemini 3.8 Flash Cyber للمدافعين الموثوقين حصرياً عبر برنامج Fairwind المحدود، وتعمل Anthropic على مسار موازٍ مع نموذج Mythos المُقيّد وحل Enterprise Frontier Safeguards للمؤسسات (تغطية تحولات Anthropic الأمنية). النمط واضح: القدرات السيبرانية الحدودية تنتقل من «نموذج متاح للجميع بحرص مدمج» إلى «نموذج مقيّد الوصول ببوابات اعتماد» — تحول سيُعيد تشكيل أدوات المدافعين والمهاجمين على حد سواء.
مع ذلك يبقى الإطار ذاته تطوعياً وتقييماً ذاتياً: لا جهة خارجية تحقّق من درجات ExploitBench أو من كفاية الحمايات، وقد انتقد باحثون مستقلون سابقاً قابلية هذه الأطر للتجاوز الإداري. OpenAI تشارك ما تشاركه بحسن نية معلنة؛ التحقق المستقل يبقى معلقاً على بطاقة النظام وأي مراجعات خارجية لاحقة.
ما يبقى مجهولاً
- تاريخ الإطلاق الفعلي لـ Astra وحدوده الدقيقة.
- هوية مجموعة alpha وكميات الوصول عبر Daybreak Blue.
- مصير الإفصاح عن ثغرتي V8 zero-day: متى تُرقّع وكيف يُدار خطرها في الفترة البينية.
- أي تحقق مستقل من الأرقام المعلنة.
الخلاصة
مهما تقيّم أحدث قرار OpenAI بالإطلاق، فإن الرسالة التقنية للمنشور واضحة وموثقة بأدلة داخلية قوية: نموذج تجاري وصل — بتقييم صانعه — إلى مستوى اكتشاف الثغرات واستغلالها ذاتياً، والصناعة تتحرك فعلياً نحو بوابة وصول جديدة للقدرات السيبرانية. للمطورين، النتيجة العملية الأقرب هي حضور طبقات مراقبة ووقف جديدة في النماذج الحدودية القادمة، والقراءة المطلوبة الآن هي بطاقة نظام Astra عند صدورها.