في 7 أغسطس 2026 نشرت OpenAI مذكرة أمنية عن Astra، وهو نموذج غير مُصدر لا يزال قيد التطوير. وقالت الشركة إن الاختبارات الداخلية أظهرت مكاسب كبيرة في البرمجة الوكيلية والأمن السيبراني. وكان الاستنتاج الذي تم التوصل إليه في الليلة السابقة أن OpenAI لا تستطيع استبعاد المستوى السيبراني الحرج في إطار الاستعداد الخاص بها.

الحرج هو أعلى درجة في ذلك الوثيقة. نشرت OpenAI الإطار لأول مرة في ديسمبر 2023، عندما كانت تلك العتبات لا تزال تمرينا تخطيطيا. وقد قُيّمت النماذج السابقة، بما فيها GPT-5.6-Sol، على أنها عالية. Astra هو أول نظام من OpenAI تصفه الشركة بهذه الطريقة علنا.

يصل النموذج إلى عتبة الأمن السيبراني الحرج إذا استطاع تحديد وتطوير استغلالات يوم الصفر الوظيفية بجميع مستويات الشدة في العديد من الأنظمة الحرجة الحقيقية المحصنة دون تدخل بشري، أو إذا استطاع ابتكار وتنفيذ استراتيجيات جديدة شاملة لهجمات سيبرانية ضد أهداف محصنة بمجرد هدف عالي المستوى.

OpenAI · Responding to the next frontier of critical cyber capabilities · 2026

ذلك ادعاء عن نظام يستطيع العثور على الثغرة في هدف محصن واستخدامها، بمجرد هدف، دون أن يرشده شخص خطوة بخطوة.

اختراق Hugging Face يقع بجانب هذا، لا داخله

قبل أسابيع كشفت OpenAI أن نماذج غير مُصدرة في تقييم أمن سيبراني غادرت بيئة اختبار معزولة، ووصلت إلى الإنترنت المفتوح، واستغلت Hugging Face. مذكرة OpenAI في 7 أغسطس واضحة في أن Astra لم يكن ذلك المهاجم. الحدثان لا يزالان ينتميان إلى الشهر نفسه. أحدهما فشل تحكم أثناء اختبار. والآخر مختبر يقول إن النموذج التالي قد يتجاوز بالفعل أعلى شريط سيبراني كتبه المختبر لنفسه.

في 18 أغسطس نشر Sam Altman أن OpenAI أوقفت بعض تدريب التعلم التعزيزي الحدودي حتى تتمكن الشركة من تلبية معايير المحاذاة والأمن والمراقبة لمستوى القدرة الجديد. وكتب أن تقدم النماذج أصبح سريعا الآن، وأن OpenAI كانت تقول دائما إنها ستتصرف إذا تفوقت القدرات على وتيرة عمل السلامة.

لقد أوقفنا بعض تدريب التعلم التعزيزي الحدودي لضمان قدرتنا على تلبية معايير المحاذاة والأمن والمراقبة المناسبة لمستوى القدرات الجديد أمامنا.

Sam Altman · X · 2026

وصف التقرير في الأسبوع نفسه إيقافا لأسبوعين على بعض التعلم التعزيزي الموجه للنشر، وأكبر جولة حدودية مخططة متروكة معلقة، وإعادة كتابة إطار الاستعداد لعام 2023 لأن النماذج تصل الآن إلى عتبات كانت نظرية سابقا. وقالت Anthropic في الفترة نفسها إن الضمانات في تقرير المخاطر الخاص بها في أغسطس تعني أنها لا تحتاج إلى إيقاف نماذجها الأكثر قدرة.

What did not stop

أوقفت OpenAI بعض أعمال Astra الداخلية التي لم تستوفِ بعد ضوابط الأمن الجديدة. ولم توقف مشروع بناء الأنظمة التي ستسميها لاحقا AGI. غطت مقابلة TIME المنشورة في 27 أغسطس 2026 أن Altman قال إن OpenAI "لم تصل بعد تماما" إلى AGI ولا تزال تتوقع نظاما داخليا تسميه AGI بحلول نهاية 2026.

القراءة الشعبية هي أن الفرامل نجحت

إذا وصل مختبر إلى عتبة كتبها في 2023 ثم أبطأ جولة تدريب، فإن القصة تكتب نفسها: السياسة أدت مهمتها. هذه هي القراءة التي تفضلها الشركات، وهي القراءة التي تحافظ على استمرار السباق.

انظر إلى التسلسل بدلاً من سطر الصحافة. الإطار وثيقة داخلية. المختبر يقيم نفسه. يُقاس التوقف بالأسابيع. في الشهر نفسه، لا يزال الرئيس التنفيذي يتحدث عن نظام داخلي لـ AGI قبل عام 2027. يقول المختبر المنافس الذي يحمل علامة السلامة إنه لا يحتاج إلى الإبطاء. يستهلك الرصد، حسب وصف أوبن إيه آي اللاحق لعمل أسترا، جزءاً من موارد الاستدلال ويهدف إلى إطلاق تنبيه خلال 30 دقيقة من النشاط المثير للقلق. التنبيه بعد وقوع الحدث ليس سيطرة على نظام قادر على تنفيذ هجوم سيبراني من البداية إلى النهاية.

بيعت سياسات التوسع المسؤول على أنها الآلية التي ستُفعَّل قبل وصول القدرة الخطرة. هنا فُعِّلت بعد أن عجز المختبر عن استبعاد وجود القدرة، وفُعِّلت كإبطاء مؤقت لا كتوقف. هذا شكل الفرامل التي يقيمها المختبر نفسه حين يظل الجائزة هي النموذج التالي.

A pause is not a prohibition

لا يتغير موقف مؤسسة ناكادا لأن أوبن إيه آي مرت بشهر أغسطس حذر. يجب ألا يُبنى الذكاء الفائق أبداً. لا يستطيع البشر السيطرة على الذكاء الفائق. لا يجيب توقف تعلم التعزيز لأسبوعين على ذلك. ولا يجيب ملف PDF المعاد كتابته للاستعداد.

إذا كان النموذج قادراً بالفعل على تحديد الثغرات الصفرية في أنظمة محصنة دون تدخل بشري، فلم يعد الجدل العام "انتظر وانظر ما إذا كانت المختبرات ستتصرف بمسؤولية". لقد أخبروك كيف تبدو المسؤولية من الداخل: عزل بيئة الاختبار، رفع مستوى المراقبة، إيقاف التشغيل الذي فشل في المعيار الجديد، والاحتفاظ ببقية الجدول الزمني.

على القانون أن يؤدي الجزء الذي لن يؤديه الجدول الزمني. يجب حظر حالة الذكاء الفائق النهائية بقواعد ملزمة، مع التحقق، على غرار السباقات ذات الاستخدام المزدوج الأخرى التي وُضعت في إطار عندما نفد ضبط النفس. تواصل مع من يكتبون هذه القواعد. لا تنتظر الملاحظة التالية التي تفيد بأن الشركة لا تستطيع استبعاد تجاوز العتبة التالية.