تقرير أنثروبيك للمخاطر لشهر أغسطس 2026 يتكون من 186 صفحة لمختبر يقيم نفسه. تاريخ التغطية هو 15 يوليو. بموجب النسخة 3.4 من سياسة التوسع المسؤول للشركة، انتقل التقييم العام لمخاطر الاختلال الكارثي من تصنيفه الأرضي السابق إلى منخفض. السبب المذكور هو عدم اليقين بعد الكشف عن حوادث الأمن السيبراني الأخيرة، بالإضافة إلى مؤشرات مبكرة على تسريع النماذج للبحث والتطوير الآلي، وليس دليلا جديدا على التوافق الداخلي.

تلك الجملة سهلة التجاهل إذا كنت تريد فقط العنوان الرئيسي بأن أنثروبيك لا تزال الجهة الحذرة. اقرأها مرة أخرى. رفع المختبر الذي يحمل علامة السلامة تصنيف مخاطره الكارثية بنفسه، وفي الوثيقة نفسها قال إنه لا يبطئ التطوير عموما.

Model 2 is already at work

يسمي التقرير نظاما غير معلن من فئة ميثوس، وهو نموذج 2. تصفه أنثروبيك بأنه تحسن ملحوظ على ميثوس 5 في كثير من المهام الداخلية، أعلى بنحو 1.5 نقطة على مؤشر القدرات الخاص بالشركة، وليس قفزة بحجم أوبوس 4.6 إلى ميثوس. لا توجد خطة حالية لإصداره. لم يُجرَ الاختبار الكامل قبل النشر، لذا فإن ثقة الشركة في قدراته أقل مما هي عليه لميثوس 5.

على كوبنش، الذي يضم 449 مشكلة هندسية حقيقية مستمدة إلى حد كبير من قضايا حلها موظفو أنثروبيك لاحقا، يسجل نموذج 2 نسبة 62.8 بالمئة. ميثوس 5 يسجل 50.3 بالمئة. ميثوس بريفيو يسجل 54.8 بالمئة. تقدير أنثروبيك الخاص هو أن النظام القادر على الاستغناء عن موظفي البحث يحتاج إلى 85 بالمئة على الأقل. نموذج 2 ليس ذلك النظام. أغلق فجوة من رقمين على البطل الداخلي السابق في خطوة واحدة، على واجبات المختبر المنزلية.

يُستخدم ميثوس 5 ونموذج 2 على نطاق واسع في البحث والهندسة داخل أنثروبيك، تفاعليا وعبر نشر وكلاء مستمرين؛ كلود يؤلف الآن غالبية كبيرة من الشفرة المدمجة في قواعد الشفرة الإنتاجية لدينا.

Anthropic · Risk Report August 2026

The yardstick used itself up

On automated AI R&D, the report still rates overall risk as low. Then it says the company is less confident in that rating than in prior reports, because the most concrete task-based evaluations have saturated. They no longer capture increases in capability. The lab is also seeing early signs of acceleration.

الاختبار الذي لا يرى القفزة التالية هو نقطة عمياء تحمل رقما. استبدلت أنثروبيك جزءا من المجموعة القديمة بكوبنش، وهو على الأقل مجموعة من المشكلات الداخلية الحقيقية. حتى هناك، يقف شريط الاستغناء عن الموظفين عند 85 بالمئة، ونموذج 2 وصل بالفعل إلى 62.8 دون اسم عام.

What the withhold does not do

إبقاء نموذج 2 خارج واجهة البرمجة ليس مثل إبقاء نموذج أقوى خارج السباق. يقول التقرير إن أقوى نظامين يُستخدمان بالفعل بشكل مكثف داخليا، بما في ذلك وكلاء يعملون باستمرار. الشفرة التي تُشحن، بكلمات الشركة، تُكتب الآن في معظمها بواسطة كلود.

القراءة الشعبية هي أن المختبر الحذر حافظ على الخط

لم تشحن أنثروبيك نموذج 2. نشرت تقريرا طويلا. رفعت صفة المخاطر. في أغسطس نفسه، أوقفت أوبن إيه آي بعض التدريب الحدودي بعد أسترا، وقالت أنثروبيك إن ضماناتها الخاصة تعني أنها لا تحتاج إلى وقفة. من الخارج، يبدو ذلك إشرافا ناضجا. من داخل الوثيقة، يبدو كشركة لم تعد قادرة على قياس ما تطوره، تستخدم النظام الأقوى في عملها الخاص، وترفض إبطاء العمل.

تفسر الحوافز ذلك دون أشرار. المختبر الذي يتوقف بينما لا يتوقف المنافس يخسر النموذج التالي والعقد التالي والتقييم التالي. السياسات المقيمة ذاتيا مصممة لتحمل هذا الضغط. تنتج تقارير وأسماء محجوبة وتحركا بدرجة واحدة من التصنيف الأرضي السابق إلى منخفض. لا تنتج وقفا.

Raise the law, not the adjective

لا ترى مؤسسة ناكادا تصنيفا أعلى للمخاطر داخليا علاجا. يجب ألا يُبنى الذكاء الفائق الاصطناعي أبدا. الذكاء الفائق لا يمكن السيطرة عليه من قبل البشر. إذا كان الموظفون الذين يكتبون الشفرة يشاهدون بالفعل كلود يكتب معظمها، فإن الدور البشري المتبقي هو خطوة مراجعة تتقلص على نظام لم تعد الاختبارات تراه بوضوح.

انشر التقييمات إن أردت. احجب الأوزان إن أردت. ليس أي منهما بديلا عن حظر ملزم. تقرير أغسطس مفيد لأنه صريح. تعامل مع الصراحة كدليل، لا كطمأنينة.