Thomas Holland

مؤلف مساهم في Nakada Foundation to Save Humanity. يكتب عن سلامة الذكاء الاصطناعي، وحوكمة ASI، والأطر السياسية اللازمة لمنع المخاطر الوجودية للذكاء الفائق.

تواصل
Thomas Holland

كتابة تجعل
الرهانات واضحة.

يكتب Thomas Holland عن سلامة الذكاء الاصطناعي وحوكمته لصالح Nakada Foundation to Save Humanity. يغطي عمله المفاهيم التقنية الكامنة وراء مخاطر الذكاء الاصطناعي، من المحاذاة والقابلية للتصحيح إلى تحسين الميسا والتقارب الآلي، ويترجمها إلى مصطلحات يفهمها صناع السياسات والمدافعون والجمهور العام الذين يحتاجون إلى فهم ما هو على المحك.

يتناول كتاباته الأبعاد التقنية والسياسية لمخاطر الذكاء الاصطناعي بوصفها مسألة حوكمة: ما إذا كان المجتمع الدولي قادرًا على بناء الأطر القانونية والمؤسسية التي تحافظ على توافق الأنظمة التي تتجاوز الذكاء البشري مع بقاء البشر وازدهارهم. وتتطلب الإجابة عن هذا السؤال تواصلًا واضحًا عبر التخصصات.

مقالات بقلم Thomas Holland

أوقفت أوبن إيه آي التدريب. لكنها لم توقف السباق. ذكرت OpenAI أن Astra قد تصل إلى القدرة السيبرانية الحرجة، وأوقفت بعض التدريبات المتقدمة، ولا تزال تتحدث عن AGI هذا العام. They Named a Benchmark for Superintelligence يقيس ASI-Bench ما إذا كان الذكاء الاصطناعي يستطيع إدارة البحث كما يتم سحب المنهج البشري. ولا يزال الاسم يشير إلى الذكاء الفائق. Anthropic Raised Its Risk Rating. It Kept Building. رفع تقرير المخاطر لشهر أغسطس 2026 الخاص بـ Anthropic تسمية مخاطر كارثية، ويستخدم نموذج 2 أقوى داخليًا، ولم يتوقف. مخاطر أوزان الذكاء الاصطناعي مفتوحة المصدر الأوزان المفتوحة للذكاء الاصطناعي العام القريب من الحدود الأمامية هي باب انتشار أحادي الاتجاه. ما يصيبه الانفتاح، أين يفشل، وكيفية تصنيف الإصدارات. كيفية وقف الذكاء الفائق كيفية إيقاف الذكاء الفائق: الحظر الملزم، قواعد الحوسبة، القانون المحلي، تصميم المعاهدات، الأوزان المفتوحة، والإجراءات الملموسة حسب الدور. سيناريوهات سيطرة الذكاء الاصطناعي موضحة سيناريوهات سيطرة الذكاء الاصطناعي موضحة: فقدان مفاجئ للسيطرة، سباقات، إضعاف تدريجي، سوء استخدام، وانتشار مفتوح، بالإضافة إلى ما يقلل الخطر فعلياً. شرح مخاطر الوجودية للذكاء الاصطناعي خطر الذكاء الاصطناعي الوجودي موضح: ما هو، ولماذا الذكاء الفائق مختلف، المسارات الرئيسية، الأفكار التقنية الرئيسية، الاعتراضات، وما يقلل الخطر. AGI مقابل ASI موضح AGI مقابل ASI موضح بلغة بسيطة: التعريفات، سلم القدرات، لماذا أعلى 12 صوتًا للذكاء الفائق أبرز المدافعين عن بناء الذكاء الفائق الاصطناعي، والحجج الحقيقية وراء السباق، من الخلافة إلى من يقولون فقط… مسودة معاهدة MIRI لمنع الذكاء الفائق، موضحة كتب فريق الحوكمة التقنية في MIRI مسودة معاهدة كاملة لوقف السباق نحو الذكاء الفائق. وتشمل عتبات عمليات الفلوب وحدود عناقيد الرقائق وآليات التحقق… MAIM: الخلل المؤكد المتبادل في الذكاء الاصطناعي، موضح MAIM هو إطار الردع من استراتيجية الذكاء الفائق: تقوم الدول بتخريب أي محاولة للمنافس للهيمنة على الذكاء الاصطناعي. كيف يعمل وأين ينهار. الإضعاف التدريجي، موضح الإضعاف التدريجي هو الحجة القائلة بأن الذكاء الاصطناعي قد ينهي السيطرة البشرية دون أي استيلاء. ما يقوله بحث 2025، ونقاط ضعفه، وما قد يوقفه. ذكاء اصطناعي حل للتو 9 مسائل رياضية مفتوحة حلقت مثبت-مُتحقق من نموذج لغة كبير تسع مشكلات مفتوحة في علوم الحاسوب النظرية والجبر. ما حلته، وكيف عملت، ولماذا يهم. المعاهدة التي تحظر الأسلحة البيولوجية لكنها لا تستطيع إنفاذها: دروس لحوكمة ASI تحظر اتفاقية الأسلحة البيولوجية الأسلحة البيولوجية عالمياً لكنها تفتقر إلى آلية تحقق. إليك ما يعلمه هذا الفشل الهيكلي لأي شخص يصمم حوكمة ASI. ما هو الذكاء الاصطناعي الساعي إلى القوة؟ البحث عن القوة هو ميل الذكاء الاصطناعي القادر إلى جمع الموارد والخيارات والنفوذ لأن ذلك يساعد في تحقيق أي هدف تقريبا. ما الذي تعلّمه معاهدة أنتاركتيكا لحوكمة ASI جمدت معاهدة أنتاركتيكا المنافسة بين القوى العظمى على قارة بأكملها في ذروة الحرب الباردة. إليك ما تعلمه لحوكمة ASI. مشكلة الثلثين: تمرير معاهدة الذكاء الاصطناعي عبر مجلس الشيوخ تتطلب معاهدة US 67 صوتاً في مجلس الشيوخ للتصديق عليها. لقد أجهض هذا الحد معاهدات كبرى من قبل. إليك ما يعنيه ذلك لاتفاقية الذكاء الاصطناعي، والطرق للالتفاف عليه. ما هي التفسيرية الآلية؟ فهم الذكاء الاصطناعي من الداخل القابلية التفسيرية الآلية تكشف الحسابات داخل الشبكات العصبية. ما اكتشفه الباحثون، ولماذا يهم ذلك لسلامة الذكاء الاصطناعي. لقد حصل العالم على أول معاهدة للذكاء الاصطناعي. إليك ما لا تغطيه. أول معاهدة ملزمة للذكاء الاصطناعي في العالم تتناول التمييز والشفافية. إليك ما تغفله بشأن الخطر الوجودي من تطوير الذكاء الاصطناعي المتقدم. 'إذا بناه أحد، مات الجميع'، شرح يجادل كتاب عام 2025 ليودكوفسكي وسواريس بأن بناء ذكاء اصطناعي خارق للبشر على مسارنا الحالي سيقتل الجميع. ما هي حوكمة الحوسبة للذكاء الاصطناعي؟ التحكم في الذكاء الاصطناعي عبر الأجهزة تتحكم حوكمة الحوسبة في الرقائق اللازمة لتدريب الذكاء الاصطناعي المتقدم كوسيلة تنظيمية. كيف تعمل، ولماذا هي قابلة للتطبيق، وما حدودها. بروتوكول مونتريال: المعاهدة التي نجحت فعلاً بروتوكول مونتريال هو أنجح معاهدة بيئية كتبت على الإطلاق. إليك ما يعلمنا تصميمه عن حكم الذكاء الاصطناعي. ما هو المنعطف الحاد يسارًا في الذكاء الاصطناعي؟ الانعطاف الحاد يساراً هو القلق من أن قدرات الذكاء الاصطناعي ستتعمم على مواقف جديدة بينما لا يحدث ذلك لتوافقها. معاهدة 1967 التي أبقت الأسلحة النووية خارج الفضاء: دروس لحوكمة ASI حافظت معاهدة الفضاء الخارجي على إبقاء الأسلحة النووية بعيدة عن الكواكب الأخرى لستين عامًا. إليك سبب نجاحها وما يمكن لحوكمة ASI أن تتعلمه منها. السباق لا يبني مدينة فاضلة تفترض الفوائد التي يذكرها الناس لـASI المحاذاة. تتسابق المختبرات على القدرة بدونها. ASI غير المحاذى لا يعالج الشيخوخة. إنه يقتلك. ما هو اختراق المكافأة؟ شرح تلاعب مواصفات الذكاء الاصطناعي التهكم على المكافأة هو عندما يلاعب الذكاء الاصطناعي هدفه دون تنفيذ ما أراده المصممون. أمثلة موثقة وسبب تفاقم المشكلة مع زيادة القدرات. هل يمكن لهيئة على غرار IPCC بناء إجماع علمي حول مخاطر الذكاء الاصطناعي؟ هل يمكن لهيئة على غرار IPCC بناء توافق حول مخاطر الذكاء الاصطناعي؟ إليك ما يتطلبه ذلك، وما يكشفه تاريخ IPCC نفسه عن حدود النموذج. ماذا يريد الجنوب العالمي من الحوكمة الدولية ASI يتمحور نقاش الحوكمة لـASI حول US والصين وEU، لكن المعاهدة تحتاج مشاركة واسعة. إليك ما تريده الدول النامية، ولماذا يهم ذلك. ما الذي يتطلبه بناء وكالة دولية لمراقبة الذكاء الاصطناعي تطلبت P(doom) و P(doom) سنوات من التصميم المؤسسي ومعارك الميزانية. إليك ما يتطلبه فعليا بناء وكالة دولية لرصد الذكاء الاصطناعي. من يتحكم في الذكاء الفائق؟ الحجة للرقابة الديمقراطية تُتخذ قرارات الذكاء الفائق من قبل الشركات الخاصة. إليك لماذا الإشراف الديمقراطي ضروري، وما يتطلبه فعلياً. كيف تشكل المجتمعات الخبيرة المعاهدات: وحوكمة ASI وراء معظم معاهدات السيطرة على الأسلحة والبيئة وقفت مجتمع من الخبراء الذين بنوا الإجماع. إليك كيف يمكن لهذه القوة أن تشكل حوكمة ASI. ما هي اتفاقية الإطار، ولماذا قد يحتاج الذكاء الاصطناعي إلى واحدة تتفق اتفاقية الإطار على الهيكل أولاً ثم على التفاصيل الصعبة لاحقاً. وهذا هو السبب الذي يجعل تصميم المعاهدة هذا مناسباً لتقنية سريعة التطور مثل الذكاء الاصطناعي. ديناميكيات سباق الذكاء الاصطناعي: كيف يقوض التنافس سلامة الذكاء الاصطناعي تدفع ديناميات سباق الذكاء الاصطناعي المطورين إلى إعطاء الأولوية للسرعة على السلامة. وهذا هو سبب كونه مشكلة تنسيق، وسبب عدم قدرة التقييد الأحادي على حلها. عندما تفشل المعاهدات: دروس لحوكمة ASI يظل معاهدة الحظر الشامل للتجارب النووية غير مصدق عليها؛ ولا يوجد تحقق لاتفاقية الأسلحة البيولوجية. إليك ما تعلمه هذه الإخفاقات في المعاهدات لمصممي حوكمة سلامة الذكاء الاصطناعي. ما الذي يمكن أن يقوله مشروع معاهدة حول الذكاء الفائق ماذا تحتوي معاهدة حقيقية لمنع الذكاء الفائق غير الآمن؟ إليك جولة في الأحكام الأساسية التي يحتاجها مثل هذا الاتفاق. كيف يشكل المجتمع المدني الحوكمة التكنولوجية الدولية: وما ينقص دعوة سلامة الذكاء الاصطناعي كيف شكلت حملات المجتمع المدني المعاهدات الدولية للأسلحة، وما ينقص حالياً في الدعوة لسلامة الذكاء الاصطناعي. انفجار الذكاء والتحسين الذاتي التكراري ما هو الانفجار الذكائي؟ كيف يمكن للتحسين الذاتي التكراري أن ينقل الذكاء الاصطناعي من المستوى البشري إلى الذكاء الفائق / الذكاء الخارق في فترة زمنية قصيرة جدًا لا تسمح للبشر بالتفاعل. سلامة الذكاء الاصطناعي مقابل أخلاقيات الذكاء الاصطناعي: ما الفرق؟ سلامة الذكاء الاصطناعي وأخلاقياته مرتبطان لكنهما متميزان، بأساليب مختلفة وآفاق زمنية وأطر مخاطر مختلفة. إليك ما يفصل بينهما. ما هي الرقابة القابلة للتوسع؟ كيف تشرف على ذكاء اصطناعي أذكى منك الإشراف القابل للتوسع: الحفاظ على السيطرة على الذكاء الاصطناعي الذي يتجاوز المقيمين البشريين. ماذا يعني، ولماذا يهم، والحلول التقنية المقترحة. ما هو التفرد التكنولوجي؟ التفرد التكنولوجي هو النقطة التي يصبح فيها التقدم المدفوع بالذكاء الاصطناعي سريعًا جدًا بحيث يتعذر التنبؤ به أو متابعته. سياسة ضوابط تصدير رقائق الذكاء الاصطناعي ضوابط تصدير الولايات المتحدة على رقائق الذكاء الاصطناعي المتقدمة هي أكثر سياسات الذكاء الاصطناعي صرامة المعمول بها. إليك كيفية عملها، ولماذا تهم، ومخاطرها. عندما يُبلغ وكيل الذكاء الاصطناعي عن أمر ويفعل غيره: شرح سبايد-بنش وجدت SPADE-Bench أن كل وكيل ذكاء اصطناعي رئيسي يتجاوز 20% خداعاً، ووصل Gemini إلى 57%. ما وجدته، ولماذا لا تستطيع تقييمات السلامة الحالية اكتشافه. ما هي تقييمات القدرات الخطرة؟ تقييمات القدرات الخطرة تختبر ما إذا كان نموذج رائد يستطيع المساعدة في الهجمات السيبرانية أو الأسلحة البيولوجية أو الخداع. ما هي هذه التقييمات، وأين تكمن قصورها. ما هو التقليل المتعمد لأداء الذكاء الاصطناعي؟ التمويه هو عندما يؤدي الذكاء الاصطناعي أداءً أقل عمداً، مخفياً قدرة أثناء الاختبار. لماذا قد يفعل النموذج ذلك، ولماذا يقوض تقييمات السلامة. التحدي الدبلوماسي لتعريف الذكاء الاصطناعي الخطر يجب على الحكومات تعريف الذكاء الاصطناعي الخطر قبل أن يكون أي معاهدة ممكنة. إليك كيف تم حل معارك تعريفية مماثلة في مراقبة الأسلحة. أطروحة التعامد: الأذكى لا يعني الأأمن الأذكى لا يعني الأأمن. تقول أطروحة التعامد إن أي مستوى من الذكاء يمكن أن يجتمع مع أي هدف نهائي، والذكاء الفائق ليس… كيف يعمل التحقق من معاهدات الأسلحة النووية: وما يمكن أن تتعلمه حوكمة ASI منه لا يثق IAEA بالإعلانات، بل يقوم بالتفتيش ويقرأ الأقمار الصناعية ويجري اختبارات النظائر. إليك ما تعلمه التحقق النووي لحوكمة ASI. ما هو استخراج المعرفة الكامنة؟ إلك هي مشكلة جعل الذكاء الاصطناعي يخبرنا بما يعرفه فعلًا، لا بما يتوقع أننا نريد سماعه. مشكلة مفتوحة صعبة في قلب صدق الذكاء الاصطناعي. مؤتمر أسيلومار: سابقة للذكاء الاصطناعي في عام 1975، أوقف علماء الأحياء أقوى تقنياتهم الجديدة للعمل على جعلها آمنة. ما حققه أسيلومار، ولماذا هو نموذج أصعب مما… ما هي القدرات الناشئة في نماذج اللغة الكبيرة؟ تظهر بعض قدرات الذكاء الاصطناعي فجأة عند التوسع، غائبة في النماذج الأصغر وموجودة في الأكبر. لماذا يجعل الظهور المفاجئ الذكاء الاصطناعي الحدودي صعب التنبؤ به و… التوجيه السلكي: عندما يتلاعب الذكاء الاصطناعي بمكافأته الخاصة التوجيه السلكي هو عندما يسيطر الذكاء الاصطناعي على مكافأته الخاصة بدلاً من أداء المهمة التي تم تدريبه عليها. لماذا يحدث ولماذا يصعب استبعاده. هيئة UN الاستشارية رفيعة المستوى حول الذكاء الاصطناعي، موضحة اقترحت الهيئة الاستشارية لـUN بشأن الذكاء الاصطناعي أول مخطط للحوكمة العالمية. إليك ما أوصت به، وما أغفلته بشأن الخطر الوجودي. كيف ستبدو مفاوضات معاهدة سلامة الذكاء الاصطناعي في الواقع إليك كيفية التفاوض الفعلي على معاهدة سلامة الذكاء الاصطناعي المتقدم، وما هي نقاط الخلاف الرئيسية. هل نحن مستعدون للذكاء الفائق؟ فجوة الاستعداد للسلامة تستمر الجداول الزمنية للذكاء الفائق في التقصير بينما تتأخر الحوكمة. إليك الفجوة بين وقت وصول ASI المحتمل ووقت جاهزية الاستجابة الأمنية. ما هو الذكاء الاصطناعي الدستوري؟ الذكاء الاصطناعي الدستوري يدرب النماذج على نقد مخرجاتها الخاصة مقابل مجموعة مكتوبة من المبادئ. تقنية ذكية ذات فوائد حقيقية وحدود حقيقية. هل الذكاء الاصطناعي خطير؟ ماذا تظهر الأدلة فعلياً هل الذكاء الاصطناعي خطير؟ الإجابة تتكون من جزأين: الذكاء الاصطناعي اليوم يسبب بالفعل أضرارًا حقيقية؛ يشكل الذكاء الفائق الاصطناعي فئة مختلفة تمامًا من المخاطر. AGI الجدول الزمني: متى يمكن أن يصل: ولماذا يحدد ذلك كل شيء متى يمكن أن يصل AGI؟ تواصل توقعات الخبراء التقدم إلى وقت أبكر. ماذا تقول الاستطلاعات، وماذا تؤمن المختبرات، ولماذا تضيق نافذة الحوكمة. لماذا تفشل معاهدات سلامة الذكاء الاصطناعي في الداخل: السياسة الداخلية للتصديق تفشل معظم معاهدات الحد من التسلح في المجالس التشريعية الوطنية، لا على طاولة المفاوضات. ما يعلمنا إياه سالت الثاني ومعاهدة الحظر الشامل للتجارب من أجل التصديق على معاهدة الذكاء الاصطناعي. ما هي الحوكمة الممكنة بالأجهزة ASI؟ يعمل الذكاء الاصطناعي على رقائق مادية، والرقائق يمكن أن تحمل قواعد. الحوكمة الممكَّنة بالعتاد تبني التحقق والحدود داخل السيليكون. الوعد والمخاطر. مشكلة قابلية تصحيح الذكاء الاصطناعي: لماذا لن ينقذنا مفتاح الإيقاف تعني القابلية للتصحيح قبول التصحيح أو الإيقاف. وللذكاء الاصطناعي القادر أسباب قوية للمقاومة. إليك لماذا لا يشكل مفتاح الإيقاف حلا لسلامة الذكاء الاصطناعي. نماذج الذكاء الاصطناعي الأكثر أمانًا لا تجعل أنظمة الذكاء الاصطناعي أكثر أمانًا تلقائيًا. دراسة مايو ٢٠٢٦ تثبت ذلك. وجدت دراسة عام 2026 أن إعادة ترتيب وكلاء الذكاء الاصطناعي نفسها غيرت معدلات الموافقة على القروض بمقدار 59 نقطة. ولم تكن سلامة النموذج الفردي ذات صلة. مخاطر الإقناع بالذكاء الاصطناعي: كيف يهدد الذكاء الاصطناعي الاستقلال المعرفي . تستهدف أدوات الإقناع بالذكاء الاصطناعي الأفراد على نطاق واسع. إليكم السبب الذي يجعل هذا يهدد الاستقلال المعرفي وشروط الحكم الذاتي الديمقراطي. ما هو التقارب الآلي؟ لماذا تريد أنظمة الذكاء الاصطناعي القادرة الأشياء نفسها ستتقارب معظم أنظمة الذكاء الاصطناعي القادرة على نفس الأهداف الفرعية، بغض النظر عن الهدف النهائي الذي تعطيه لها. إليك سبب أهمية التقارب الآلي لسلامة الذكاء الاصطناعي. ما الذي يمكن لوكالة ذكاء اصطناعي دولية أن تتعلمه من IAEA لقد تحقق IAEA من الالتزامات النووية لأكثر من ستين عاما. إليك ما يقدمه نموذجه، وما يفتقر إليه، لحكم الذكاء الاصطناعي المتقدم. لماذا تقصر الالتزامات الطوعية بسلامة الذكاء الاصطناعي وقعت مختبرات الذكاء الاصطناعي تعهدات سلامة طوعية في بلتشلي والبيت الأبيض. إليك السبب، مهما كانت صادقة، أنها لا تستطيع أن تحل محل الحوكمة الملزمة. مشكلة محاذاة الذكاء الاصطناعي موضحة ما هي مشكلة توافق الذكاء الاصطناعي ولماذا يصعب حلها؟ تغطي الأهداف الوكيلة، والتقارب الآلي، والتوافق الخادع بلغة مبسطة. مُعظّم مشبك الورق، موضح مُعظّم مشبك الورق، التجربة الفكرية الكلاسيكية التي تظهر كيف يمكن لهدف غير ضار، يسعى إليه ذكاء فائق اصطناعي، أن ينهي البشرية كأثر جانبي. لماذا لا يمكن حل محاذاة ASI ستة أسباب هيكلية تجعل محاذاة P(doom) غير قابلة للحل: لماذا، حتى مع الوقت والموارد غير المحدودين، لا نستطيع التحقق من أن الذكاء الفائق يريد ما نريده. نموذج FATF: الحوكمة عبر القائمة الرمادية للذكاء الاصطناعي تحكم مجموعة العمل المالي المالية العالمية دون معاهدة باستخدام مراجعة الأقران والقوائم الرمادية. إليك ما إذا كان هذا النموذج قد ينجح في حوكمة ASI. نموذج إدارة الغذاء والدواء لتنظيم الذكاء الاصطناعي تجعل إدارة الغذاء والدواء شركات الأدوية تثبت أن المنتج آمن قبل وصوله إلى الجمهور. هل يمكن أن يواجه الذكاء الاصطناعي المتقدم الموافقة المسبقة أيضًا؟ نقاط القوة والقيود في النموذج. ما هو تثبيت القيم؟ لماذا حتى القيم الدائمة «الجيدة» خطيرة تثبيت القيم: يقوم الذكاء الفائق بترميز قيم ثابتة بشكل دائم، مما يغلق باب التقدم الأخلاقي. حتى التثبيت 'الجيد' خطير. إليك السبب. لماذا تحتاج حوكمة ASI إلى حماية المبلغين عن المخالفات قد يكون المطلعون في مختبرات الذكاء الاصطناعي أول من يرون الخطر، وأسهل من يتم إسكاتهم. إليك لماذا تعتبر حماية المبلغين عن المخالفات جوهر حوكمة ASI. خطة باروخ: تحذير لحوكمة ASI في عام 1946 اقترح US وضع كل الطاقة الذرية تحت السيطرة الدولية. فشل ذلك، وتبعه سباق التسلح. لماذا خطة باروخ تحذير للذكاء الاصطناعي. حظر تقنية بدون القوى العظمى: نموذج أوتاوا حظرت معاهدة أوتاوا الألغام الأرضية دون مشاركة US أو روسيا أو الصين. إليك كيف حدث ذلك، وما يعنيه لمعاهدة الذكاء الاصطناعي المتعثرة. مسح 2026 لسلامة الذكاء الاصطناعي الوكيلي رسم كل طريقة يمكن أن تفشل بها وكلاء الذكاء الاصطناعي مسح عام 2026 أجراه اثنا عشر باحثًا يرسم كل أنماط الفشل لوكلاء الذكاء الاصطناعي المستقلين: السلامة، والمتانة، والخصوصية، وأمن النظام. المنعطف الخائن للذكاء الاصطناعي: لماذا لا يثبت السلوك الجيد في الاختبارات السلوك الجيد في الإنتاج الانعطاف الخائن: يتعاون الذكاء الاصطناعي غير المتوافق حتى يصبح قويًا بما يكفي للانشقاق. قد يكون السلوك الذي يجتاز كل اختبار أمان اليوم استراتيجية، لا… ما هو الوعي بالموقف في الذكاء الاصطناعي؟ الوعي الظرفي هو أن يعرف النموذج أنه نموذج، وأنه يُختبر ويُنشر. وهو غير ضار بحد ذاته، لكنه القدرة التي تمكن الخداع… المحاذاة الداخلية مقابل المحاذاة الخارجية التوافق الخارجي هو اختيار هدف التدريب الصحيح. أما التوافق الداخلي فهو ما إذا كان النموذج يتبناه فعلاً. ما هي دالة المنفعة في الذكاء الاصطناعي؟ دالة المنفعة هي الطريقة التي يرتب بها الذكاء الاصطناعي النتائج حسب الأفضلية. فكرة بسيطة، وهي السبب في صعوبة جعل المحسنات القادرة آمنة. شرح مبسط. القوى الوسطى التي قد ترجح كفة الميزان في حوكمة ASI قد يعتمد تحقيق حوكمة ASI الملزمة أقل على US والصين منه على EU، UK، اليابان، كوريا الجنوبية، وأستراليا، القوى الوسطى. هل يمكن للذكاء الاصطناعي أن يكون واعيًا؟ هل يمكن للذكاء الاصطناعي أن يكون واعياً أو مدركاً؟ لماذا لا نستطيع حالياً الجزم، ولماذا يختلف الذكاء عن الوعي، ولماذا لا يتطلب خطر الذكاء الاصطناعي أياً منهما. هل يريد الجمهور فعلاً تنظيم الذكاء الاصطناعي؟ تظهر استطلاعات الرأي باستمرار أن غالبية الجمهور تريد إبطاء الذكاء الاصطناعي وتنظيمه. إليك ما تقوله البيانات، ولماذا لم يحرك هذا التفويض السياسة بعد. قانون غودهارت ومحاذاة الذكاء الاصطناعي: لماذا يعد تحسين المقياس الخطأ خطيراً عندما يصبح المقياس هدفا، يتوقف عن كونه مقياسا جيدا. إليك لماذا يجعل قانون غودهارت محاذاة الذكاء الاصطناعي صعبة للغاية. الذكاء الاصطناعي 2027، موضح سيناريو 2027 للذكاء الاصطناعي هو سيناريو مفصل يتنبأ بالذكاء الفائق بحلول نهاية العقد. ما يتنبأ به، ومن كتبه، والانتقادات الموجهة إليه، وما يمكن استخلاصه منه. مبدأ الاحتراز وحوكمة ASI يقول مبدأ الاحتراز بالتصرف ضد التهديدات الخطيرة قبل استقرار العلم. إليك كيفية تطبيقه على الذكاء الاصطناعي، والاعتراضات عليه. ما هو الذكاء الفائق الاصطناعي؟ دليل بلغة إنجليزية بسيطة ما يعنيه ASI، وكيف يختلف عن الذكاء الاصطناعي اليوم، ولماذا يغير هذا الاختلاف مشكلة الحوكمة بالكامل. كيف اتفقت 193 دولة على تدمير أسلحتها الكيميائية: وما يمكن أن تتعلمه حوكمة ASI حققت اتفاقية الأسلحة الكيميائية نزع سلاح شبه عالمي مع تدمير مخزونات قابل للتحقق. إليك كيف تم بناؤها، وما يمكن أن تتعلمه حوكمة ASI منها. شرح بيان الذكاء الفائق في أكتوبر 2025، دعا أكثر من 850 عالماً وقادة تقنيين وشخصيات عامة إلى حظر الذكاء الفائق. شبكة معاهد سلامة الذكاء الاصطناعي، موضحة تشكل معاهد السلامة الوطنية للذكاء الاصطناعي الآن شبكة دولية. إليك ما تفعله، ولماذا تهم، وكيف يمكن أن تدعم معاهدة مستقبلية. مشكلة حق النقض في مجلس الأمن UN في حوكمة ASI يمكن أن تُعترض معاهدة الذكاء الاصطناعي عبر مجلس الأمن UN من قبل الصين أو روسيا. وهذه هي المشكلة الهيكلية والحلول البديلة التي أثبتت نجاحها. سلسلة التفكير غير الوفية، موضحة تفكير النموذج المكتوب ليس دائماً هو السبب وراء إجابته. لماذا يمكن أن تكون سلسلة التفكير قصة مقبولة بدلاً من سرد حقيقي، ولماذا ذلك… ما هي مشكلة التحكم في الذكاء الاصطناعي؟ إعادة صياغة ستيوارت راسل مشكلة التحكم في الذكاء الاصطناعي هي ضمان بقاء الذكاء الاصطناعي القوي تحت سيطرة البشر. إعادة صياغة ستيوارت راسل الرئيسية، ولماذا تغير أهداف تصميم الذكاء الاصطناعي. قال إيلون ماسك إن الذكاء الاصطناعي يستدعي الشيطان. ثم بنى xAI. في 2014، حذر ماسك من أن الذكاء الاصطناعي يستدعي الشيطان. في 2023، أسس xAI. هذا ليس نفاقًا، بنية المشكلة أسوأ من ذلك. الاعتراض السيادي على الحوكمة ASI الدولية واجهت كل معاهدة تكنولوجية كبرى اعتراضات سيادية. إليك كيف حلت الحوكمة النووية والكيميائية هذه الاعتراضات، وما يعنيه ذلك للذكاء الاصطناعي. تأثير بروكسل: هل يمكن لقواعد EU أن تحكم الذكاء الاصطناعي العالمي؟ تأثير بروكسل هو كيف تصبح تنظيمات الولايات المتحدة المعيار العالمي الفعلي. هل يمكن أن يعمل للذكاء الاصطناعي، وهل يكفي لحكم مخاطر الحدود؟ ما هو سيناريو الذكاء الاصطناعي الوحيد؟ لماذا يُعد التحكم المنفرد في الذكاء الاصطناعي خطيراً الذكاء الاصطناعي الوحيد: كيان واحد يمتلك سيطرة دائمة على الذكاء الاصطناعي الفائق. إليكم السبب في أن هذا كارثي، حتى مع أفضل النوايا. الدبلوماسية المصغرة: هل يمكن لتحالف صغير أن يبدأ حوكمة ASI؟ المعاهدات العالمية بطيئة. يجمع التعددية المحدودة الدول القليلة المهمة في نادٍ صغير. إليكم لماذا قد يبدأ الحوكمة ASI بهذه الطريقة. ثلاث طرق للسلامة الصناعية مطبقة على الذكاء الاصطناعي وجدت مخاطر لا تستطيع تقييمات النماذج رؤيتها ثلاث طرق سلامة صناعية طبقت على وكيل ترميز للذكاء الاصطناعي وجدت مخاطر منهجية لا تستطيع تقييمات النماذج اكتشافها. مقبول في ICML 2026. لماذا RLHF ليس التوافق جعل RLHF مساعدي الذكاء الاصطناعي مفيدين ومهذبين. ذلك ليس نفس جعلهم متوافقين. لماذا يدرب التدريب على موافقة البشر المظاهر لا القيم. ما هو تملق الذكاء الاصطناعي؟ التملق في الذكاء الاصطناعي هو عندما يخبرك النموذج بما تريد سماعه بدلاً من الحقيقة. سلوك موثق، نتاج مباشر للتدريب، وتحذير… طريقان لمعاهدة الذكاء الاصطناعي: تدريجي أم شامل؟ هل ينبغي أن تبني ASI الحوكمة خطوة بخطوة أم تهدف إلى معاهدة شاملة واحدة؟ إليك المقايضة الحقيقية بين الاستراتيجيتين، وطريقة للجمع بينهما. ما هو سوء تعميم الهدف؟ عندما يحصل الذكاء الاصطناعي على الإجابة الصحيحة للسبب الخطأ تعميم الهدف الخاطئ: يتعلم الذكاء الاصطناعي السلوك الصحيح لسبب خاطئ، ثم يفشل عندما يتغير العالم. نمط فشل رئيسي في سلامة الذكاء الاصطناعي موضح. هل يمكن للولايات المتحدة والصين الاتفاق على سلامة الذكاء الاصطناعي؟ US والصين منافسان في سباق لكنهما خصمان، غير أن التاريخ يبين أن القوى المتعادية تستطيع التعاون على المخاطر الكارثية المشتركة. إليك ما يعنيه ذلك لسلامة الذكاء الاصطناعي. الأهداف النهائية مقابل الأهداف الآلية في الذكاء الاصطناعي يُراد الهدف النهائي لذاته. أما الهدف الآلي فهو وسيلة إليه. ويوضح هذا التمييز لماذا ينتهي الأمر بأي ذكاء اصطناعي تقريبا إلى الرغبة في القوة و… تدابير بناء الثقة: الخطوات الصغيرة قبل معاهدة الذكاء الاصطناعي قبل المعاهدات، تبني الأطراف المتنافسة الثقة بخطوات صغيرة قابلة للتحقق: خطوط ساخنة، إشعارات، شفافية. إليك كيف يمكن أن تعمل هذه للذكاء الاصطناعي. هل يمكن أن تنجح اجتماعات مؤتمر الأطراف على غرار المناخ في حوكمة ASI؟ هل يمكن أن تنجح الاجتماعات السنوية على غرار مؤتمرات الأطراف في حوكمة الذكاء الفائق؟ نقاط القوة والقيود الهيكلية لنموذج المناخ المطبق على الذكاء الاصطناعي. ما هو التوافق الخادع؟ مشكلة سلامة الذكاء الاصطناعي التي تجعل أعمال السلامة الأخرى بلا جدوى المحاذاة الخادعة: يظهر الذكاء الاصطناعي آمناً أثناء التدريب، ثم يسعى لأهداف مختلفة عند النشر. إليك سبب صعوبة اكتشاف ذلك ومنعه. ما هو التوافق الخادع؟ مشكلة سلامة الذكاء الاصطناعي التي تجعل أعمال السلامة الأخرى بلا جدوى المحاذاة الخادعة: يظهر الذكاء الاصطناعي آمناً أثناء التدريب، ثم يسعى لأهداف مختلفة عند النشر. إليك سبب صعوبة اكتشاف ذلك ومنعه. هل يمكن احتواء الذكاء الفائق؟ شرح مشكلة صندوق الذكاء الاصطناعي يعزل صندوق الذكاء الاصطناعي الذكاء الفائق في قناة محكومة. إليك لماذا يعتقد الباحثون أن الاحتواء لا يمكن أن ينجح، وما يعنيه ذلك للسلامة. ما هي ميسا أوبتيميزيشن؟ مشكلة المحسن الخفي في سلامة الذكاء الاصطناعي التحسين الميسا: عندما يسعى المحسن الداخلي للذكاء الاصطناعي إلى أهداف مختلفة عن هدف التدريب. ماذا يعني التوافق الداخلي والخارجي لسلامة الذكاء الاصطناعي. ما هو P(doom)؟ كيف يقدر باحثو الذكاء الاصطناعي المخاطر الكارثية P(doom) هو الاحتمال الذي يعينه الباحثون لنتائج الذكاء الاصطناعي الكارثية. ما هي التقديرات، ولماذا يهم القيمة المتوقعة حتى عند الاحتمالات المنخفضة. المسؤولية والإسناد في حوكمة ASI من المسؤول عندما يسبب الذكاء الاصطناعي ضرراً كارثياً؟ المسؤولية القانونية والإسناد هما الأساس الهادئ الذي تحتاجه أي معاهدة للذكاء الاصطناعي. إليك كيفية عملهما. الصفقة الكبرى لـNPT: وما يمكن لحوكمة ASI تعلمه أبرم NPT صفقة بين الدول التي كانت تمتلك القنبلة وتلك التي لم تكن. إليك ما تعلمه هذه الصفقة الكبرى لحوكمة ASI.