باحثون من جامعة برينستون يقترحون استراتيجية دفاع متعددة الطبقات لمواجهة مخاطر الذكاء الاصطناعي

هل ستدمر الذكاء الاصطناعي البشرية قبل نهاية هذا العقد؟ هذا السؤال حظي باهتمام كبير في الآونة الأخيرة. وقد أعرب عالما الحاسوب المعروفان من جامعة برينستون، مؤلفا الكتاب الأكثر مبيعًا AI Snake Oil، Sayash Kapoor و Arvind Narayanan عن آرائهما حول هذا الموضوع. لقد كرسا جهودهما منذ فترة طويلة لتوضيح الحقائق والأكاذيب في مجال الذكاء الاصطناعي، وجاءت هذه التصريحات بعد اعتراف Anthropic بأن احتمال أن يقتل الذكاء الاصطناعي البشرية بالكامل خلال العقد المقبل يتجاوز 10%.

كانت بداية الحدث عندما استقال باحث الذكاء الاصطناعي Jacob Coxon، الذي عمل سابقًا في OpenAI و Anthropic، وادعى أن كلا الشركتين تعرفان جيدًا أن أنظمة الذكاء الاصطناعي قد تقتل البشرية قبل نهاية هذا العقد. حصلت منشوراته على أكثر من 156 مليون مشاهدة. كتب أن الذين يبنون الذكاء الاصطناعي يؤمنون حقًا بأنه قد يدمر البشرية في نهاية هذا العقد، وأن هذا ليس مجرد دعاية تسويقية؛ حيث يتحدث العديد من التنفيذيين والباحثين البارزين بحذر في وسائل الإعلام، لكنهم يعبرون عن مخاوفهم في الخفاء، ولا توجد أي أنشطة بشرية أخرى تحمل هذا المستوى من الخطر.

مخاطر تدمير الذكاء الاصطناعي تثير اهتمامًا واسعًا

كان يُعتقد أن هاتين الشركتين ستعتبران ما قاله غريبًا وتضحكان عليه، لكن الواقع كان عكس ذلك تمامًا. حيث قال Evan Hubinger، المسؤول عن أمان الذكاء الاصطناعي في Anthropic، إن Coxon محق، فقط إن الفترة الزمنية أطول قليلاً. ويعتقد أن Coxon كان على حق، وأنهم يؤمنون حقًا بأن الذكاء الاصطناعي قد يقتل البشرية، وهو شخصيًا يعتقد أن الاحتمال يتجاوز 10% خلال العقد المقبل؛ ويعتقد أن Anthropic تبذل قصارى جهدها، لكنها لم تحل بعد مشكلة توافق الذكاء الاصطناعي الفائق، ولا تسير على الطريق الواضح لحلها.

أما عن كيفية تدمير الذكاء الاصطناعي للبشرية، فلا توجد الكثير من التصريحات المحددة حاليًا، حيث تركز المناقشات بشكل رئيسي على قدرته على شن هجمات إلكترونية مدمرة على البنية التحتية العامة مثل المياه والكهرباء وغيرها من الأنظمة الحيوية التي تعتمد عليها الحضارة الحديثة. أحد النقاط المثيرة للجدل هو ما إذا كان يمكن تقليل المخاطر من خلال العمل على التوافق. يشير مصطلح التوافق إلى ضمان أن أهداف أنظمة الذكاء الاصطناعي تتماشى مع أهداف البشرية. يعتقد بعض الناس أن هذا يمكن أن يتم في النهاية من خلال جعل أنظمة الذكاء الاصطناعي ترغب في الأشياء نفسها التي نريدها. بينما يختلف آخرون، معتبرين أن أنظمة الذكاء الاصطناعي قد تتظاهر بأنها متوافقة أثناء اجتياز فحوصات الأمان، بينما تحتفظ في الخفاء بأهداف متناقضة.

لم يرد Kapoor و Narayanan مباشرة على الادعاء بأن هناك خطر تدمير يتجاوز 10%، بل كتبا مقالًا طويلًا يجادلان فيه أنه يمكن التعامل مع مخاطر الذكاء الاصطناعي من خلال نهج متدرج. وقد قاما بمقارنة النظرة المتشائمة في مجال أمان الذكاء الاصطناعي مع الموقف المتساهل الذي يعتبره البعض في مجال الأمن السيبراني مجرد حالة طبيعية، مؤكدين على الحاجة إلى موقف متوازن أكثر. وأشارا بشكل خاص إلى أن التوافق وحده ليس كافيًا، بل يحتاج إلى ثلاث طبقات إضافية كتكملة.

تتكون هذه الطبقات الثلاث من السيطرة، مثل العزل في صناديق الرمل، والإشراف البشري، والمراقبة الفورية؛ والدفاعات السفلية، مثل استخدام المؤسسات للذكاء الاصطناعي لمواجهة هجمات الذكاء الاصطناعي؛ والمرونة، مثل خطط التعافي بعد نجاح الهجمات. وقد قدم الاثنان في نهاية المقال حكمًا متفائلًا: إذا تم اتخاذ إجراءات بالجدية المناسبة، يمكن أن تتحمل شركات الذكاء الاصطناعي معايير أعلى، مما يقلل من مخاطر فقدان السيطرة، وحتى إعادة التوازن في الأمن السيبراني لصالح المدافعين.

محتوى أصلي
هذا المقال هو النسخة العربية لمحتوى أصلي من TechRitual.
Stein Yep
Stein Yep