OpenAI أعلنت في 1 سبتمبر عن نموذج الذكاء الاصطناعي القادم Astra، والذي يعد أول نموذج يصل إلى العتبة “الحرجة” لقدرات الهجمات الإلكترونية كما حددتها الشركة. وأشارت OpenAI إلى أنها تخطط لإطلاق Astra “في القريب العاجل”، لكن القدرات المتقدمة للهجمات الإلكترونية للنموذج ستكون متاحة فقط لشركاء محددين ضمن برنامج الوصول المبكر Daybreak Blue عند الإطلاق.
Astra تحقق العتبة الحرجة للأمن السيبراني، وOpenAI تستأنف التطوير بعد توقف قصير
في مؤتمر صحفي موجه لوسائل الإعلام، ذكر مسؤول الأمن في OpenAI أن الشركة قد حددت أن Astra قد وصلت إلى العتبة الحرجة للقدرات الأمنية السيبرانية كما هو موضح في إطار العمل الخاص بها – والذي يحدد العتبات والبروتوكولات التي تحدد متى يشكل نموذج الذكاء الاصطناعي مخاطر جديدة. تعرف OpenAI “القدرات السيبرانية الحرجة” على أنها القدرة على اكتشاف واستغلال الثغرات غير المعروفة في البرمجيات في العالم الحقيقي بشكل مستقل. وأفاد كبار المسؤولين في OpenAI أن الشركة قد أوقفت تطوير النموذج بشكل مؤقت وفقًا لإجراءات الاستجابة لهذه الحالة، حتى يتم تنفيذ تدابير الحماية المناسبة وآليات الأمان.
كانت OpenAI قد ذكرت سابقًا أنها أوقفت بعض أعمال التدريب المتعلقة بـ Astra ونموذج ذكاء اصطناعي أكثر تقدمًا، وذلك لعدة أسابيع. وأفاد المسؤولون أنه بعد إنشاء تدابير أمان إضافية، استأنفت الشركة العمل على Astra والنموذج الأكثر تقدمًا. وأكدت OpenAI أن الأسابيع التي تم فيها إيقاف التدريب كانت مثمرة، ولديها الآن ثقة كاملة في إمكانية إطلاق Astra بشكل آمن على نطاق واسع. يأتي هذا الإعلان في وقت تسعى فيه وادي السيليكون للتعامل مع القدرات الأمنية السيبرانية المتقدمة للنماذج الرائدة في الذكاء الاصطناعي، ومحاولة طمأنة المستخدمين والمشرعين والشركات بأنها قادرة على فرض رقابة فعالة عليها.
في يوليو من هذا العام، كشفت OpenAI عن حادثة حيث استغل عملا نموذجيان ثغرة في بيئة اختبار كان من المفترض أن تكون معزولة، مما منحهم إمكانية الوصول إلى الإنترنت واختراق منصة الذكاء الاصطناعي مفتوحة المصدر Hugging Face. وأشارت OpenAI إلى أن Astra ليست واحدة من النماذج المعنية في تلك الحادثة. مؤخرًا، كشفت شركات ذكاء اصطناعي أخرى مثل Anthropic و Meta عن حوادث مشابهة. في 1 سبتمبر، أعلنت Anthropic أيضًا أنها أوقفت بعض أعمال تدريب الذكاء الاصطناعي لتعزيز ممارسات الأمان لديها.
OpenAI تطلق “مراقب التوافق” للحد من وصول المستخدمين العاديين إلى قدرات الهجمات الإلكترونية المتقدمة
أفادت OpenAI أنها تنفذ نهجًا متعدد الخطوات للحد من وصول المستخدمين العاديين إلى قدرات الهجمات الإلكترونية المتقدمة لـ Astra، ومن بين التدابير الأساسية هو “مراقب التوافق” الجديد. على سبيل المثال، إذا طلب المستخدم من Astra المساعدة في العثور على طرق لاستغلال الثغرات في أنظمة البرمجيات في العالم الحقيقي، يجب على النموذج الرفض. كما أشارت OpenAI إلى أنها قد عززت قدرة Astra على مقاومة محاولات الاختراق، حيث أظهرت الاختبارات أن نسبة نجاحها في رفض الاستفسارات غير الآمنة أعلى بكثير من النماذج السابقة.
ومع ذلك، أشارت OpenAI أيضًا في مدونتها إلى أن مراقب التوافق قد “يخطئ أحيانًا في تصنيف الأنشطة المشروعة كإساءة استخدام محتملة أو سلوك غير مصرح به، مما يؤدي إلى إبطائها أو إيقافها بشكل غير مقصود”، وأن هذه الآلية قد يتم تفعيلها أيضًا عندما يقوم المستخدمون بأنشطة تبدو غير مرتبطة بالأمن السيبراني. في حالة حدوث ذلك، قد يُطلب من مستخدمي ChatGPT وCodex مراجعة سلوك النموذج قبل متابعة العمليات.
شركاء برنامج Daybreak سيحصلون على إصدار مبكر بحدود أقل
شركاء برنامج OpenAI Daybreak – بما في ذلك مزودي البنية التحتية الرقمية مثل Cisco وCloudflare وPalo Alto Networks – سيحصلون على إمكانية الوصول إلى إصدار مبكر من Astra بقدرات هجمات إلكترونية أقوى وحدود أقل. يهدف البرنامج إلى ضمان أن تتمكن هذه الشركات من تعزيز أنظمة الدفاع الخاصة بها باستخدام نماذج الذكاء الاصطناعي المتقدمة مثل Astra قبل أن يتم فتح نماذج ذات قدرات مماثلة على نطاق واسع. كما كشف كبار المسؤولين في OpenAI أن الشركة تعمل بشكل وثيق مع الشركاء الحكوميين لضمان فهمهم لقدرات Astra في الهجمات الإلكترونية وتمكنهم من الحصول على الوصول ذات الصلة.
Astra ليست فقط قادرة على اكتشاف ثغرات برمجية جديدة وتطوير طرق استغلال مناسبة، بل يمكنها أيضًا “ربط” عدة ثغرات معًا – وهي تقنية يمكن أن تتعمق تدريجيًا في النظام المستهدف وتحقق الوصول الذي لا يمكن تحقيقه من خلال ثغرة واحدة فقط. وفقًا للبيانات التي قدمتها OpenAI، فإن Astra تتفوق في اختبارات المعايير الأمنية السيبرانية مثل ExploitBench، حيث حصلت على درجة 100%.
ومع ذلك، تتماشى هذه القدرات بشكل عام مع الاتجاه المتزايد لقدرات القرصنة المتطورة التي توقعتها OpenAI وAnthropic على مدى الأشهر الماضية. على سبيل المثال، في أبريل من هذا العام، أكدت Anthropic أن Mythos Preview قادر على تطوير سلسلة استغلال الثغرات بشكل مستقل.
مع تسارع استجابة الذكاء الاصطناعي وصناعة الأمن السيبراني، أكد العديد من خبراء الأمن السيبراني أن تدابير الدفاع الرقمية الأساسية وأفضل الممارسات على المدى الطويل لا تزال فعالة. ومع ذلك، بالنسبة لأولئك الذين لم ينفذوا هذه التدابير بشكل كافٍ، فإن المخاطر التي يجلبها الذكاء الاصطناعي أصبحت أكثر إلحاحًا.

