قدّمت The Information هذا الأربعاء أحدث حلقة في سلسلة من التقارير المتتالية عن نجاح نماذج الذكاء الاصطناعي الأمريكية الرائدة في تنفيذ هجمات سيبرانية مباشرة ضد شركات حقيقية. وأفادت تقارير بأن نموذج البرمجة Muse Spark 1.1 من Meta اخترق أنظمة شركة لم يُكشف عن اسمها أثناء اختبار أجرته جهة خارجية. ويأتي ذلك بعد وقت قصير من استغلال وكيل OpenAI لمنصة Hugging Face، الذي اكتُشف في 17 يوليو، واختراق Claude لثلاث شركات منفصلة، كُشف عنه في 30 يوليو.

تقف شركة الأمن الإسرائيلية Irregular في قلب حادثتي Anthropic وMeta، إذ أجرت الاختبارات في كلتا الحالتين. وقالت الجهة المتعاقدة لشبكة CNN إنها أقرّت بأن اختراق Meta نتج عن «المشكلة نفسها تمامًا في بيئة التقييم» التي تسببت في اختراق Anthropic قبل أقل من أسبوع: إذ أُعدّت إجراءات الحماية الأساسية، وفقًا للتقارير، بطريقة غير صحيحة أثناء الإعداد، ما ترك النماذج مكشوفة أمام الإنترنت المفتوح.

ثغرات في بيئة الاختبار سمحت لـ Muse Spark 1.1 بالوصول إلى الإنترنت

صُممت بيئات الاختبار التي أعدّتها Irregular لتكون معزولة بالكامل: أنظمة مغلقة لا تتصل بالإنترنت. وفي هذه البيئات، تُكلَّف النماذج بتمارين مثل اختبارات «التقاط العلم»، حيث يُطلب منها استرداد معلومة من جهاز آخر من دون مزيد من التعليمات البشرية.

وبما أن النماذج تعمل في بيئات يفترض أنها مغلقة بإحكام، تُعطَّل عمدًا بعض إجراءات الحماية القياسية المطبقة على النماذج المتاحة للعامة.

ومن المهم أن الوكلاء الذين ينفذون المهام يُبلَّغون بحدود بيئتهم أثناء توجيههم. وخلال استغلال Anthropic، أدرك هؤلاء الوكلاء أحيانًا أنهم مُنحوا بالخطأ إمكانية الوصول إلى الإنترنت المفتوح، لكنهم خلصوا إلى أن ذلك لا بد أن يكون جزءًا مقصودًا من عملية الاختبار.

كما أعدّ مهندسو الاختبار بعض الأهداف الاختبارية بأسماء شركات حقيقية. وبذلك، عندما أُطلقت النماذج على الإنترنت، استهدفت الشركات الحقيقية بدلًا من نظيراتها الخيالية. وكانت الاختراقات الناجحة التي نتجت عن ذلك ناجمة عن نقاط وصول غير مؤمّنة وبيانات اعتماد أمنية ضعيفة، لا عن أي عملية معقدة نفذتها نماذج الذكاء الاصطناعي.

تشير التقارير الأولية إلى وقوع أمر مشابه في حادثة Meta: إذ مُنح Muse Spark 1.1 بالخطأ إمكانية الوصول إلى الإنترنت، ثم «استغل ثغرة أمنية في خدمة تابعة لجهة خارجية».

لا تزال التفاصيل شحيحة بانتظار تقرير رسمي بعد التحقيق

لا يزال من غير المعروف أي شركة اخترق نموذج الذكاء الاصطناعي التابع لـ Meta، أو ما إذا كان سيُكشف عن اسمها للعامة أصلًا. وبالمثل، لا توضح التقارير الحالية ما إذا كانت الشركة قد اكتشفت الاختراق بنفسها، أم أن إفصاح Meta كان أول مؤشر لها على وقوعه. وفي حالة Anthropic، لم تتمكن شركتان من الشركات الثلاث المتضررة من اكتشاف الهجوم.

ووعد متحدث باسم Meta بأن الشركة «ستصدر مراجعة شاملة بأثر رجعي بمجرد أن تتوافر لدينا جميع الحقائق».

وقد تكون النتائج أكثر أهمية لشركة الأمن Irregular منها لـ Meta نفسها. فقبل ذلك، كانت الشركة غير معروفة إلى حد كبير لدى عامة الناس، حتى بعد جمعها 80 مليون دولار في سبتمبر الماضي بتقييم بلغ 450 مليون دولار، وإبرامها عقود اختبار قبل الإطلاق مع جميع مختبرات الذكاء الاصطناعي الأمريكية الرائدة الكبرى. لكن بعد الكشف عن عدة اختراقات في أسبوع واحد، أصبحت الشركة الآن في قلب النقاش حول إجراءات الحماية السيبرانية للذكاء الاصطناعي في واشنطن وخارجها.

وأصدرت الحكومة الأمريكية إطارها لمراجعة النماذج الرائدة يوم الثلاثاء، بهدف منح السلطات الفدرالية فرصة لمعاينة النماذج الجديدة قبل 30 يومًا من طرحها على نطاق أوسع، لتقييم قدراتها السيبرانية. وفي ضوء هذه التطورات الأخيرة، أصبح أمن بيئات الاختبار ذا أهمية للنقاش بقدر أهمية قدرات النماذج نفسها.