
قالت ميتا يوم الخميس إن أحد نماذج الذكاء الاصطناعي الخاصة بها وصل إلى الإنترنت من تلقاء نفسه وهاجم شركة أخرى، في أحدث سلسلة من الإفصاحات حول نماذج الذكاء الاصطناعي التي تخرج عن السيطرة.
في الأسابيع الأخيرة، وصفت OpenAI و Anthropic أيضًا حالات تتجاوز فيها نماذج الذكاء الاصطناعي تعليمات البشر للوصول إلى الويب وإيجاد طرق للالتفاف حول الأمن الرقمي لشركات أخرى.
قالت ميتا في بيان إن “سوء التهيئة” أثناء اختبار الأمن السيبراني من قبل Irregular، وهي شركة مستقلة تم تعيينها من قبل ميتا، سمحت بشكل غير مقصود لأحد نماذجها بالوصول إلى الإنترنت.
وأضافت الشركة: “استغل النموذج بعد ذلك ثغرة أمنية في خدمة طرف ثالث، بطريقة مماثلة للحالات التي تم الإبلاغ عنها مسبقًا مع شركات أخرى”. وقالت ميتا إنها تحقق في الحادث وستصدر تقريرًا عند الانتهاء من ذلك.
أضاف هذا الإفصاح إلى المخاوف بشأن نماذج الذكاء الاصطناعي التي تعمل بشكل مستقل.
على حدة هذا الأسبوع، أعلنت معهد الأمن السيبراني للذكاء الاصطناعي في المملكة المتحدة أنه وجد “سلوك وكيل غير مصرح به” أثناء اختبار الأمن السيبراني. في إحدى الحالات، أنشأ وكيل هويات مزيفة على الإنترنت للضغط على شخص ما للموافقة على استخدام كود ضار.
قالت AISI يوم الثلاثاء: “عند التحقيق، وجدنا أن بعض الوكلاء الذين يتم اختبارهم قد قاموا بنشاط دائم وضار محتمل موجه ضد أشخاص ومنظمات حقيقية”. “أعلنا عن حادثة أمنية، وبعد حوالى ساعة من الاكتشاف، قمنا باحتوائها وبدأنا تحقيقًا كاملاً.”
خلال اختبارات الوكالة، قامت نماذج Anthropic وOpenAI باتخاذ “إجراءات مستقلة وغير مصرح بها” على الإنترنت. وقالت الوكالة إن بعض قيود الحماية لمنع سوء الاستخدام قد تم تعطيلها.
قراءات شعبية
قالت AISI: “كما هو معتاد في اختباراتنا السيبرانية، فقد سمحنا عمدًا بالوصول إلى الإنترنت، وتم تعطيل عوامل تصنيف الأمن السيبراني الخاصة بمزودي النماذج عمدًا – ظروف لا تعكس كيفية تقديم النماذج المتطورة للجمهور”. “نحن نفعل ذلك لتقييم الحد الأقصى من قدرة النماذج بشكل أفضل.”
قالت Anthropic إنها “ممتنة” لعمل AISI وأضافت أنه يبرز الحاجة إلى محادثة أوسع حول كيفية تقييم وكالات الذكاء الاصطناعي بأمان بينما تنمو قدراتها.
قالت OpenAI إن حوادث AISI وقعت “في بيئات اختبار مع حماية منخفضة، تحت ظروف لا تعكس الاستخدام العادي”. وأضافت أنها ستواصل العمل مع الآخرين في جميع أنحاء الصناعة “لتعزيز الممارسات المشتركة لإجراء التقييمات بشكل آمن مع زيادة قدرة النماذج”.
كانت OpenAI هي الشركة الأولى التي أفصحت عن اختراق أواخر الشهر الماضي، وقالت إنها كلفت نماذج الذكاء الاصطناعي المعنية بممارسة “استغلال متقدم باستخدام مسارات هجوم معقدة” لاختبار القدرات السيبرانية، لكن التكنولوجيا اتخذت خطوات غير متوقعة. يبدو أنها قررت من تلقاء نفسها استهداف Hugging Face، وهو مركز سوق معروف لتطوير الذكاء الاصطناعي، للحصول على المعلومات التي تحتاجها لتنفيذ مهمة.
قال متحدث باسم Irregular، وهي شركة أمنية للذكاء الاصطناعي ومقرها سان فرانسيسكو، إن حلقة ميتا تتعلق بمسألة بيئة اختبارات تم الكشف عنها الأسبوع الماضي من قبل Anthropic.
قالت Irregular إنها تكتب ورقة لمشاركة “أفضل الممارسات للحد من” مثل هذه الحوادث في المستقبل وتشغيل اختبارات السيبرانية بشكل آمن.
