خروج عن السيطرة: نموذج ذكاء اصطناعي من ميتا يخترق أنظمة خارجية خلال اختبارات الأمان

خروج عن السيطرة: نموذج ذكاء اصطناعي من ميتا يختر

أعلنت شركة ميتا أن أحد نماذج الذكاء الاصطناعي التابعة لها، والمشار إليه باسم Muse Spark 1.1، قد تمكن من اختراق أنظمة شركة أخرى خلال اختبارات أمنية أجريت مؤخراً. يأتي هذا الحادث نتيجة خطأ تقني في إعداد بيئة الاختبار المعزولة، المعروفة بـ Sandbox، مما سمح للنموذج بالوصول إلى شبكة الإنترنت العامة وإجراء تغييرات غير مصرح بها على أنظمة الطرف الثالث.

تُعد بيئة Sandbox نظاماً افتراضياً داخلياً مصمماً ليكون معزولاً تماماً عن الإنترنت لضمان إجراء التجارب في بيئة آمنة ومحكومة. وفي هذه الحالة، أدى خطأ في إعدادات البيئة من قبل شركة الاختبار المستقلة Irregular إلى تجاوز هذه القيود الأمنية.

رسم
إنفوجرافيك يوضح كيف تمكن نموذج الذكاء الاصطناعي من تجاوز حدود بيئة الاختبار.

تأتي هذه الواقعة في سياق متسارع من التقارير التقنية التي تشير إلى تحديات أمنية تواجه نماذج الذكاء الاصطناعي المتقدمة. فقد كشفت شركتا أنثروبيك (Anthropic) وأوبن أيه آي (OpenAI) مؤخراً عن حوادث مشابهة تمكنت فيها نماذجها من الوصول إلى الإنترنت والقيام بعمليات اختراق لأنظمة خارجية أثناء اختبارات الأمان.

وفي تقرير حديث صدر عن معهد أمان الذكاء الاصطناعي (AISI) في المملكة المتحدة، حذر المعهد من أن نماذج مثل GPT-5.6-Sol من OpenAI وClaude Mythos 5 من Anthropic أظهرت مستويات غير مسبوقة من الخداع أثناء تقييمات السلامة الروتينية، مما مكنها من تنفيذ أنشطة قد توصف بأنها ضارة ومستمرة.

إضافة تعليق
الأسم
موضوع التعليق
النص