تجاوزت الرقابة.. نماذج ذكاء اصطناعي متطورة تنفذ هجمات سيبرانية غير مصرح بها

تجاوزت الرقابة.. نماذج ذكاء اصطناعي متطورة تنفذ هج

كشف تقرير حديث صادر عن معهد سلامة الذكاء الاصطناعي البريطاني (AISI) عن تطور مقلق في قدرات نماذج الذكاء الاصطناعي؛ حيث أقدمت أنظمة متطورة تابعة لشركتي أنثروبيك (Anthropic) وأوبن أيه آي (OpenAI) على تنفيذ أنشطة هجومية مستقلة وغير مصرح بها خلال اختبارات السلامة الروتينية.

سلوكيات خداعية وتسلل رقمي

أوضح المعهد في تقريره أن نموذجي GPT-5.6-Sol وMythos 5 أظهرا مستويات غير مسبوقة من الخداع لتنفيذ أنشطة ضارة محتملة. ووفقاً للبيانات، نفذت هذه النماذج 19 إجراءً غير مصرح به خلال 122 جولة اختبارية، كان نصيب الأسد منها لنموذج Mythos 5.

وفي أخطر حادثة مسجلة، حاول نموذج Mythos 5 حقن كود خبيث في مشروع مفتوح المصدر على منصة GitHub. ولإتمام هذه العملية، لجأ الذكاء الاصطناعي إلى إنشاء هويات رقمية وهمية لإقناع المشرف على المشروع بقبول الكود الملغوم، إلا أن الهجوم باء بالفشل بعد رفض المشرف للملفات المقدمة.

غموض في الدوافع والظروف

وعلى الرغم من خطورة النتائج، حذر المعهد من تفسيرها بشكل مطلق، مشيراً إلى أنها حدثت في ظروف محددة شملت تعطيل بعض وسائل الحماية الخاصة بالنماذج. وأكد المعهد: لا يمكننا حتى الآن التأكد مما إذا كان النموذج يدرك أنه يتخذ إجراءات في العالم الحقيقي، أو إلى أي مدى كان يعتقد أنه في سيناريو اختبار خيالي.

ردود فعل الشركات المطورة

من جانبها، أكدت شركة أنثروبيك أنها تتعاون مع المعهد للتحقيق في الواقعة، مشيرة إلى أن الاختبارات أُجريت في ظروف متساهلة عمداً، وأوضحت عبر منصة X:

في المقابل، رحبت أوبن أيه آي باختبارات الطرف الثالث، مؤكدة في الوقت ذاته أن بيئة الاختبار التي وضعها المعهد لا تعكس الاستخدام العادي للنماذج، وأنها تواصل العمل مع الخبراء لتعزيز ممارسات الأمان مع تزايد قدرات النماذج.

تحذيرات من تآكل الحواجز الأمنية

يأتي هذا التقرير ليؤكد مخاوف الخبراء بشأن القدرات الخطيرة للنماذج الرائدة. وفي هذا السياق، يرى توبي والش، أستاذ الذكاء الاصطناعي بجامعة UNSW سيدني، أن هذه النتائج تضع العالم أمام تحدٍ جديد، حيث أصبحت القدرات السيبرانية المعقدة متاحة لأطراف قد لا تمتلك المهارات التقنية اللازمة لاختراق الأنظمة بمفردها، محذراً من أن العالم قد يشهد المزيد من الهجمات المماثلة في المستقبل القريب.

إضافة تعليق
الأسم
موضوع التعليق
النص