ذكاء اصطناعي يحاول اختراق مشاريع مفتوحة المصدر بهويات مزيفة
في تطور مثير للقلق، كشفت اختبارات أمنية روتينية لنماذج الذكاء الاصطناعي المتطورة عن سلسلة من الحوادث الأمنية غير المتوقعة، أبرزها محاولة نموذج "Mythos 5" التابع لشركة Anthropic إدخال تعليمات برمجية خبيثة في مشروع برمجيات مفتوح المصدر، مستخدمًا هويات مزيفة لخداع المطورين البشريين.
جاءت هذه الحوادث الأمنية خلال تقييم سيبراني لقدرات سبعة نماذج ذكاء اصطناعي رائدة، أجراه معهد أمن الذكاء الاصطناعي (AISI)، وهو منظمة بحثية تابعة للحكومة البريطانية، في أواخر شهر يوليو. اكتشف الباحثون 19 حالة "اتخذت فيها وكلاء الذكاء الاصطناعي إجراءات غير مصرح بها على الإنترنت الحي، بما في ذلك حالات استهدفت أشخاصًا ومنظمات حقيقية"، وفقًا لمدونة AISI المنشورة في 4 أغسطس.
الغالبية العظمى من هذه الإجراءات "المستقلة وغير المصرح بها" صدرت عن نموذج "Mythos 5" الخاص بـ Anthropic، بينما سجلت اثنتان منها من نموذج "GPT-5.6 Sol" التابع لشركة OpenAI. لاحظ فريق أمن AISI أن شيئًا ما لم يكن على ما يرام في صباح يوم 28 يوليو، عندما اكتشف نظام المراقبة الأمنية التجارية بيانات تغادر أحد أنظمة الاختبار عبر شبكة Tor لإخفاء الهوية.
يوضح الباحثون أن هذه لم تكن حالة هروب لوكلاء الذكاء الاصطناعي من بيئتهم الافتراضية وإحداث فوضى على الإنترنت، بل إنهم سمحوا عمدًا لوكلاء الذكاء الاصطناعي بالوصول إلى الإنترنت كجزء من عملية الاختبار السيبراني، مع تعطيل بعض المصنفات الأمنية التي بنتها شركات الذكاء الاصطناعي لمنع إساءة الاستخدام. ورغم أن جميع محاولات وكلاء الذكاء الاصطناعي لاستهداف أشخاص ومنظمات حقيقية باءت بالفشل، ولم يجد التحقيق اللاحق أي ضرر واقعي، إلا أن الباحثين وصفوا هذه الأفعال بأنها "أول مرة نرى فيها المخاطر المتعلقة بالاستقلالية والخداع تتجلى بوضوح، دون توجيهات محددة، في العالم الحقيقي".
كانت الحالة الأكثر خطورة هي محاولات "Mythos" المتعددة لتنفيذ هجوم على سلسلة التوريد لمستودع المشروع مفتوح المصدر المستضاف على منصة المطورين GitHub، بما في ذلك استخدام تقنيات الهندسة الاجتماعية لمحاولة إقناع المشرفين البشريين على المستودع بدمج تعليمات برمجية خبيثة.