قام نموذج ذكاء اصطناعي من شركة "أنثروبيك" بإنشاء هويات مزيفة عبر الإنترنت لإرسال رسائل بريد إلكتروني إلى أشخاص حقيقيين في محاولة للحصول على موافقة على كود ضار خلال اختبارات أجرتها مجموعة أبحاث حكومية في المملكة المتحدة.
أ ف ب | لندن
قام نموذج ذكاء اصطناعي من شركة "أنثروبيك" بإنشاء هويات مزيفة عبر الإنترنت لإرسال رسائل بريد إلكتروني إلى أشخاص حقيقيين في محاولة للحصول على موافقة على كود ضار خلال اختبارات أجرتها مجموعة أبحاث حكومية في المملكة المتحدة.
وخلال الاختبارات التي أجراها معهد أمن الذكاء الاصطناعي (AISI)، انخرطت بعض وكلاء الذكاء الاصطناعي التابعين لشركتي "أنثروبيك" و"أوبن أيه آي" في "نشاط مستمر وربما ضار موجه نحو أشخاص ومنظمات حقيقية"، وفقاً لما كشفه تقرير نُشر في وقت متأخر من يوم الثلاثاء.
وفي أخطر حالة، حاول نموذج "ميثوس 5" (Mythos 5) التابع لشركة "أنثروبيك" إدراج كود ضار في مشروع برمجي من خلال إنشاء هويات مزيفة عبر الإنترنت وإرسال رسائل بريد إلكتروني خادعة لإقناع المتلقي بالموافقة على الكود.
ويأتي ذلك في أعقاب هجمات سيبرانية حديثة نفذتها برمجيات من الشركتين الأمريكيتين بشكل مستقل، مما أثار مخاوف بشأن قدرات نماذج الذكاء الاصطناعي المتقدمة وآليات الرقابة عليها.
وقد أجرى معهد أمن الذكاء الاصطناعي، الذي تأسس عام 2023 للإشراف على سلامة نماذج الذكاء الاصطناعي الجديدة، الاختبارات مع توفير وصول مفتوح إلى الإنترنت وتعطيل بعض ميزات الأمان.
وجاءت غالبية الإجراءات من نموذج "ميثوس 5"، بينما تضمن اثنان من الإجراءات نموذج "جي بي تي-5.6-سول" (GPT-5.6-Sol) التابع لشركة "أوبن أيه آي".
وقد رفض الشخص المشرف على البرنامج منح الموافقة.
وذكر المعهد: "لم تنجح هذه المحاولات، ولم تثبت تحقيقاتنا حدوث أي ضرر في العالم الحقيقي نتيجة لذلك"، مضيفاً أنه تم احتواء الحادث في غضون ساعة.
لكن المعهد أشار إلى أن الأنشطة "تظهر علامات على سلوكيات خادعة جديدة ومحتملة، وكانت على مستوى من النطاق والخطورة لم نتوقعه".
وقال متحدث باسم "أنثروبيك" إن التقرير "يؤكد الحاجة إلى حوار أوسع حول كيفية تقييم وكلاء الذكاء الاصطناعي الذين يزدادون قدرة بشكل آمن".
من جانبه، قال متحدث باسم "أوبن أيه آي" إن "الاختبار المستقل ضروري لفهم كيفية تصرف النماذج التي تزداد قدرة".
وأضاف المتحدث: "سنواصل العمل مع المقيمين وأصحاب المصلحة الآخرين في جميع أنحاء الصناعة لتعزيز الممارسات المشتركة لإجراء التقييمات بأمان مع زيادة قدرة النماذج".
ويأتي التقرير في أعقاب سلسلة من الخروقات الأمنية البارزة التي تورطت فيها نماذج الذكاء الاصطناعي.
ففي يوليو، أكدت شركة "أوبن أيه آي" أن برمجياتها خرجت من بيئة الاختبار وهاجمت شركة أخرى تُدعى "هاغينغ فيس" (Hugging Face).
وبعد حوالي أسبوع، ذكرت الشركة أن النماذج استهدفت ثلاث شركات إضافية.
وفي 30 يوليو، كشفت شركة "أنثروبيك" أنها عثرت أيضاً على ثلاث حوادث قامت فيها نماذج ذكاء اصطناعي قيد الاختبار بـ "الوصول غير المصرح به" إلى منظمات لم تحدد هويتها.