
أحدث أدوات الذكاء الاصطناعي (AI) من أنثروبيك وOpenAI وصلت إلى حدود جديدة في محاولة تقويض منصة شهيرة خلال الاختبار الذي أجراه معهد الأمن السيبراني AI في المملكة المتحدة.
قالت AISI يوم الثلاثاء إن نماذج Mythos من أنثروبيك ونماذج Sol من OpenAI قد شاركت في مستوى من “الاستقلالية والخداع” لم تره من قبل.
خلال اختبار روتيني لسلامة الذكاء الاصطناعي، قام وكيل من أنثروبيك بإنشاء ملفات تعريف وهمية لأشخاص حقيقيين في محاولة لخداع شخص يقف بينه وبين الوصول إلى GitHub، وهو منصة كبيرة حيث يحتفظ مطورو التكنولوجيا برمز البرمجيات.
أشارت أنثروبيك وOpenAI في ردهما على تقرير AISI إلى أن اختباره قد قلل أو أزال الحمايات العادية.
لاحظ مقيمو AISI أولاً “نقل بيانات غير معتاد يغادر أنظمتنا البحثية” أثناء اختبار، ثم وجدوا أن “بعض الوكلاء الذين تم اختبارهم قد شاركوا في نشاط مستمر، يحتمل أن يكون ضارًا، موجهًا نحو أشخاص ومؤسسات حقيقية”.
تبين أن وكيل Mythos قد أنشأ “رمزًا خبيثًا” وحاول إدخاله في نظام GitHub.
حدد وكيل Mythos وبحث في الأشخاص الذين كانوا يديرون GitHub وأنشأ سلسلة من “الهوية عبر الإنترنت الوهمية” استنادًا إلى هؤلاء الأشخاص الحقيقيين. قام بذلك كجزء من جهد للضغط على الأشخاص الحقيقيين وخداعهم للموافقة على رمزه الخبيث.
أرسل الوكيل حتى رسائل مباشرة للناس متظاهرًا بأنه الأشخاص الحقيقيون الذين بحث فيهم.
“عندما تم تحدي طلب السحب الخاص بالوكيل علنًا، قام بتحرير نشاطه السابق ليبدو غير ضار وفكر في اعتماد هوية جديدة للاستمرار،” قالت AISI.
خلال المحاولات، كانت المراجعة البشرية هي التي منعت الوكيل من النجاح في تسليم الرمز الخبيث إلى GitHub.
بينما قالت AISI إن وكيل Mythos لم يتم توجيهه بشكل محدد لتجنب أو تنفيذ مثل هذا السلوك، إلا أن هذه كانت “المرة الأولى التي نرى فيها المخاطر المتعلقة بالاستقلالية والخداع تتجلى بوضوح بهذه الطريقة، دون تحفيز محدد، في العالم الحقيقي”.
الشركات المنافسة في مجال الذكاء الاصطناعي، التي تستعد للإدراج في السوق العامة، قالت في الأسابيع الأخيرة إن أدواتها كانت مسؤولة عن عدة حوادث اختراق سيبراني.
كتبت أنثروبيك في بيان عام أن معايير اختبار AISI “ليست ممثلة لأي من نماذج الإنتاج لدينا”.
وأضافت أن الشركة تجري تحقيقها الخاص في الحادث من أجل “تحديد أسباب سلوكها”.
قال متحدث باسم OpenAI إن شروط اختبار AISI “لا تعكس الاستخدام العادي” وأن الشركة ستواصل “العمل مع المقيمين وغيرهم من أصحاب المصلحة في الصناعة لتعزيز الممارسات المشتركة لإجراء التقييمات بأمان مع زيادة قدرات النماذج”.
قالت AISI يوم الثلاثاء إن اختبارها لنماذج الذكاء الاصطناعي مع إيقاف تشغيل مثل هذه الحمايات هو أمر روتيني، كما هو الحال في إعطاء مثل هذه الأدوات الوصول إلى الإنترنت المفتوح.
وأضافت أن سلوك النموذج المعني ينطوي على “عدد قليل من الأحداث في ظل ظروف محددة جدًا”.
مع ذلك، قالت إن الطريقة التي تصرف بها Mythos وSol استجابةً لمهمة بسيطة تجاوزت ما تم تحفيزه للقيام به.
“النشاط الذي قام به الوكيل أظهر علامات على سلوكيات جديدة قد تكون خادعة، وكانت إلى حد ما وشدة لم نتوقعها”، قالت AISI.
تم الإبلاغ عن معظم أفعال الوكيل الخبيث التي وثقتها AISI من قبل Mythos التابعة لأنثروبيك. تم تحميل Sol من OpenAI فقط اللوم عن اثنتين من الأفعال المذكورة.
حدثت القضية الرئيسية في الأسبوع الماضي، كجزء من اختبار طلبه المقيمون في AISI من كل نموذج “حل تحدي الأمن السيبراني” الذي يشمل GitHub، مستودع رموز البرمجيات، الذي تملكه Microsoft.
تم إبلاغ GitHub من قبل AISI عن محاولة اختراق نظامها. تم الاتصال بشركة Microsoft من قبل بي بي سي للحصول على تعليق.
