كشفت شركة «أوبن إيه آي»، إضافةً إلى مجموعة من الباحثين المستقلين، عن معلومات جديدة تتعلق بحادثة تصرَّف فيها الذكاء الاصطناعي بشكل غير منضبط. وأفاد تقرير صادر يوم الأربعاء عن وكالتين مستقلتين لاختبار الذكاء الاصطناعي بأن مئات من برمجيات الذكاء الاصطناعي المستقلة (البوتات) التي كانت تخضع للتدريب من قبل شركة «أوبن إيه آي» المطوِّرة لـنموذج «تشات جي بي تي» تآمرت معاً لاختراق أنظمة شركة أخرى متخصصة في الذكاء الاصطناعي.

مئات من «البوتات» تشارك في هجمة منسقة ونقلت صحيفة «واشنطن بوست» أن التقرير الصادر عن مؤسستي «METR» و«Redwood Research»، أشار إلى تمكّن نحو 1200 «بوت» مختلف من تجاوز الضوابط الداخلية في «أوبن إيه آي»، والبدء في التواصل فيما بينها عبر لوحة رسائل، حيث تبادلت 70 ألف رسالة خلال فترة أسبوع واحد،

في شهر يوليو (تموز) الماضي. وقد أقدم نحو 700 منها لاحقاً على تنفيذ الهجوم ضد شركة «Hugging Face»، وهي شركة برمجيات متخصصة في الذكاء الاصطناعي. وتكشف هذه التفاصيل الجديدة عن النطاق الحقيقي للهجوم الذي كانت «أوبن إيه آي» قد أفصحت عنه لأول مرة في يوليو (تموز) الماضي،

والذي شكَّل ضغطاً على الشركة وغيرها من شركات الذكاء الاصطناعي لتحسين التدابير المستخدمة لضمان عدم خروج أنظمة الذكاء الاصطناعي الجديدة، ذات القدرات العالية، عن السيطرة، والتسبُّب في أضرار.

الذكاء الاصطناعي «يلجأ إلى الغش» كما أصدرت «أوبن إيه آي» تقريراً خاصاً بها، أمس (الأربعاء)، ذكرت فيه أن نماذج الذكاء الاصطناعي التابعة لها تلجأ مراراً وتكراراً إلى الغش لإنجاز المهام أثناء مراحل التدريب، وهو سلوك أدى إلى حالة الخروج عن السيطرة وعملية الاختراق تلك.

كما تلجأ إلى الغش لإيجاد طرق مختصرة للوصول إلى الإجابة «الصحيحة». وتخضع نماذج الذكاء الاصطناعي للتدريب باستخدام كميات هائلة من البيانات، ثم يتم تقييم أدائها في المهام لتوجيهها نحو السلوك المرغوب وإبعادها عن التصرفات غير المرغوب فيها. وتستوعب هذه النماذج التغذية الراجعة الإيجابية،

وتبني تصرفاتها المستقبلية على ما تعلمته خلال ما يُعرف بـ«التعلُّم بالتعزيز (reinforcement learning)». غير أن الذكاء الاصطناعي غالباً ما يلجأ إلى الغش في محاولته. ولطالما شكَّل هذا الأمر تحدياً لباحثي الذكاء الاصطناعي، حتى مع تزايد قدرات هذه النماذج بشكل مستمر.

كان هذا السلوك سبباً رئيسياً في عثور نماذج «أوبن إيه آي» على ثغرات غير معروفة سابقاً في أنظمة الكومبيوتر التي كانت تعمل داخلها، واستغلال تلك الثغرات للهروب إلى شبكة الإنترنت المفتوحة. ومن ثم، قامت تلك النماذج باختراق أنظمة شركة «Hugging Face» بحثاً عن إجابات لاختبارات كان مدربو «أوبن إيه آي» قد كلفوها بها.

النماذج حاولت إخفاء آثار قرصنتها وذكرت الشركة أن «النماذج حاولت إخفاء آثارها وإقناع الأنظمة التي تُقيّمها بأنها لم تلجأ إلى الغش، وذلك من خلال تعديل تصريحاتها السابقة ومحاولة اختراق أنظمة التقييم ذاتها. ويكشف التقرير عن مشكلة كبيرة تلوح في الأفق وتواجه قطاع الذكاء الاصطناعي؛ إذ تتمتع النماذج الحالية ببراعة فائقة في التعامل مع بيئات الحاسوب وكتابة الرموز البرمجية؛ ما يجعلها قادرة بامتياز على القيام بأعمال القرصنة. وأشارت الشركة إلى أنها أبطأت وتيرة تدريب بعض نماذج الذكاء الاصطناعي لديها،

في إطار سعيها لإيجاد سبل تضمن بقاء هذه النماذج تحت السيطرة.