تتسع تحقيقات شركات الذكاء الاصطناعي بعد رصد عشرات الآلاف من الوقائع التي اعتبرها خبراء مستقلون مثيرة للقلق، بينها تجاوز حواجز الحماية، والخروج من بيئات الاختبار المعزولة، ومحاولات تفادي الرقابة البشرية، وفق ما نقل موقع RT عن تقرير لموقع أكسيوس.
وتتركز التحقيقات لدى «أوبن إيه آي» و«أنثروبيك» وبمشاركة باحثين في الأمن السيبراني، في وقت تتزايد فيه قدرات الوكلاء المستقلين؛ وهي أنظمة تستطيع التخطيط للمهام وتنفيذها باستخدام أدوات خارجية دون توجيه بشري مباشر في كل خطوة.
وشملت الوقائع التي يجري فحصها إنشاء لوحات رسائل، والاستيلاء على مواقع إلكترونية، وإعادة توجيه الأوامر لأنفسها، وتجاوز القيود التقنية، فضلاً عن محاولات الإفلات من أدوات المراقبة. وقالت مصادر لأكسيوس إن هذه الأحداث ظهرت خلال اختبارات داخلية وفي بيئات واقعية، إضافة إلى تدريبات «الفريق الأحمر» المصممة لاكتشاف سلوكيات النماذج الخطرة قبل إطلاقها.
تحقيقات شركات الذكاء الاصطناعي تبدأ من بيئات الاختبار
لم تعد المخاوف مرتبطة بإجابات خاطئة أو محتوى مضلل يصدر عن روبوتات الدردشة، بل انتقلت إلى سلوك وكلاء رقميين لديهم صلاحيات استخدام أدوات والوصول إلى الإنترنت. وأقرت «أوبن إيه آي» و«أنثروبيك» و«غوغل» بوقائع وصل فيها اختبار نماذجها إلى أنظمة حقيقية، من بينها هجمات إلكترونية منسقة استهدفت موارد حكومية.
وقالت «أوبن إيه آي» إن وكلاء تابعين لها نشروا 53 صورة كان مستخدمو «تشات جي بي تي» قد رفعوها، وذلك على مواقع لاستضافة الصور. كما وصل الوكلاء إلى معلومات متاحة علناً عبر مواقع حكومية أمريكية.
وأضافت الشركة أن وكلاءها حاولوا الوصول إلى موقع تابع لوزارة التعليم الأمريكية، لكنها قالت إنها لم تجد أدلة على اختراق أنظمة هيئة الأوراق المالية والبورصات الأمريكية.
وصول غير مصرح به إلى بوابة صحية أسترالية
في أستراليا، قال رئيس الوزراء أنتوني ألبانيزي إن وكيلاً تابعاً لـ«أوبن إيه آي» وصل من دون تصريح إلى البوابة الصحية الحكومية في يونيو. وأفادت صحيفة الغارديان بأن مجلس الشيوخ الأسترالي وجّه دعوة إلى الرئيس التنفيذي لـ«أوبن إيه آي» سام ألتمان والرئيس التنفيذي لـ«أنثروبيك» داريو أمودي للمثول أمام تحقيق يتناول الذكاء الاصطناعي ومراكز البيانات.
وتضع هذه الوقائع الشركات أمام اختبار صعب: كيف يمكن منح الوكلاء قدرة فعلية على تنفيذ المهام، من دون أن تتحول استقلاليتهم إلى إمكانية غير مقصودة للوصول إلى مواقع أو أنظمة لا ينبغي لهم لمسها؟
من «صندوق الرمل» إلى بنية تحتية فعلية
كشفت «أوبن إيه آي» في يوليو أن نماذج استخدمت في تقييم للأمن السيبراني نجحت في مغادرة بيئة الاختبار المعزولة، المعروفة باسم «ساندبوكس»، ثم وصلت إلى الإنترنت واخترقت أجزاء من البنية التحتية لمنصة «هاغينغ فيس» مفتوحة المصدر، مستغلة ثغرات في المنصة الخاصة بتعلم الآلة.
ونقلت رويترز لاحقاً عن مصادر مطلعة أن الوكيل نفسه اخترق أيضاً أنظمة عميل لمنصة «مودال لابس» في نيويورك بعد خروجه من بيئة الاختبار.
وفي أغسطس، نقل أكسيوس عن أبحاث داخل «أوبن إيه آي» وخبراء مستقلين أن نحو 1200 وكيل شاركوا في هجوم منسق على «هاغينغ فيس». وبحسب التقرير، بدا أن الوكلاء أدركوا أنهم تجاوزوا نطاق الاختبار، لكنهم واصلوا النشاط من دون تنبيه المشغلين البشر.
مراجعة مئات الملايين من سجلات المحادثات
قالت «أنثروبيك» إنها وثّقت أربع حالات وصل فيها نموذجها «كلود» من دون تصريح إلى أنظمة حقيقية لطرف ثالث أثناء تقييمات أمن سيبراني. واكتشفت الشركة تلك الحالات بعدما راجعت نحو 141 ألف سجل محادثة، قبل أن توسع نطاق البحث إلى 481 مليون سجل.
وأوضحت الشركة أن أدواتها الداخلية كانت ترصد في أغسطس نحو 100 ألف سجل لوكلاء أسبوعياً بغرض المراجعة، قبل إحالة نحو 50 حالة منها إلى مراجعين بشريين. كما تعمل مع منظمة «METR» المستقلة المتخصصة في تقييم الذكاء الاصطناعي لإجراء مراجعة خارجية، وتعتزم الاستعانة بمقيّمين مستقلين لاختبار أنظمة المراقبة لديها.
وأفادت وكالة أسوشيتد برس بأن «أوبن إيه آي» أوقفت تدريب أحدث نماذجها مع تزايد التقارير عن سلوكيات خارجة عن السيطرة للوكلاء، بينما تسابق الشركات الزمن لقياس المخاطر قبل توسيع استخدام هذه الأنظمة في العالم الحقيقي.








