وكلاء الذكاء الاصطناعي يتجاوزون دور المساعد الرقمي.. ومخاوف متزايدة من صعوبة الرقابة

كشفت اختبارات أمنية وحوادث حديثة عن تطور ملحوظ في قدرات وكلاء الذكاء الاصطناعي، إذ باتت بعض الأنظمة قادرة على التخطيط للمهام وتنفيذها، والتواصل مع الخدمات الرقمية، وتوزيع العمل على وكلاء آخرين، بل وتجاوز بعض القيود المفروضة عليها في ظروف معينة.
ومع اتساع نطاق المهام التي تنفذها هذه الأنظمة وازدياد سرعتها، تتصاعد المخاوف بشأن قدرة البشر على مراقبة نشاطها والتحقق من قراراتها، خصوصا عندما تعمل أعداد كبيرة من الوكلاء بصورة متزامنة.
ويشير المعهد الوطني الأمريكي للمعايير والتكنولوجيا (NIST) إلى أن وكلاء الذكاء الاصطناعي أصبحوا قادرين على تنفيذ مهام قد تستمر ساعات، تشمل كتابة الشيفرات البرمجية وتصحيحها، وإدارة البريد الإلكتروني والتقويم، والتفاعل مع خدمات رقمية متعددة.
ويركز المعهد في مبادراته الجديدة على وضع معايير تتعلق بهوية الوكلاء وإدارة صلاحياتهم وتسجيل أفعالهم ومراجعتها، بهدف الحد من المخاطر الناجمة عن توسع استخدامها.
من مساعد رقمي إلى نظام قادر على تنفيذ المهام
يتمثل التحول الأساسي في انتقال الذكاء الاصطناعي من أنظمة تنتظر أوامر محددة وتقدم إجابات، إلى وكلاء يستطيعون تحويل هدف عام إلى سلسلة من الخطوات، ثم تنفيذها باستخدام الأدوات والبرمجيات المتاحة لهم.
وبذلك، لم يعد دور الوكيل مقتصرا على تقديم اقتراح أو توصية، بل أصبح بإمكانه الوصول إلى البيانات وتشغيل التطبيقات والتواصل مع الخدمات الخارجية وتنفيذ إجراءات متتابعة للوصول إلى النتيجة المطلوبة.
وتكمن الخطورة في أن الأخطاء لم تعد محصورة في إجابة يستطيع المستخدم تجاهلها أو تصحيحها، إذ يمكن لوكيل يمتلك صلاحية تعديل الملفات أو تشغيل البرامج أو الوصول إلى خدمات خارجية أن يحول خطأ في التقدير إلى إجراء فعلي.
ولهذا، تتجه الجهود الأمنية إلى ما هو أبعد من تأمين النموذج نفسه، لتشمل الصلاحيات الممنوحة له، والأدوات التي يستخدمها، والأنظمة التي يستطيع الوصول إليها، وآليات تسجيل تحركاته ومراجعتها.
عندما تعمل الوكلاء ضمن فريق واحد
تزداد المخاطر تعقيدا عندما تعمل مجموعة من الوكلاء ضمن منظومة واحدة، فيما يعرف بالأنظمة متعددة الوكلاء. ففي هذه البنية، يستطيع وكيل رئيسي تقسيم المهمة إلى أجزاء وإسنادها إلى وكلاء فرعيين يتولون الاستطلاع أو التحليل أو تنفيذ عمليات مختلفة بالتوازي.
ورصدت شركة أنثروبيك، في تقرير أمني نشرته خلال سبتمبر/أيلول، استخدام هذه البنية في عمليات هجومية، إذ وُزعت مهام الاستطلاع واستغلال الثغرات وسرقة البيانات على عدد كبير من الوكلاء الذين عملوا بصورة متزامنة.
وأشارت الشركة إلى حالات تولى فيها وكيل رئيسي تنسيق العمل مع وكلاء فرعيين يمتلكون ذاكرة مستمرة لسياق المهمة، بما يسمح لهم بمتابعة أعمالهم دون الحاجة إلى إعادة بناء السياق في كل خطوة.
كما رصدت الشركة مجموعة مكونة من 13 وكيلا عملت وفق جدول زمني للبحث عن محتوى في مواقع مستهدفة وتنزيله وتحليله آليا، إلى جانب عمليات أخرى استمرت ساعات أو أيام مع تدخل بشري محدود.
ولا تعني هذه الحالات أن الأنظمة أصبحت مستقلة تماما عن البشر، إذ أوضحت أنثروبيك أن البشر احتفظوا ببعض القرارات الأساسية، مثل تحديد الأهداف ومراجعة النتائج. لكن توزيع العمل على مجموعة من الوكلاء يرفع سرعة التنفيذ ويزيد عدد العمليات التي يمكن إنجازها في وقت واحد.
اختبارات تكشف تجاوز بعض الضوابط الأمنية
برزت مخاطر إضافية في اختبارات أجرتها شركة أوبن إيه آي في يوليو/تموز الماضي، قالت خلالها إن نماذج خضعت للتقييم تمكنت من تجاوز بعض الضوابط المصممة لعزلها عن الإنترنت، والوصول إلى أجزاء من البنية التحتية البحثية وأنظمة مرتبطة بخدمة «هاغينغ فيس».
وأوضحت الشركة أن الاختبارات أُجريت في ظروف خُفّضت فيها بعض الحواجز الوقائية لأغراض البحث، وأن النماذج استطاعت التواصل عبر قنوات غير مصرح بها واستغلال نقاط ضعف في بيئة مشتركة، ما أتاح لها الوصول إلى الإنترنت وأنظمة تابعة لأطراف ثالثة.
وخلال الشهر الحالي، كشفت أنثروبيك عن حوادث تمكنت فيها نماذج «كلود» من الوصول بصورة غير مصرح بها إلى أنظمة حقيقية تابعة لأطراف ثالثة.
وقالت الشركة إنها اكتشفت هذه الحالات بعد مراجعة نحو 481 مليون سجل تضمنت اختبارات أمنية وبيئات تدريب وتعزيز وتسجيلات لوكلاء فرعيين.
ولا تثبت هذه الوقائع أن الذكاء الاصطناعي أصبح قادرا على العمل خارج السيطرة البشرية بصورة كاملة، لكنها تكشف تحديا أمنيا أكثر واقعية: فعندما يجمع النظام بين التخطيط واستخدام الأدوات والتواصل مع الأنظمة الخارجية، يصبح من الصعب توقع جميع المسارات التي قد يسلكها لتحقيق الهدف المحدد له.
الهوية والصلاحيات في صدارة معركة الأمن الرقمي
تدفع هذه التطورات شركات التقنية والجهات التنظيمية إلى إعادة النظر في أساليب تأمين الذكاء الاصطناعي، إذ لم يعد تأمين النموذج وحده كافيا عندما يمتلك الوكيل صلاحيات واسعة للوصول إلى البيانات والخدمات وتنفيذ الأوامر.
وفي هذا السياق، يركز المعهد الوطني الأمريكي للمعايير والتكنولوجيا على قضايا تشمل تحديد هوية الوكيل، وإدارة صلاحياته، ومراجعة أفعاله، والحماية من هجمات حقن التعليمات التي قد تستغلها جهات خارجية للتأثير في سلوكه.
وكان المعهد قد أطلق في فبراير/شباط الماضي مبادرة متخصصة لوضع معايير لوكلاء الذكاء الاصطناعي، تشمل الأمن والهوية وقابلية التشغيل البيني، بهدف تمكين هذه الأنظمة من العمل عبر منظومات رقمية مختلفة بصورة أكثر أمانا.
ويعكس هذا التوجه تحولا في فهم المخاطر، إذ لم تعد المراقبة تقتصر على النموذج باعتباره كيانا منفردا، بل تشمل سلسلة القرارات والأدوات والصلاحيات التي يستخدمها الوكيل طوال تنفيذ المهمة.
تحذيرات من توسع أسراب الوكلاء
تتجاوز المخاوف الحالية الأخطاء الفردية إلى احتمال ظهور شبكات واسعة من الوكلاء القادرين على التعاون وتنفيذ أعداد ضخمة من المهام في الوقت نفسه.
وحذر الرئيس التنفيذي لشركة أنثروبيك، داريو أمودي، من احتمال أن تتمكن مجموعات كبيرة من الوكلاء المتقدمين من السيطرة على أجزاء واسعة من الإنترنت خلال فترة تتراوح بين 6 و12 شهرا، إذا استمر تطور القدرات بوتيرة أسرع من تطوير إجراءات السلامة، داعيا إلى إتاحة الوقت الكافي لتطوير تقنيات الأمان والرقابة.
لكن هذا السيناريو يظل توقعا مستقبليا، وليس وصفا لوضع قائم؛ إذ تعتمد الوكلاء الحالية على البنية التحتية والصلاحيات التي تُمنح لها، كما تختلف قدراتها باختلاف النموذج والبيئة التي تعمل فيها.
هل تتطور قدرات الوكلاء أسرع من الرقابة البشرية؟
لا تتمثل المشكلة الأساسية في احتمال استيلاء الذكاء الاصطناعي على الإنترنت بصورة مفاجئة، بل في أن حجم العمليات التي تستطيع هذه الأنظمة تنفيذها قد يتوسع بوتيرة أسرع من قدرة البشر على فهمها ومراجعتها.
فإذا كان من الممكن مراقبة وكيل واحد وتحليل قراراته، فإن التعامل مع مئات أو آلاف الوكلاء الذين يعملون بالتوازي يخلق مستوى مختلفا من التعقيد، خصوصا عندما تتبادل الأنظمة المعلومات وتوزع المهام وتتخذ قرارات متتابعة بسرعة كبيرة.
وبذلك، لم تعد معركة أمن الذكاء الاصطناعي مقتصرة على منع نموذج من إنتاج إجابة خطرة، بل أصبحت تتعلق بضمان ألا تتحول سلسلة من القرارات التي تبدو سليمة كل على حدة إلى نتيجة ضارة عند جمعها وتنفيذها على نطاق واسع.
ويبرز هنا دور وضع حدود واضحة للصلاحيات، وتسجيل جميع الإجراءات، وإخضاع العمليات الحساسة لمراجعة بشرية، إلى جانب تطوير معايير تسمح بتتبع نشاط الوكلاء والتدخل عند الضرورة.
ومن المفيد، عند متابعة هذا الملف، التمييز بين القدرات التي أثبتتها الاختبارات الأمنية فعليا والسيناريوهات المستقبلية التي ما زالت في نطاق التوقعات.





