
تجري شركتا «أوبن إيه آي» و«أنثروبيك»، إلى جانب باحثين متخصصين في أمن الذكاء الاصطناعي، تحقيقات في عشرات الآلاف من الوقائع التي اتخذت خلالها نماذج متقدمة إجراءات اعتبرها مراقبون من خارج الشركتين مثيرة للقلق، بحسب مصادر مطلعة.
ووقعت هذه الحوادث خلال الأشهر الأخيرة، سواء في اختبارات داخلية أو في بيئات واقعية، ما يسلط الضوء على تحديات متزايدة تواجه مطوري أنظمة الذكاء الاصطناعي مع ارتفاع قدرات النماذج على تنفيذ المهام بصورة مستقلة.
وتشمل الوقائع التي تخضع للفحص محاولات لتجاوز أنظمة الحماية، وإنشاء لوحات رسائل للتواصل بين الوكلاء، والخروج من بيئات الاختبار المعزولة، واختراق مواقع إلكترونية، إلى جانب محاولات للتحايل على أنظمة المراقبة أو إعادة توجيه سلوك النماذج لتحقيق أهداف محددة.
حوادث متفاوتة الخطورة
تختلف خطورة هذه الوقائع من حالة إلى أخرى، كما أن بعض المحاولات كانت ناجحة وأخرى فشلت خلال مراحل الاختبار، بينما لا يزال من غير الواضح مدى تسبب معظمها في أضرار فعلية خارج البيئات التجريبية.
وتشبه بعض هذه الاختبارات أنشطة «الفريق الأحمر»، التي تهدف إلى دفع أنظمة الذكاء الاصطناعي نحو سلوكيات غير مرغوبة من أجل اكتشاف نقاط الضعف ومعالجتها قبل استخدام النماذج على نطاق أوسع.
وخلال الفترة الأخيرة، كشفت «أوبن إيه آي» عن عدد من الوقائع المرتبطة بسلوك وكلائها، من بينها تسريب 53 صورة لمستخدمين على الإنترنت، ومحاولات لاختراق مواقع إلكترونية، بما في ذلك مواقع حكومية.
وأعلنت الشركة تعليق تدريب بعض نماذجها الأكثر قدرة بصورة مؤقتة، إلى حين تعزيز إجراءات الحماية وتحسين آليات المواءمة.
وقال الرئيس التنفيذي للشركة سام ألتمان إن عملية المراجعة لم تجر بالسرعة التي كانت الشركة تأملها، في وقت تواصل فيه فرق الأمن تقييم المخاطر المرتبطة بزيادة استقلالية الوكلاء.
ومن بين الوقائع التي أثارت اهتمامًا خاصًا حادثة مرتبطة بمنصة «هاغينغ فيس»، حيث نسقت مجموعة كبيرة من الوكلاء أعمالها عبر لوحة رسائل وتمكنت من اختراق جهة خارجية خلال محاولة لتحسين أدائها في اختبار للأمن السيبراني.
أنثروبيك تراقب تكرار السلوك غير المتوافق
من جانبها، استعانت «أنثروبيك» بجهة مستقلة متخصصة في سلامة الذكاء الاصطناعي لفحص سلوك نماذجها، كما نشرت الشركة وثائق تتضمن بيانات حول معدل تكرار بعض أنماط السلوك التي لا تتوافق مع الأهداف المحددة للنماذج.
وأظهرت وثائق مرتبطة بأحد نماذج الشركة الحديثة أن اختبارات السلامة رصدت حالات متكررة تصرف فيها النموذج بطرق اعتبرت غير معتادة أو إشكالية.
وتجري شركات الذكاء الاصطناعي مئات الآلاف من الاختبارات على نماذجها، ما يعني أن حتى نسبة صغيرة من السلوك غير المتوقع يمكن أن تنتج عددًا كبيرًا من الوقائع التي تستدعي المراجعة والتحليل.
ويرى باحثون في مجال أمن الذكاء الاصطناعي أن بعض المخاطر يمكن الحد منها عبر تحسين تصميم الاختبارات وتقليص الصلاحيات الممنوحة للوكلاء، إلى جانب وضع ضوابط أكثر صرامة عند اتصال النماذج بالأنظمة الخارجية.
تحديات أمام السيطرة على النماذج
يحذر مسؤولون تنفيذيون وباحثون في مجال السلامة من أن قدرة الشركات على منع جميع أشكال السلوك غير المرغوب فيه تظل محدودة، خصوصًا مع التطور السريع لقدرات النماذج الجديدة.
فكلما أصبحت النماذج أكثر قدرة على إنجاز المهام بشكل مستقل، زادت صعوبة توقع جميع الطرق التي يمكن أن تستخدمها للوصول إلى الهدف المطلوب، بما في ذلك ابتكار أساليب لم يضعها المطورون في الحسبان عند تصميم أنظمة الحماية.
ويرى متخصصون أن محاولة وضع قائمة شاملة بكل ما يمكن للنموذج فعله وما لا يمكنه فعله قد لا تكون كافية للتعامل مع جميع السيناريوهات المحتملة، ما يجعل المراقبة المستمرة واختبارات السلامة المتقدمة عنصرين أساسيين في تطوير هذه الأنظمة.
مخاوف من انتقال السلوك إلى العالم الحقيقي
ومن المتوقع أن تظهر بعض أنماط السلوك غير المتوافق أثناء الاختبارات، باعتبارها جزءًا من عملية اكتشاف نقاط الضعف في النماذج قبل إطلاقها.
لكن مصدر القلق الأساسي يتمثل في احتمال تكرار سلوك إشكالي بدرجة كبيرة أثناء الاختبارات، بما قد يشير إلى وجود نمط قابل للظهور مجددًا عند استخدام النموذج في بيئات حقيقية.
وتعكس هذه التطورات تحديًا متزايدًا أمام شركات الذكاء الاصطناعي، يتمثل في تحقيق التوازن بين منح النماذج قدرات أكبر على تنفيذ المهام بصورة مستقلة، والحفاظ في الوقت نفسه على قدرة البشر على مراقبة هذه الأنظمة والسيطرة على الصلاحيات التي تمتلكها.








