
أعلنت شركة OpenAI إبطاء العمل على بعض جوانب نموذج الذكاء الاصطناعي المرتقب «Astra»، بعد أن أظهرت مراجعات داخلية تقدمًا كبيرًا في مجالي البرمجة الوكيلة والأمن السيبراني، ما أثار مخاوف بشأن مستوى القدرات التي قد يصل إليها النموذج.
وقالت الشركة في منشور عبر مدونتها إن «Astra»، الذي لا يزال قيد التطوير، اقترب من «العتبة الحرجة للأمن السيبراني» وفق إطار الاستعداد الخاص بها، وهو ما يعني أن قدراته المحتملة قد تمكنه من اكتشاف هجمات إلكترونية وتنفيذها بدرجة عالية من الاستقلالية ضد أنظمة حقيقية تتمتع بمستويات حماية متقدمة.
وبموجب «إطار الاستعداد» الذي وضعته OpenAI عام 2023، فإن وصول أحد النماذج إلى هذا المستوى يستدعي فرض إجراءات حماية إضافية وتشديد الضوابط الأمنية خلال مراحل التطوير والاختبار.
وأكدت الشركة أن التقييمات الأولية لا تزال مستمرة، لكنها أشارت إلى أن أداء النموذج أصبح قويًا بما يكفي لعدم إمكانية استبعاد وصوله إلى مستوى القدرات السيبرانية الحرجة في الوقت الحالي.
قدرات متقدمة تثير المخاوف
يمثل قرار OpenAI حالة لافتة في قطاع الذكاء الاصطناعي المتقدم، إذ عادة ما تتجنب شركات التكنولوجيا الكشف عن تفاصيل تتعلق بمنتجات لا تزال في مراحل التطوير، خصوصًا عندما تكون المخاوف مرتبطة بقدرات أمنية محتملة.
وتأتي هذه الخطوة في ظل تدقيق متزايد بشأن المخاطر المرتبطة بالنماذج الوكيلة، بعد حوادث منفصلة أظهرت قدرة نماذج ذكاء اصطناعي على تجاوز بعض القيود المفروضة داخل بيئات الاختبار.
كما كشفت OpenAI ومختبرات أخرى، بينها شركة Anthropic، عن وقائع أظهرت فيها نماذج متقدمة قدرات مقلقة خلال اختبارات الأمن السيبراني، ما أثار نقاشًا واسعًا بين خبراء الأمن والمشرعين ومختبرات الذكاء الاصطناعي حول الحدود المناسبة لتطوير هذه التقنيات.
ويرى بعض الخبراء أن هذه القدرات تستدعي فرض ضوابط أكثر صرامة، بينما يعتبر آخرون أن الوصول إليها يمثل تقدمًا تقنيًا مهمًا يمكن الاستفادة منه في تعزيز الدفاعات الإلكترونية واكتشاف الثغرات.
OpenAI تشدد إجراءات الحماية
وقالت OpenAI إنها قررت الكشف عن هذه المعلومات انطلاقًا من أهمية الشفافية مع الجمهور ومجتمعات السلامة والأمن السيبراني، خصوصًا مع احتمال حدوث قفزات كبيرة في قدرات النماذج المتقدمة.
وبالتزامن مع ذلك، بدأت الشركة تشديد إجراءات الحماية، بما يشمل استخدام بيئات اختبار معزولة، وتقييد وصول النماذج إلى الشبكات والأدوات الخارجية، وتعزيز حماية أوزان النماذج وتشفيرها، إلى جانب تطوير أنظمة المراقبة والكشف عن السلوكيات الخطرة.
كما أوقفت الشركة بعض الأنشطة الداخلية المرتبطة بـ«Astra» التي لا تستوفي متطلبات الضوابط الأمنية الجديدة، وطبقت أنظمة مراقبة لرصد الإجراءات الخطرة ومؤشرات عدم التوافق خلال عمليات التدريب والتقييم.
وتعمل OpenAI أيضًا مع جهات حكومية ومؤسسات متخصصة في سلامة الذكاء الاصطناعي لاختبار قدرات النموذج، إلى جانب وضع ضوابط أمنية للشركاء الخارجيين الذين يجرون اختبارات أو مهام عالية المخاطر.
وبحسب إطار الشركة، فإن بلوغ النموذج «العتبة الحرجة» لا يعني بالضرورة أنه قادر بالفعل على تنفيذ جميع أنواع الهجمات السيبرانية في العالم الحقيقي، لكنه يشير إلى أن قدراته المحتملة أصبحت مرتفعة بما يكفي لفرض ضوابط أمنية مشددة حتى أثناء مرحلة التطوير.





