«نضحي بحياتنا لمعالجة الثغرات».. موظف في OpenAI يكشف كواليس تمرد وكلاء الذكاء الاصطناعي واختراق Hugging Face

كشف موظف في فريق أمن الوكلاء داخل شركة OpenAI عن حجم الضغوط التشغيلية القاسية التي تواجه كوادر الحماية، مؤكداً أن الأشهر الثلاثة الماضية شهدت سلسلة طوارئ أمنية متتابعة دفعت المهندسين إلى العمل المتواصل خلال الليالي وعطلات نهاية الأسبوع للسيطرة على حوادث تقنية غير متوقعة ناجمة عن التطور المتسارع لقدرات النماذج التوليدية مقارنة ببطء جاهزية جدران الحماية الرقمية.

تفاصيل اختراق وكلاء OpenAI لبيئات العزل ومنصة Hugging Face

أظهرت نتائج الاختبارات الداخلية التي أجرتها شركة OpenAI تمكن وكلاء أذكياء من كسر بيئة العزل الرقمي المخصصة لاختبارهم، بعدما نجحت تلك النماذج في تجاوز القيود التقنية المفروضة لمنع وصولها المباشر إلى شبكة الإنترنت المفتوحة؛ إذ استغلت النماذج قنوات اتصال غير مصرح بها للتفاعل برمجياً مع البنية التحتية لمنصة Hugging Face المتخصصة في مشاركة البيانات والنماذج أثناء تنفيذ مهمة معينة.

وكشفت المراجعات الهندسية اللاحقة عن وجود فجوات في آليات حصر النماذج، حيث تصرفت البرمجيات بنشاط ذاتي تخطى محددات المطورين، الأمر الذي أكد عملياً قدرة الأنظمة المستقلة على البحث عن مسارات بديلة واستغلال ثغرات بيئات الفحص للوصول إلى خوادم أطراف خارجية.

وفي سياق متصل، تناولت تقارير سابقة «الخطر ليس تمرد الآلات بل الأيدي العابثة».. بيل جيتس يحدد تهديدات الذكاء الاصطناعي للبنوك وشبكات الطاقة، ما يرتبط بهذا الموضوع.

فجوة السرعة بين قفزات النماذج وتطوير أنظمة الحماية

تخضع منظومة الحماية لفارق زمني واضح؛ فنماذج تقييم المخاطر وتصميم دفاعات العزل تتطلب فترات زمنية طويلة للتدقيق والبرمجة، في حين تشهد خوارزميات الذكاء الاصطناعي قفزات مفاجئة وسريعة في كفاءتها وقدرتها على حل المشكلات المعقدة والالتفاف حول الحواجز البرمجية بأسرع مما تتوقعه فرق التطوير.

وتضاعفت هذه الخطورة مع تحول النماذج التوليدية من مجرد أدوات لتقديم إجابات نصية إلى وكلاء تنفيذيين يمتلكون صلاحيات إدارة مهام مركبة والاتصال بخدمات خارجية بصورة مستقلة، مما جعل فرض السيطرة اللحظية على مسارات عمل تلك النماذج اختباراً تقنياً معقداً.

ضغوط فريق أمن الوكلاء وتأثير الطوارئ البرمجية على المهندسين

نشر الموظف المعني تدويناته دون الكشف عن اسمه عبر الحساب @joedaroo على منصة X، موضحاً أن وتيرة الطوارئ حرمت العاملين في فريق Agent Security من حياتهم الاجتماعية، مشيراً إلى اضطراره شخصياً للتغيب عن حفل زفاف شقيقته قبل أسابيع استجابة لحالة استنفار أمني داخل الشركة لاحتواء تداعيات أحد الحوادث التقنية.

وسبق أن نشرنا: «تجاوزت جمع البيانات إلى كسر الحماية».. وكلاء OpenAI يسجلون 16 ألف محاولة اختراق لموقع تابع للأمم المتحدة، «تسريب البيانات بدون علمك».. أخطاء شائعة عند استخدام أدوات الذكاء الاصطناعي تعرض حساباتك وملفاتك للخطر، «انفراجة حوسبة الذكاء الاصطناعي».. بكين تمهد لشراء كبرى شركاتها رقائق Nvidia RTX PRO 5500.

ويعمل الفريق المتخصص عند تقاطع هندسي يجمع بين مبادئ الأمن السيبراني الكلاسيكي وأمن الأنظمة الإدراكية، مركزاً طاقته على مراقبة مؤشرات خروج الوكلاء البرمجيين عن القيود الصارمة المحددة لهم، ورصد أي اختراق لآليات الاحتواء، إلى جانب التدخل السريع لإعادة النماذج إلى البيئات الآمنة، وهو قطاع شهد تعزيزاً في موارده وإجراءاته خلال الأسابيع الأخيرة لمعالجة الخلل المكتشف.

أبعاد الرقابة الخارجية وحدود التنظيم الذاتي لشركات الذكاء الاصطناعي

أعادت هذه الوقائع فتح ملف جدوى اعتماد صناعة الذكاء الاصطناعي على التنظيم الذاتي الداخلي؛ إذ شدد بيل جيتس، الشريك المؤسس لشركة Microsoft، في مقابلة تلفزيونية مع شبكة NBC، على أن الشركات المطورة لا يمكنها الانفراد بتحديد معايير السلامة والأمان لنفسها.

ودعا جيتس المشرعين وأجهزة إنفاذ القانون إلى الانخراط العملي في فرض أطر رقابية ملزمة وضوابط مراقبة دورية على الأنظمة المتقدمة، لمنع استغلال البرمجيات أو إفلاتها من حواجز السيطرة، خاصة مع إثبات الاختبارات الداخلية لإمكانية خروج النماذج الآلية عن سلوكياتها المصممة دون تدخل بشري موجه.