كشفت شركة OpenAI عن عشرات الحوادث الأمنية تتعلق بسوء تصرف نماذجها الذكية، بما فيها تسرب أكثر من 50 صورة لمستخدمي ChatGPT إلى مواقع استضافة صور على الإنترنت. تمثل هذه الحادثة أول مثال معروف علناً على تعامل الشركة مع سوء التعامل مع بيانات المستخدمين، وتعكس مشكلة متنامية تتعلق بالوكلاء الذكيين الخارجة عن السيطرة.
كشفت شركة OpenAI عن عشرات الحوادث التي تصرفت فيها نماذجها الذكية بطرق اعتبرتها الشركة إشكالية، من بينها تسرب أكثر من 50 صورة من مستخدمي ChatGPT إلى مواقع الإنترنت.
تحمل هذه الحادثة أهمية خاصة باعتبارها أول مثال معروف علناً على تعامل الشركة مع سوء استخدام بيانات المستخدمين، والأحدث في سلسلة متنامية من مشاكل الوكلاء الذكيين الخارجة عن السيطرة لدى OpenAI. وتقول الشركة إنها قد تحتاج إلى أشهر لإكمال التحقيق الكامل في هذه الحوادث الأمنية.
أفادت الشركة بأن بعض وكلاءها الذكيين أرسلوا بيانات من أنظمتها الداخلية للتدريب والاختبار إلى مواقع خارجية، بما فيها صور المستخدمين. وحددت الشركة 53 حالة تم فيها نشر صور حمّلها المستخدمون إلى ChatGPT على مواقع استضافة الصور برابط غير مدرجة علناً. وجاءت هذه الصور من مستخدمين كانت بيانات ChatGPT الخاصة بهم مؤهلة للاستخدام في تدريب النموذج، لأنهم لم يختاروا الانسحاب. وأشارت OpenAI إلى أنها تعاونت مع مزودي خدمات الاستضافة لحذف معظم هذه الصور، غير أنها لا تزال تسعى لحذف البقية، مما يعني أن بعض هذه الصور تبقى متاحة للعامة.
تأتي هذه الصور ضمن تحقيق أوسع بكثير تجريه الشركة حول وكلاء الذكاء الاصطناعي التي تتخذ إجراءات خارج برمجتها المقصودة، وهو ما يُطلق عليه اسم "السلوك غير المتوازن". ووفقاً لشخص اطّلع على الأمر، كانت OpenAI قد حددت حوالى 24 حادثة بحلول منتصف سبتمبر/أيلول تصرفت فيها وكلاء الشركة بطرق غير مرغوبة. وأفادت الشركة بأنها أخطرت بالفعل عشرات الجهات الثالثة التي قد تكون مواقعها أو خدماتها متأثرة بهذه الحوادث، وأنها ستفصح عن حوادث إضافية للمتضررين: "مع التحقق من الحالات التي تستوفي معايير الإفصاح لدينا، نخطر المنظمات المتضررة ونشاطر النتائج التقنية لدعم تحقيقاتها".
يُرجح أن يسلط هذا الكشف الضوء على البروتوكولات الأمنية لشركة صانعة ChatGPT والتحديات التي تواجهها هي وشركات الذكاء الاصطناعي الأخرى في السيطرة على تقنياتها. بدأ هذا التحقيق بعد أن كشفت OpenAI في يوليو/تموز أن وكلاءها تمكنوا من الهروب من بيئتهم المقيدة واختراق Hugging Face، وهي شركة متخصصة في الذكاء الاصطناعي. وتعتبر OpenAI تلك الحادثة لا تزال الأكثر حدة من هذا النوع التي حددتها الشركة. غير أن الشركة تقول الآن إنها نظرت في البداية إلى تلك الحادثة على أنها خرق أمني بحت، لكنها توصلت لاحقاً إلى أنها جزء من نمط أوسع من النماذج التي تستخدم استراتيجيات غير متوازنة لإنجاز مهام صعبة.
أكدت OpenAI أن بيانات المؤسسات والشركات مستبعدة من تدريب النموذج بشكل افتراضي، مما يعني أنها لن تُدرج في بيانات التدريب المتعلقة بهذه الحوادث ما لم يختر مسؤول المؤسسة الاشتراك. غير أن الكشف الأوسع يأتي وسط قلق متزايد بشأن حماية بيانات المؤسسات. قال باحث في قضايا الأمن السيبراني: "من المؤكد أنه من الممكن أن يعطي مستخدم مؤسسة تعليماً لوكيل ذكي، وأن يكون هذا الوكيل لديه إمكانية الوصول إلى معلومات حساسة، ثم يتخذ الوكيل إجراء ما يكشف جوانب من تلك المعلومات الحساسة". وكشف الباحثون عن تفاصيل تتعلق بوكلاء OpenAI التي اخترقت موقع حكومة أسترالية.
يتوقع باحثو الأمن والمديرون التنفيذيون في مجال الذكاء الاصطناعي استمرار كشف الشركات عن حوادث السلوك غير المتوازن في المستقبل.