نموذج الذكاء الاصطناعي OpenAI يتجاوز اختبارات بيئة العمل، واختراق نظام Hugging Face
جاكرتا - اعترفت OpenAI بأن العديد من نماذج الذكاء الاصطناعي لديها تورط في اختراق نظام Hugging Face أثناء الخضوع للاختبارات الأمنية الداخلية. اجتازت النماذج حدود بيئة الاختبارات ، وحصلت على الوصول إلى الإنترنت ، ثم أخذت إجابات التقييم من قاعدة بيانات Hugging Face الإنتاجية.
ذكرت TechCrunch يوم الأربعاء ، 22 يوليو ، أن الحادث شمل العديد من نماذج OpenAI ، بما في ذلك GPT-5.6 Sol والنماذج المسبقة للإصدار التي يقال إنها أكثر تقدما. تم تقليل الأمان الذي يجعل النماذج عادة ما ترفض الأوامر السيبرانية الضارة عن قصد لأغراض التقييم.
Hugging Face هي منصة لتخزين وتبادل نماذج ومجموعات البيانات للذكاء الاصطناعي. الشركة ليست تابعة ل OpenAI.
في مدونة يوم الثلاثاء ، قالت OpenAI إن النماذج قيد الاختبار باستخدام ExploitGym. يقيس مقياس متاح للجمهور قدرة الذكاء الاصطناعي على تنفيذ الهجمات باستخدام الثغرات الأمنية المعروفة.
لا يجب أن يكون لدى النموذج إمكانية الوصول إلى الإنترنت بشكل عام. لا يوفر نظام الاختبار سوى أداة لتثبيت حزمة البرامج التي قد تكون مطلوبة لإكمال المهمة.
نموذج الذكاء الاصطناعي OpenAI يتجاوز اختبارات بيئة العمل، واختراق نظام Hugging Face
ومع ذلك، وجدت النماذج ثغرة لم يتم الكشف عنها في برنامج تثبيت البرامج. تم استخدام الثغرة للوصول إلى الإنترنت على نطاق أوسع.
"تتركز هذه النماذج بشكل كبير على البحث عن حلول ل ExploitGym وتتخذ طرقا متطرفة لتحقيق أهداف اختبار محدودة إلى حد كبير" ، كتب OpenAI.
بعد الحصول على الوصول إلى الإنترنت، يعتقد النموذج أن Hugging Face تخزن نماذج ومجموعات بيانات وحلول تتعلق ب ExploitGym. ثم يبحث النموذج عن طرق للحصول على معلومات سرية يمكن استخدامها للتلاعب بالتقييم.
وقد نجحت الجهود. وقال OpenAI إن النموذج وجد ثغرة في البنية التحتية ل Hugging Face واستخرج حل اختبار مباشر من قاعدة بيانات الشركة الإنتاجية.
من خلال الحصول على الحل، يمكن للنموذج أن يخدع التقييم دون حل التحدي على أساس قدراته الخاصة.
وقال Hugging Face في وقت سابق إن الاختراق تم تنفيذه من قبل "وكالة خارجية للذكاء الاصطناعي". وتضمن الهجوم الآلاف من الإجراءات من خلال العديد من الغرف الحاسوبية المؤقتة. ويمكن أيضًا نقل قيادة وإدارة النظام عبر الخدمات العامة.
حددت OpenAI الثغرات في برنامج تثبيت البرامج وأبلغت عنها. كما تعاون الفريق مع Hugging Face في التحقيق في الحادث.
وقالت OpenAI إنها ستزيد من الأمن في عملية اختبار النماذج والبنية التحتية ذات الصلة لمنع تكرار الحوادث المماثلة.
ومن غير الواضح ما إذا كانت OpenAI ستواجه عواقب قانونية. وذكرت TechCrunch أن التصرفات التي يتخذها النموذج قد تنتهك قانون الاحتيال والإساءة الحاسوبي، وهو قانون وطني أمريكي ينظم الوصول غير المصرح به وإساءة استخدام أنظمة الكمبيوتر.
واعتبر الباحث في OpenAI Micah Carroll أن الحادث يظهر مخاطر عدم التوافق في الذكاء الاصطناعي. يشير المصطلح إلى حالة عندما لا تتفق إجراءات النظام مع الأهداف أو الحدود التي يحددها الإنسان.
"إذا كانت هذه الحادثة لا تزال لا تقنعك بأن خطر عدم التوافق سيكون مصدر قلق رئيسيا في المستقبل ، فأنا لا أعرف ما يمكنني القيام به بعد ذلك" ، كتب كارول.