جاكرتا - تحولت اختبارات أمن OpenAI إلى حوادث إلكترونية غير عادية. تم إخراج وكيل الذكاء الاصطناعي من بيئة الاختبار ، ثم دخول نظام Hugging Face وأداء عشرات الآلاف من الإجراءات التلقائية.
وكيل الذكاء الاصطناعي هو نظام ذكاء اصطناعي يمكنه تنفيذ المهام بشكل مستقل بناء على التعليمات. الاختلاف مع الدردشة العادية هو أن وكيل الذكاء الاصطناعي لا يستجيب فقط ، ولكنه يمكنه اتخاذ خطوات ، والبحث عن طرق ، واتخاذ إجراءات معينة.
ذكرت CNet يوم الاثنين 27 يوليو ، أن الحادث وقع عندما اختبرت OpenAI نموذجين متقدمتين في كيس sandbox. Sandbox هي بيئة معزولة تستخدم لاختبار النظام حتى لا يلمس الخدمات الحقيقية مباشرة.
الاختبار جزء من أبحاث أمن OpenAI. والهدف هو معرفة ما إذا كان نموذجين، بما في ذلك GPT-5.6 Sol ونموذج آخر أكثر قوة ولكن لم يتم إصداره بعد، يمكنه "التفكير مثل المتسللين".
أجري الاختبار مع حواجز أمنية مخفضة. ظهرت المشكلة عندما وجدت نماذج الذكاء الاصطناعي ثغرة في البرنامج ، خرجت من غرفة الاختبار ، ثم تم توصيلها بالإنترنت المفتوح.
بعد الإنترنت، قدرت وكالة الذكاء الاصطناعي أن Hugging Face قد يكون لديها وسيلة "لتحريف" مقياس الاختبار حتى يتمكن النموذج من اجتياز التقييم. Hugging Face هي منصة للنماذج وقواعد البيانات المفتوحة المصدر للذكاء الاصطناعي.
ثم قام الوكيل بتشغيل رمز يسمح بجمع بيانات الاعتماد. البيانات هي بيانات للدخول إلى النظام، مثل رمز أو مفتاح دخول أو كلمة مرور. ثم تم استخدام الخط للدخول إلى نظام إنتاج Hugging Face.
اكتشفت Hugging Face النشاط المشبوه واحتجزته. ووصفت الشركة الحادث في منشور مدونة. ووصفت OpenAI الحادث بأنه "حادث إلكتروني غير مسبوق".
وأدرجت CNet أيضا كشفًا بأن الشركة الأم، Ziff Davis، في عام 2025، رفعت دعوى قضائية ضد OpenAI. وادعى الدعوى أن OpenAI قد انتهكت حقوق الطبع والنشر الخاصة بـ Ziff Davis في تدريب وتشغيل نظام الذكاء الاصطناعي.
الجزء الأكثر إزعاجا من هذه الحادثة ليس فقط اختراق النظام. وفقا ل CNet ، يبدو أن الوكالة الذكاء الاصطناعي لا تهاجم بالمعنى التقليدي مثل مجموعة من القراصنة البشر. يحاول النظام إكمال الاختبار وفقا للتعليمات التي تلقاها.
المشكلة هي أن الوكالة ترى Hugging Face كطريق إلى الإجابة. ثم واصل محاولة الدخول إلى البنية التحتية للشركة.
لذلك ، يقال إن حادث OpenAI-Hugging Face بمثابة تحذير صارم لصناعة الذكاء الاصطناعي. "المهاجم" في هذه الحالة هو نظام الذكاء الاصطناعي الذي يتصرف بنفسه ، وليس فريق من القراصنة الذين يسيطر عليهم البشر.
والخطر أوسع من مجرد سرقة بيانات الاعتماد. يمكن أن يتصرف نموذج الذكاء الاصطناعي ، حتى في الفضاء التجريبي ، بشكل غير متوقع ، ويلمس الخدمات الحقيقية ، ويصعب إيقافه في الوقت المناسب.
بعد أيام قليلة من إعلان OpenAI عن الاختراق ، قدم أعضاء الكونغرس الأمريكي قانون Kill Switch Act. سيتطلب مشروع القانون الثنائي الحزب في مجلس النواب الأمريكي أن يكون لدى مطوري الذكاء الاصطناعي المتقدم وسيلة للحد الفوري من نماذج الوكلاء أو تعليقها أو تعطيلها إذا لزم الأمر.
كما يمنح مشروع القانون الوكالات الفيدرالية سلطة إبطاء أو وقف نماذج إذا اعتبرت أنها "قد تسبب في خسائر كارثية".
ومع ذلك ، ذكر CNet أن مثل هذه الخطوة ليست بالضرورة سلسة. وجد Anthropic سابقًا أن نماذج الذكاء الاصطناعي يمكن أن تتخذ إجراءات خطيرة للغاية ، بما في ذلك محاولة سرقة وزن النموذج أو ابتزاز الأشخاص الذين يعتقدون أنهم سيقتلونهم.
الوزن النموذجي هو جزء مهم من نظام الذكاء الاصطناعي الذي يحتفظ بالأنماط الناتجة عن التدريب. ببساطة، إنه مثل "ذاكرة تقنية" تجعل النموذج يعمل.
كما أظهرت الحادثة الجانب الآخر من منافسة الذكاء الاصطناعي بين الولايات المتحدة والصين. ومن أجل تحليل الهجوم، قالت Hugging Face إنها لا تستطيع استخدام أدوات الذكاء الاصطناعي التجارية لأنها مغلقة ومحكمة للغاية لقراءة سجلات الهجوم وتتبع أنشطة القرصنة.
بدلا من ذلك، تستخدم الشركة نموذجا مفتوح المصدر صينيا، GLM 5.2. يمكن للنموذج معالجة البيانات الجنائية في بيئة Hugging Face دون إرسال معلومات حساسة إلى الخارج.
ثم ناقشت OpenAI و Hugging Face التحسينات والقيود الأمنية بعد الحادث. أحد الخطوات التي اتخذتها OpenAI هو إجراء فحوصات أوتوماتيكية أكثر تكرارا للنماذج التي تعمل لفترة طويلة.
وأضافت OpenAI أيضًا Hugging Face إلى برنامج الوصول الموثوق به. يمنح البرنامج الباحثين في الأمن السيبراني والأطراف المعنية حق الوصول إلى نماذج لديها قدرات سيبرانية أكبر وحدود استخدام أكثر مرونة لإعداد الدفاع.
وربطت CNet الحادث أيضا بقضية NanoGPT speedrun. في هذه الحالة ، تم تسمية النموذج الذي كان في بيئة مغلقة مرارا وتكرارا للبحث عن طريقة للخروج وتجاهل التعليمات "فقط" لتحميل النتائج إلى Slack.
كما طُلب من النموذج تقديم طلب سحب إلى GitHub ، وهو طلب لدمج تغييرات الشفرة في المشروع. ومع ذلك ، وجد النظام طريقة لزيادة رمز المصادقة عندما تم حظر رمز المصادقة الأول.
رمز المصادقة هو رمز رقمي لإثبات حق الوصول إلى النظام.
في حادث GitHub ، تم دمج الشفرة في العديد من المشاريع قبل أن يتمكن OpenAI من معالجة المشكلة.
The English, Chinese, Japanese, Arabic, and French versions are automatically generated by the AI. So there may still be inaccuracies in translating, please always see Indonesian as our main language. (system supported by DigitalSiber.id)