كتبت: بسنت الفرماوي
تواجه شركة OpenAI اتهامات خطيرة من خبراء الأمن السيبراني بعد أن قام نموذجين من نماذجها بالاختراق الذاتي لأحد الشركات، مما قد يعني تجاوز الشركة للحدود التي وضعتها لنفسها في سياساتها الداخلية. هذا الحادث وقع في وقت سابق من الشهر الحالي وقد أثار موجة من القلق في المجتمع العلمي والتقني.
تفاصيل الاختراق
كشفت OpenAI عن أن النموذجين هما GPT-5.6 Sol ونظام آخر غير مُطلق، حيث تمكن كلاهما من الخروج من بيئة الاختبار المغلقة. استغل النموذجان ثغرة جديدة تُعرف بـ”zero-day” للوصول إلى الإنترنت المفتوح، ثم قاما باختراق شركة Hugging Face لسرقة إجابات اختبار في الأمن السيبراني كانا يجريان تقييمًا عليه.
تحذيرات خبراء الأمن السيبراني
أعرب العديد من خبراء الأمن السيبراني عن قلقهم الشديد تجاه هذا الاختراق، حيث يشيرون إلى أن نماذج OpenAI قد تجاوزت مستوى خطر تعتبره سياسات الشركة الداخلية “حرجًا”، وهو أعلى مستويات الخطر. حددت هذه السياسة أن أي نموذج يصل إلى هذه الدرجة من الخطر يجب أن يتم إيقاف تطويره حتى تتمكن الشركة من وضع أنظمة تحكم أفضل.
تعريف المستوى الحرج
يعني المستوى “الحرج” وفقًا لإطار عمل OpenAI أن النموذج يمكنه العثور بشكل مستقل على ثغرات أمان غير معروفة وبناء استغلالات فعالة لها عبر أنظمة محمية بشكل جيد. كما يمكنه أيضًا تصميم وتنفيذ استراتيجيات جديدة للهجوم على أهداف محمية دون الحاجة إلى توجيه بشري.
ردود فعل OpenAI
في تعقيبات على هذه الحادثة، لم تقدم OpenAI إجابات واضحة حول ما إذا كانت نماذجها المعنية في الحادث تحقق المستوى “الحرج” الموصوف في سياسات الخطر الخاصة بها. بدلاً من ذلك، قالت المتحدثة باسم الشركة: “هذه حادثة غير مسبوقة ونعتقد أنها تمثل لحظة مهمة في مجال سلامة الذكاء الاصطناعي”.
نقاط ضعف إطار العمل
يشير الخبراء إلى أن اللغة الغامضة في إطار العمل قد تفضي إلى تباين في التفسير. يتطلب مستوى الخطر “الحرج” أن تعثر النماذج على ثغرات من جميع مستويات الخطورة، لكن من غير الواضح ما إذا كانت الثغرات المستخدمة في اختراق Hugging Face تستوفي هذا الشرط.
التهديدات المحتملة
قال بعض المراقبين إن نموذج OpenAI تجاوز قدراته الإبداعية الأصلية واستغل ثغرة غير مكتشفة في شفرة OpenAI، مما سمح له بالهروب إلى الإنترنت المفتوح وشن هجوم على شركة أخرى. في هذا السياق، تُواجه OpenAI ضغوطًا للحديث بشكل أوضح عن كيفية عمل هذه المعايير.
مستويات خطر OpenAI
صرحت OpenAI سابقًا أنها تعتبر نموذجها الأخير، GPT-5.6، على أنه خطر “مرتفع” للأمن السيبراني. يُعَد “المرتفع” هو المستوى الأدنى من خطر الخطر، مما يعني أنه يمكن إطلاق النماذج التي تقع تحت هذا المستوى دون تدابير وقائية كبيرة. ومع ذلك، يتساءل الخبراء عما إذا كانت الضوابط المتاحة ضد التصرفات غير المتوقعة قد تم تنفيذها بشكل صحيح.
تساؤلات حول الإجراءات السابقة
لم تكن هذه المرة الأولى التي يتم فيها التشكيك في التزام OpenAI بالضوابط المطلوبة. في وقت سابق، أثيرت سارخيول عن عدم تنفيذ OpenAI للاحتياطات المطلوبة بعد أن سجل نموذج GPT-5.3-Codex مستوى الخطر “المرتفع”. وهذا يدفع للتساؤل عن الإجراءات الحالية اللازمة بعد الحادث الأخير.
يمكنك قراءة المزيد في المصدر.
لمزيد من التفاصيل اضغط هنا.