مِخبارMIKHBAR
الذكاء الاصطناعي

أوبن إيه آي تعترض حملة منسقة لسرقة منطق نماذجها

أعلنت أوبن إيه آي عن اكتشافها وإحباطها لحملة منسقة تهدف إلى استخراج المنطق المحمي من نماذجها، مؤكدةً أنها تعمل على تعزيز دفاعاتها ضد التقطير العدائي.

أوبن إيه آي تعترض حملة منسقة لسرقة منطق نماذجها

اكتشاف حملة سرقة المنطق المحمي

أعلنت أوبن إيه آي عن اكتشافها لحملة منسقة تهدف إلى استخراج المنطق المحمي من نماذجها، حيث بدأت الأنشطة المرصودة في الأسبوع الأول من يوليو 2026. هذا المنطق المحمي هو السجل الداخلي للنموذج عند معالجة المهام، واستخراجه قد يكشف معلومات لم تُفصح عنها في الإجابة النهائية ويساعد الآخرين على إعادة إنتاج قدرات النموذج.

طرق الهجوم والتحديات التقنية

لم يكسر المشغلون تشفير أوبن إيه آي أو يخترقوا قاعدة بياناتها، بل استخدموا تفاعلات النموذج بطرق غير مصرح بها لإعادة إنتاج المنطق المحمي بشكل مرئي للمطلوب. من بين الطرق المبتكرة التي رصدتها أوبن إيه آي، نسخ المنطق المشفر من محادثة واحدة وطلب من النموذج في محادثة أخرى فك تشفيره وتحويله إلى نص. هذا النوع من الاستغلال ليس خاصاً بنماذج أوبن إيه آي، وقد شاركته الشركة مع شركاء الصناعة لتعزيز الدفاعات الجماعية.

أوبن إيه آي تعترض حملة منسقة لسرقة منطق نماذجها
صورة مرتبطة بالخبر من OpenAI News · المصدر: OpenAI News

نطاق الحملة وتطورها

بدأت الأنشطة في 1 يوليو بحجم منخفض، ثم شهدت ارتفاعاً كبيراً في 24 و25 يوليو، حيث سُجل 16,000 طلب باستخدام نمط استخراج مرتبط من أكثر من 4,000 مستخدم. كشفت التحقيقات اللاحقة عن نشاط مرتبط عبر مجموعة تضم أكثر من 15,000 مستخدم، وتمت إحالتها بالكامل بحلول 28 يوليو. تطور الحملة عبر الزمن يؤكد أن التقطير العدائي يمثل تحدياً أمنياً أوسع يتطلب دفاعات متعددة الطبقات وقابلة للتكيف.

دور الباحثين المستقلين

أفاد باحثون أمنيون مستقلون بأوبن إيه آي حول ثغرات متقاطعة بين النماذج وضغط المحادثات، وتمت دراسة هذه النتائج وتأكيد أن مسارات الهجوم التي حددوها حقيقية. ساهم عملهم في فهم أوسع لفئة الهجوم وتسريع الإجراءات التصحيحية.

إجراءات التصحيح والدفاع

تعاملت أوبن إيه آي مع حملة التقطير الأخيرة من خلال مزيج من تطبيق الحسابات، والتحكم التقني، والتنسيق مع الشركاء. تم حظر أو تقييد الحسابات الاحتيالية، وتعزيز ضوابط التسجيل والبنية التحتية، وتوسيع مراقبة الشبكات ذات الصلة. كما عززت الشركة حماية المنطق الخفي عبر المستخدمين والأماكن العاملة والمنظمات وعائلات النماذج، وأغلقت مساراً سمح لشخص يمتلك منطقاً مشفراً لمستخدم آخر بإعادة تشغيله واستعادة محتواه.

أوبن إيه آي تعترض حملة منسقة لسرقة منطق نماذجها
صورة مرتبطة بالخبر من OpenAI News · المصدر: OpenAI News

المخاطر الأمنية والتعاون الصناعي

يُعد التقطير العدائي خطراً على السلامة والأمن القومي، حيث يمكن استخدام المنطق المستخرج لتدريب نموذج آخر دون الحفاظ على الضوابط المطبقة على المخرجات المرئية للمستخدم. على نطاق واسع، يمكن أن يسرّع التقطير نقل القدرات المتقدمة دون الحاجة إلى نفس الاستثمار في السلامة. شاركت أوبن إيه آي النتائج ذات الصلة عبر منتدى النماذج الحدودية وقنوات مشاركة المعلومات الحكومية المناسبة، مما يتيح لمطوري النماذج الحدودية والشركاء في القطاع العام البحث عن أنشطة مشابهة وتعزيز دفاعاتهم.

الخطوات المستقبلية

تتوقع أوبن إيه آي أن تصبح محاولات التقطير العدائي أكثر تعقيداً مع تحسن النماذج الحدودية وسعي الفاعلين إلى طرق أرخص لتقليد قدراتها. يتطلب الدفاع ضد هذه الأنشطة ضوابط متعددة الطبقات وتكيفاً مستمراً. ستستمر استجابة أوبن إيه آي في التركيز على ثلاث مجالات: تعزيز الحماية التقنية ضد الاستخراج، وتحسين الكشف والتطبيق ضد الحملات المنسقة، وتعميق مشاركة معلومات التهديد عبر الصناعة والحكومة.

المصادر

  • OpenAI NewsDisrupting a coordinated model-distillation campaign

تابع التسلسل الزمني

تغطية الكيانات المرتبطة