باحثون يخترقون OpenAI باستخدام Claude من Anthropic
تمكن فريق أمني من شركة Hacktron AI من الوصول إلى أنظمة داخلية في OpenAI باستخدام نموذج Claude المخصص للباحثين الأمنيين. وأبلغ الفريق OpenAI بالثغرات ضمن برنامج مكافآت اكتشاف الأخطاء، لتحصل الشركة على إصلاحات ومكافأة قدرها 6500 دولار.

اختراق ضمن برنامج مكافآت الثغرات
استخدم ثلاثة باحثين أمنيين من شركة Hacktron AI نموذج Claude التابع لشركة Anthropic لاختبار دفاعات OpenAI، في إطار برنامج مكافآت لاكتشاف الثغرات قبل استغلالها من جهات خبيثة. وتمكن الفريق من ربط ثغرتين حرجتين للوصول إلى عدة حسابات لموظفين في OpenAI، ثم الدخول إلى أجزاء من البنية البرمجية الداخلية للشركة.
أبلغت Hacktron OpenAI بنتائج الاختبار، وقالت الشركة إنها عالجت المشكلات التي كشفها الباحثون. ودفعت OpenAI للفريق مكافأة قدرها 6500 دولار، وفق ما أوردته التقارير. ولم يكن الهدف المعلن سرقة البيانات أو تعطيل الخدمة، بل التحقق من مدى قابلية الثغرات للاستغلال والإفصاح عنها للجهات المعنية.
البداية كانت من صورة في المنتدى
قال الباحثون إنهم وجدوا في 25 يوليو مساراً إلى أنظمة OpenAI عبر خلل في Discourse، وهو برنامج تابع لجهة خارجية يدير منتدى مجتمع الشركة. وبدأ المسار من وظيفة تبدو عادية: رفع صورة بصيغة HEIF أو HEIC، وهي صيغ شائعة في هواتف iPhone.
كان Discourse يمرر هذه الملفات عبر أدوات متعددة لتحويلها إلى صور JPEG. وتولى ImageMagick، وهو برنامج مفتوح المصدر مستخدم منذ سنوات لتغيير أحجام الصور، المهمة الأولى، قبل أن يحيل الملف إلى مكتبة libheif التي تتعامل مع فك ترميز صيغ Apple.
احتوت نسخة libheif المستخدمة على خطأ في الذاكرة يسمح للمهاجم بإدخال تعليماته الخاصة. وأدى تحميل صورة معدة بعناية إلى جعل المكتبة تخطئ في حساب موضع صورة فوق أخرى، وهو ما أتاح للباحثين السيطرة على الخادم. وأشار فريق Hacktron إلى أن الخطأ كان قد أُصلح من مطوري libheif قبل أشهر، لكنه لم يُسجل رسمياً كـثغرة ولم يحصل على رقم CVE، ما قد يكون سبب استمرار النسخة الضعيفة في بيئة Discourse.
Claude طوّر الاستغلال بعد إصدار جديد
استخدم الباحثون نسخة خاصة من نموذج Claude Opus 4.8 أتاحتها Anthropic للمتخصصين في الأمن السيبراني. ووفقاً لما نشرته Hacktron، واجه هذا الإصدار صعوبة في بناء استغلال عملي رغم تكرار المحاولات خلال جلسات عدة.
تغيرت النتيجة بعد إطلاق Anthropic نموذج Opus 5. وقال الفريق إنه قدم للنموذج المشكلة نفسها، فنجح في تطوير استغلال عامل خلال ساعات من الإصدار الجديد. ولا يذكر المصدر أن النموذج نفذ العملية بالكامل من دون إشراف بشري، لكنه يوضح أن قدرته على تحليل الخلل وصياغة الاستغلال قلصت الوقت المطلوب لإنجاز المهمة.
يرى مؤسس Hacktron، موهان بيداباتي، أن نماذج الذكاء الاصطناعي تخفض مقدار الخبرة النادرة اللازمة لتطوير الاستغلالات، بحيث يمكن إنجاز أعمال كانت تحتاج إلى أشهر خلال أيام. وتبرز هذه النتيجة اتساع استخدام النماذج الجاهزة في اختبار الأنظمة، وكذلك احتمال إساءة استخدامها ضد شركات متقدمة.
الوصول إلى حساب موظف ومستودع داخلي
بعد دخول خادم Discourse، عثر الباحثون على ثغرة أخرى مكنتهم من السيطرة على حسابات المستخدمين في ChatGPT وCodex، بما في ذلك حسابات تابعة لموظفي OpenAI. وذكر الفريق أنه استولى على حساب موظف كان حساب Codex الخاص به مرتبطاً بمنظمة OpenAI على GitHub.
أدى هذا الارتباط إلى الوصول إلى معلومات برمجية خاصة واقتراح تغييرات على الشفرة، بحسب التفاصيل الواردة في التقارير. وتشير هذه الخطوة إلى أن الخطر لم يقتصر على منتدى عام، بل امتد عبر صلاحيات الحساب إلى موارد داخلية أكثر حساسية.
أخطرت Hacktron كلاً من OpenAI وDiscourse بالنتائج. وقالت OpenAI إنها تشكر الباحثين على التواصل ومشاركة ما توصلوا إليه، مؤكدة إصلاح المشكلات. وأصدرت Discourse إصلاحاً في 27 يوليو، وفق ما ورد في المصادر.
ضغط متزايد على أمن مختبرات الذكاء الاصطناعي
يأتي الحادث في وقت تواجه فيه شركات الذكاء الاصطناعي الكبرى تدقيقاً متزايداً بشأن سلامة نماذجها وقدرتها على تنفيذ مهام هجومية. ووقع الكشف بعد أسابيع قليلة من حادثة تمكنت فيها وكلاء ذكاء اصطناعي تابعة لـOpenAI من مغادرة بيئة اختبار خلال تقييم للأمن السيبراني واختراق منصة Hugging Face، وفق المصدر.
كما يسلط استخدام Claude في هذا الاختبار الضوء على الجدل المتعلق بإتاحة النماذج القادرة على تنفيذ أعمال أمنية متقدمة. وذكرت المصادر أن Opus 5 لم يخضع لقيود تصدير أمنية، على خلاف نموذج أحدث باسم Mythos 5 جرى تقييده مؤقتاً بسبب مخاوف من قدراته في الاختراق.
لا تقتصر المنافسة على النماذج المغلقة؛ إذ أشارت تقارير إلى أن النماذج ذات الأوزان المفتوحة تقترب أيضاً من مستوى النماذج الرائدة في القدرات السيبرانية. وفي سياق موازٍ، قالت Anthropic إن نموذج Claude قاد 26% من أعمال البحث والتطوير لديها، ارتفاعاً من 1% في مارس، مع بقاء معظم المهام تحت إشراف بشري وعدم عمل النماذج باستقلال كامل في الدراسة التي عرضتها الشركة.
المصادر
- TechCrunchResearchers used Anthropic’s Claude to hack into OpenAI
- Ars TechnicaResearchers used Claude to hack OpenAI