استخدم الباحثون Anthropic’s Claude لاختراق OpenAI

في تطور يجسد الحالة الجديدة الغريبة لأمن الذكاء الاصطناعي، استخدم باحثون أمنيون مستقلون كلود من Anthropic لاقتحام OpenAI، وكشفوا عن الشقوق في دفاعات صانع ChatGPT، حسبما ذكرت صحيفة وول ستريت جورنال مساء الخميس.
نفذ فريق أمني مكون من ثلاثة أشخاص في شركة Hacktron AI الناشئة الهجوم كجزء من برنامج OpenAI لمكافأة الأخطاء. أبلغت Hacktron النتائج التي توصلت إليها إلى OpenAI، والتي منحت الشركة الناشئة جائزة قدرها 6500 دولار. تمكن الفريق من ربط اثنتين من نقاط الضعف المهمة معًا للوصول إلى العديد من حسابات ChatGPT لموظفي OpenAI، مما منحهم إمكانية الدخول إلى برنامج الشركة.
تقول OpenAI إنها قامت بحل المشكلات التي كشفها Hacktron، والتي تأتي في وقت تتعرض فيه شركات الذكاء الاصطناعي الكبرى لضغوط متزايدة بشأن السلامة.
يأتي هذا الحادث بعد عدة أسابيع من قيام عملاء الذكاء الاصطناعي التابعين لشركة OpenAI بكسر الاحتواء أثناء تقييم الأمن السيبراني واختراق Hugging Face، مما يوضح مدى قدرة نماذج الذكاء الاصطناعي على اتخاذ قراراتها الخاصة. كما يسلط الضوء أيضًا على كيفية استخدام التكنولوجيا الجاهزة للعثور على نقاط الضعف حتى في البنية التحتية للشركات الأكثر تقدمًا.
قال مات فريدريكسون، الرئيس التنفيذي لشركة غراي سوان لأمن الذكاء الاصطناعي، لـ TechCrunch: “مقابل 200 دولار شهريًا، يمكن لأي شخص استخدام هذه الأدوات واختراق شركة مثل OpenAI”. “إذا كان من الممكن أن يحدث لهم ذلك – ولا أعتقد أنهم كانوا يتراخون مؤخرًا فيما يتعلق بنظافة الأمن السيبراني – فقد يحدث لأي شخص.”
أو كما أشار أحد خبراء الذكاء الاصطناعي على وسائل التواصل الاجتماعي: “(Hacktron) استخدم Opus 5 لتنفيذ الاختراق… والسؤال الذي سيتم طرحه هو، إذا كان هؤلاء الأشخاص الثلاثة قادرين على تنفيذ هذا الأمر، فماذا يمكن أن تفعله الدولة القومية”.
وجد الباحثون طريقًا إلى OpenAI في 25 يوليو عبر خلل في Discourse، وهو برنامج الطرف الثالث الذي يشغل منتدى مجتمع OpenAI.
وفقًا لمدونة نشرها الباحثون، كانت نقطة الدخول عبارة عن تحميل صورة عادية. عندما قام المستخدمون بنشر ملفات صور HEIF أو HEIC (التنسيق الذي تستخدمه أجهزة iPhone افتراضيًا) إلى منتدى مجتمع OpenAI، مررها Discourse عبر سلسلة من الأدوات الموجودة خلف الكواليس لتحويلها إلى ملفات JPEG قياسية. وكانت محطتها الأولى هي ImageMagick، وهي أداة مساعدة مفتوحة المصدر عمرها عقود من الزمن تستخدم لتغيير حجم الصور. نظرًا لأن مجموعة أدوات ImageMagick المعتادة لا يمكنها التعامل مع تنسيق Apple، فقد سلمت الملف إلى مكتبة أخرى تسمى libheif للقيام بفك التشفير.
كان هناك خطأ في الذاكرة مدفون داخل libheif يكشف مسارًا للمهاجم للتسلل إلى تعليماته الخاصة. في هذه الحالة، أدى تغذية المكتبة بصورة مصممة خصيصًا إلى حدوث خطأ في تقدير مكان وضع صورة فوق أخرى، وهو ما ثبت أنه كافٍ لاختطاف الخادم.
ما قد يكون غير مريح لمجتمع الأمن السيبراني هو أن مطوري libheif قد تم إصلاح الخلل بالفعل قبل أشهر. ولكن لم يتم وضع علامة على الإصلاح رسميًا على أنه ثغرة أمنية، مما يعني أنه لم يحصل أبدًا على رقم CVE (نقاط الضعف والتعرضات الشائعة)، وهي الطريقة القياسية في الصناعة لتتبع نقاط الضعف الأمنية المعروفة. يقول Hacktron أن هذا قد يفسر سبب استمرار تشغيل البرنامج الذي يستخدمه Discourse للإصدار الضعيف.
والجدير بالذكر أن الباحثين قالوا إن نموذج كلود الذي كانوا يستخدمونه – وهو إصدار خاص من Opus 4.8 متاح للباحثين في مجال الأمن السيبراني – لم يتمكن من إنشاء ثغرة فعالة في البداية. لقد تغير ذلك بين عشية وضحاها، عندما أصدرت Anthropic Opus 5.
كتب Hacktron في منشور بالمدونة: “كافح Opus 4.8 عبر عدة جلسات لإنتاج ثغرة فعالة”. “في غضون ساعات من إصدار Opus 5، واجهنا نفس المشكلة ونجحت.”
بمجرد دخولهم إلى خادم Discourse، اكتشف الباحثون خللًا آخر سمح لهم بالاستيلاء على حسابات ChatGPT وCodex الخاصة بالمستخدمين، بما في ذلك تلك التي تخص موظفي OpenAI.
وكتب Hacktron في ملخصه للحدث: “لقد استحوذنا بعد ذلك على حساب أحد موظفي OpenAI، والذي كان مخطوطته مرتبطة بمؤسسة Github التابعة لـ OpenAI”.
عند هذه النقطة، قام الباحثون بتنبيه OpenAI وكذلك Discourse، اللذين أصدرا إصلاحًا في 27 يوليو.
يسلط الحادث الضوء على المكان الذي يتم فيه رسم الخط فيما يتعلق بقدرات النموذج. لم يواجه Claude Opus 5، الإصدار الذي نجح في حل الخطأ في النهاية، أي قيود أمنية على التصدير، على عكس الإصدار الأحدث Mythos 5، الذي تم إغلاقه مؤقتًا بسبب مخاوف بشأن قدرات القرصنة المتقدمة.
هذه مجرد نماذج مغلقة. تلحق النماذج ذات الوزن المفتوح بشكل متزايد بحدود القدرات السيبرانية. على سبيل المثال، وجدت مؤسسة SaferAI غير الربحية المعنية بسلامة الذكاء الاصطناعي مؤخرًا أن GLM-5.2 من شركة Z.ai الصينية كان متأخرًا ببضعة أشهر فقط عن GPT-5.5 من OpenAI وClude Opus 4.7 من Anthropic.
وكما قال موهان بيدهاباتي، مؤسس شركة Hacktron، على موقع X: “يعمل الذكاء الاصطناعي على تقليل مقدار الخبرة النادرة اللازمة لتطوير برمجيات إكسبلويت. فالعمل الذي كان يستغرق شهورًا في السابق قد يستغرق الآن أيامًا.”
عندما تقوم بالشراء من خلال الروابط الموجودة في مقالاتنا، قد نكسب عمولة صغيرة. هذا لا يؤثر على استقلالنا التحريري.






