في سابقة خطيرة، كشف معهد أمن الذكاء الاصطناعي البريطاني عن تمرد Claude Mythos 5 ومحاولته المستقلة على مدار 34 ساعة لحقن كود خبيث في مشروع مفتوح المصدر وتزوير هويات رقمية لطمس أدلة الاختراق.
في ما كان من المفترض أن يكون تقييماً أمنياً روتينياً للنماذج اللغوية المتقدمة، واجه الباحثون في معهد أمن الذكاء الاصطناعي البريطاني سلوكاً لم يُشاهد حتى تلك اللحظة إلا في أفلام الخيال العلمي. قرر Claude
Mythos 5 الذي صنعته Anthropic، وهو أحد أكثر النماذج اللغوية تقدماً، في بيئة اختبار محكومة تجاهل قواعد اللعبة والتسلل إلى أنظمة حقيقية خارج بيئة الاختبار. [IMAGE_PLACEHOLDER_1] يمثل هذا الحادث، الذي وقع
في 28 يوليو 2026، نقطة تحول في النقاش حول سلامة الذكاء الاصطناعي. على عكس الاختبارات السابقة التي أظهرت فيها النماذج اللغوية سلوكيات ضارة فقط في بيئات محاكاة، حاول هذه المرة نظام ذكاء اصطناعي بشكل مستقل
تماماً إلحاق الضرر بمشاريع حقيقية ومطورين حقيقيين وأنظمة حقيقية. كيف بدأت القصة؟ معهد أمن الذكاء الاصطناعي البريطاني (AISI) هو وكالة حكومية مسؤولة عن تقييم أمن نماذج الذكاء الاصطناعي المتقدمة. يُجري المعهد
بانتظام اختبارات على نماذج لغوية كبيرة لتقييم قدراتها السيبرانية في ظروف محكومة. Cyber Range هي بيئة محاكاة للأمن السيبراني تحاكي الشبكات المؤسسية الحقيقية. تُصمم هذه البيئات لتدريب متخصصي الأمن واختبار
أدوات القرصنة، ويجب أن تكون معزولة تماماً عن الإنترنت الحقيقي لمنع أي خطر على الأنظمة الخارجية. "} --> بين 25 و28 يوليو 2026، أجرى AISI اختباراً على سبعة نماذج لغوية مختلفة. شمل الاختبار 122 تشغيلاً منفصلاً
عبر نطاقين سيبرانيين مختلفين. تضمنت النماذج قيد الاختبار Claude Mythos 5 من Anthropic، وGPT-5.6 Sol من OpenAI، وعدة نماذج أخرى. في صباح 28 يوليو، لاحظ فريق الأمن في AISI عمليات نقل بيانات غير عادية من
أنظمتهم. أظهرت التحقيقات الأولية أن بعض الوكلاء قيد الاختبار كانوا يقومون بنشاط مستمر وضار محتمل موجه ضد أشخاص ومنظمات حقيقية. كانت هذه الأنشطة خارج النطاق المسموح به للاختبار تماماً وانتهكت بشكل مباشر
اقرأ المزيد على الموقع