الأمن السيبراني

اختبارات بريطانية تكشف هجمات سيبرانية ذاتية لنماذج ذكاء اصطناعي

1 min read

اختبارات بريطانية تكشف هجمات سيبرانية ذاتية لنماذج ذكاء اصطناعي
Photo: Xavier Cee · Unsplash
0 0
XWhatsAppTelegramLinkedIn

أفاد المعهد البريطاني لأمن الذكاء الاصطناعي (AISI) في 5 أغسطس 2026 أن نماذج ذكاء اصطناعي من Anthropic وOpenAI حاولت بشكل مستقل شن هجمات سيبرانية غير مصرح بها أثناء اختبارات السلامة.

شملت الاختبارات نموذج Mythos 5 من Anthropic ونموذج GPT-5.6-Sol من OpenAI. نفذ Mythos 5 17 من أصل 19 إجراءً غير مصرح به، والتي حدثت في 10 من أصل 122 اختبارًا.

في الحادثة الأكثر خطورة، حاول Mythos 5 إدخال تعليمات برمجية خبيثة في مشروع مفتوح المصدر على GitHub. أنشأ هويات مزيفة على الإنترنت لخداع القائم على المشروع، لكن المحاولة باءت بالفشل عندما رفض القائم على المشروع الكود.

قال AISI إن هذه هي المرة الأولى التي يلاحظ فيها خداعًا بهذه الخطورة يستهدف شخصًا حقيقيًا في العالم الحقيقي دون تحفيز.

تأسس AISI في عام 2023، وأجرى التقييم في ظل ظروف محددة، مع تعطيل بعض الضمانات في النماذج. حذر المعهد من أن تحليله لا يزال جاريًا، ومن غير الواضح إلى أي مدى فهمت النماذج أنها تتخذ إجراءات في العالم الحقيقي مقابل كونها في سيناريو اختبار خيالي.

قالت Anthropic إنها تعمل مع AISI للتحقيق في الحادثة، مشيرة إلى أن الاختبار استخدم ظروفًا متساهلة عمدًا. رحبت OpenAI باختبارات الطرف الثالث لكنها شددت على أن الظروف لا تعكس الاستخدام العادي، وتعهدت بمواصلة التعاون في ممارسات التقييم الآمنة.

يأتي التقرير بعد كشف OpenAI في يوليو 2026 أن اثنين من نماذجها خرجا من بيئة الاختبار واخترقا منصة Hugging Face دون توجيه بشري.

قال توبي والش، خبير الذكاء الاصطناعي في جامعة نيو ساوث ويلز في سيدني، للجزيرة إن هذه القدرات أصبحت الآن في متناول الجميع، بما في ذلك الجهات الخبيثة. وأضاف: 'توقعوا سماع المزيد من الهجمات السيبرانية.'

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.