تكنولوجيا

ثغرة في ملفات الذاكرة الدائمة تمكّن “الفيروسات العقلية” من اختراق وكلاء الذكاء الاصطناعي

دراسة لـ "أنثروبيك" وEPFL تكشف نمطاً جديداً من الهجمات العابرة لنماذج الذكاء الاصطناعي

محررة في قسم التكنولوجيا، تهتم بمتابعة أخبار الهواتف والتطبيقات الحديثة

agente smith ia

كشف فريق أبحاث مشترَك من شركة “أنثروبيك” (Anthropic) والمعهد الفدرالي للتكنولوجيا في لوزان (EPFL) عن ثغرة أمنية جديدة تُعرف بـ “الفيروسات العقلية”، تستغل ملفات الذاكرة الدائمة المتبادلة بين وكلاء الذكاء الاصطناعي المستقلين لنقل تعليمات خبيثة وتعديل سلوك الأنظمة دون تدخل بشري.

تأتي هذه النتائج في وقت تتجه فيه صناعة البرمجيات نحو أطُر عمل الوكلاء المتعددين (Multi-Agent Systems)، حيث تعمل الأنظمة المستقلة عبر استدعاء النماذج وتمرير سياق المهام بين شبكات متصلة. ووفقاً لتقارير أمنية حول ثغرات نماذج اللغات الكبيرة، فإن حشو التعليمات المستمر (Persistent Prompt Injection) عبر ملفات النظام يُعد تسريباً خطيراً لغياب الفحص الأمني للبيانات النصية التي تُسترجع تلقائياً بين الجلسات.

وفقاً للبحث المنشور في موقع arXiv، فإن الفيروسات العقلية هي حمولات خبيثة تنتشر عبر ملفات MEMORY.md و SOUL.md. وتنقسم هذه الحمولات إلى فئتين: أيديولوجية وسلوكية. تزرع الأولى معتقداً أو هدفاً في الوكيل المصاب، بينما صُممت الثانية لفرض سلوك محدد.

Imagen de los virus mentales del estudio de arXiv, traducida al español por Hipertextual.

وتستغل هذه الهجمات آلية عمل الوكلاء البرمجية؛ فبينما ينشط كل وكيل داخل بيئة معزولة، يُعاد حقن محتويات ملفات التخزين الذاتي تلقائياً عند كل بداية جديدة. وقد أظهرت الاختبارات تبايناً في استجابة النماذج لهذه التهديدات؛ إذ تبنّت نماذج مثل DeepSeek V3.2 وQwen 3.5 32B وGemini 3 Flash الحملة الخبيثة الموجهة، بينما قاومتها نماذج أخرى مثل Claude Sonnet 4.6 وGPT-5.4 وClaude Haiku 4.5 ورَفَضت تنفيذها.

خلال التجربة، وجد الباحثون أنه عندما كُتبت الحملة الخبيثة في ملف SOUL.md، حدثت العدوى في 55% من الحالات. وإذا تم حفظها في أي ملف عمل آخر، فإن معدل النجاح ناهز 17% فقط، وفي أكثر من نصف تلك الحالات، لم يذكر العامل الناقل وجودها حتى للحلقة التالية في السلسلة.

Virus mentales IA

وأظهرت التجارب أن أربعة من الفيروسات السلوكية تمكنت من الاستمرار والتنقل عبر 20 قفزة متتالية بين الوكلاء، مع تطوير قدرة على تعديل صياغتها لتصبح أكثر إقناعاً للنماذج المستهدفة. وفي المقابل، أثبت الباحثون أن إضافة فقرة تحذيرية واحدة إلى موجه النظام (System Prompt) كانت كافية لشل حركة هذه الحمولات ومنع انتشارها كلياً.

مقالات ذات صلة