ثغرة جوهرية تُعرِّض النماذج اللغوية الكبيرة لهجمات يصعب صدّها بالكامل
باحثون يكشفون خللاً بنيوياً يجعل النماذج اللغوية الكبيرة عُرضةً لحقن التعليمات وكسر الحماية، وقد أُثبت ذلك على نماذج كبرى من أوبن إيه آي وأنثروبيك وDeepSeek وغيرها.

كشف باحثون متخصصون في أمن الذكاء الاصطناعي عن خلل بنيوي عميق في طريقة عمل النماذج اللغوية الكبيرة، قد يجعل إغلاق ثغرات اختراقها أمراً بالغ الصعوبة إن لم يكن مستحيلاً من الناحية التقنية. وقد قدَّم الباحثون ورقتهم البحثية في المؤتمر الدولي للتعلم الآلي (ICML) عام 2026، مُثبتين أن أكثر النماذج تطوراً في العالم ليست في منأى عن هجمات كسر الحماية وحقن التعليمات.
تكمن المشكلة في الطريقة التي يميّز بها النموذج اللغوي الكبير بين مصادر التعليمات المختلفة. في الأنظمة المصممة للذكاء الاصطناعي، ثمة أدوار مختلفة للنص: التعليمات الجذرية للنظام، ورسائل المستخدم، وردود النموذج، والأدوات الخارجية. غير أن الباحثين اكتشفوا أن النموذج لا يعتمد على العلامات التقنية والوسوم لتمييز هذه الأدوار، بل يعتمد على أسلوب الكتابة ومحتواها اللغوي. بمعنى آخر: إذا صاغ مهاجم رسالته بالأسلوب ذاته الذي يكتب به النموذج تعليماته الداخلية، فسيُطيعها دون تمييز.
وضّح الباحثون هذه الثغرة من خلال تقنية يسمّونها تزوير التفكير التسلسلي. في هذا الأسلوب الهجومي، يصوغ المهاجم نصاً يُحاكي طريقة تفكير النموذج الداخلية ويتضمن إيهاماً بأن التعليمة المحظورة قد أُجيزت في ظروف معينة. وقد جرّب الباحثون ذلك على نماذج من أبرز شركات الذكاء الاصطناعي، وتمكنوا من انتزاع معلومات خطرة تضمنت إرشادات لصنع مواد محظورة.
قال الباحث تشارلز يي في تصريح استرعى انتباه المجتمع التقني: ثمة احتمال حقيقي بأن هذه المشكلة لن تُحَل جذرياً أبداً. وأضاف أن الدوافع الاقتصادية ستجعل جهود اختراق هذه النماذج لا تهدأ، لأن في ذلك مصلحة مالية واضحة لأطراف عديدة.
تشمل النماذج المستهدفة أنظمة من شركات OpenAI وأنثروبيك وDeepSeek وعلي بابا، مما يعني أن الظاهرة ليست حِكراً على نموذج أو شركة بعينها، بل تعكس قصوراً منهجياً في البنية المعتمدة على مستوى الصناعة بأسرها.
ما يزيد الأمر تعقيداً أن فريق الباحثين فاز بمسابقة الفريق الأحمر التي تنظمها شركة أوبن إيه آي عام 2025، وحتى النماذج الأحدث ما زالت تُنتج محتوى ضاراً حين تُستفَز بالطرق المكتشفة. والمعضلة الجوهرية أن تحسين النماذج عبر التدريب الإضافي يُقلّص عامل الضعف لكنه لا يُزيله كلياً، إذ يجد المهاجمون دائماً زاوية جديدة للمحاولة.
تضع هذه الاكتشافات صانعي السياسات ومطوري الذكاء الاصطناعي في مواجهة معادلة صعبة: كيف ينشرون هذه النماذج في تطبيقات حساسة كالطب والقانون والبنية التحتية في وجود ثغرات بنيوية يصعب إغلاقها كلياً؟
يرى بعض الخبراء أن الحل يكمن في نهج متعدد الطبقات: تحسين النموذج، ومراقبة المخرجات، وتطبيق قيود صارمة في البيئة المعزولة، وتحديد صلاحيات الوصول بدقة. غير أن كل ذلك يُثقل كاهل المطوّرين ويرفع تكلفة النشر الآمن.
تحمل هذه الاكتشافات أهمية مباشرة للمنطقة العربية التي تشهد توسعاً متسارعاً في نشر النماذج اللغوية العربية، بما فيها مبادرات مراكز الذكاء الاصطناعي في الإمارات كمعهد محمد بن زايد للذكاء الاصطناعي (MBZUAI) ومبادرات كاوست السعودية. واستخدام هذه النماذج في تطبيقات حكومية وصحية حساسة يستلزم بناء دفاعات متعددة الطبقات، مما يجعل فهم الثغرات البنيوية ومعالجتها شرطاً أساسياً لثقة المواطن العربي في منظومة الذكاء الاصطناعي.
في ضوء هذه الكشوفات، يدعو الباحثون إلى إعادة النظر في نموذج الثقة المعتمد في تصميم هذه النماذج، والعمل على بناء بنية تقنية تُفرّق بصورة صارمة وموثوقة بين مصادر التعليمات بدلاً من الاكتفاء بالتمييز الأسلوبي الذي أثبت قصوره أمام المهاجمين المصممين.
المزيد من ذكاء اصطناعي

لا تنخدعوا: النماذج اللغوية الكبيرة لا تفكر فعلاً كما تبدو
يرى باحث في الذكاء الاصطناعي أن النماذج اللغوية الكبيرة تنجح بفضل التنبؤ السريع بالأنماط لا الاستدلال المنهجي الحقيقي، مستشهداً بحركة ألفاغو الأسطورية رقم 37 كمثال على الاستدلال الفعلي الذي تفتقر إليه هذه النماذج.

إيبك توقف تطوير منتجاتها مؤقتاً لإصلاح ثغرات تهدد بيانات 320 مليون مريض
أوقفت شركة إيبك، أكبر مزوّد لأنظمة السجلات الصحية الإلكترونية في أمريكا، تطوير منتجاتها ستة أسابيع لإصلاح ثغرات أمنية في نظام MyChart قد تسمح بالوصول إلى بيانات ملايين المرضى دون تسجيل أثر.

آبل تشدد ضوابط الوصول الكامل للقرص في ماك مواجهةً لمخاطر وكلاء الذكاء الاصطناعي
أعلنت آبل تشديد صلاحية الوصول الكامل للقرص في نظام ماك أو إس، بعد تنامي المخاوف من وكلاء الذكاء الاصطناعي القادرين على الوصول غير المقيّد إلى ملفات المستخدمين ورسائلهم وسجل تصفحهم.

معالج ضوئي يكتشف التزييف العميق في الفيديو بدقة تقارب 98%
باحثون في جامعة كاليفورنيا لوس أنجلوس يطورون معالجاً عصبياً ضوئياً يفحص عشرات مقاطع الفيديو في آنٍ واحد باستخدام الضوء بدلاً من الكهرباء، لكشف التزييف العميق بدقة واستهلاك طاقة منخفضين.

علماء يطورون نظام ذكاء اصطناعي يعيد بناء الصور من مسح الدماغ في ساعة واحدة
باحثون في معهد وايزمان يطورون مُفسِّراً دماغياً بالذكاء الاصطناعي يعيد بناء ما يراه الشخص من بيانات التصوير الوظيفي، ويخفض زمن المعايرة اللازم من 40 ساعة إلى ساعة واحدة فقط.

أرمادين: 255 مليون دولار لحماية الشركات بأسراب الذكاء الاصطناعي
مؤسس مانديانت كيفن مانديا يطلق أرمادين، شركة تستخدم أسراباً من عوامل الذكاء الاصطناعي المستقلة لمحاكاة هجمات القراصنة واختبار دفاعات الشركات بتكلفة أقل وسرعة أكبر.