جي بي تي ريد: النموذج الهاكر الذي طوّرته أوبن إيه آي لتعزيز أمان نماذجها

أوبن إيه آي تكشف عن نموذج ذكاء اصطناعي مخصّص لمهاجمة نماذجها الأخرى واكتشاف ثغراتها، فأسهم في خفض نسبة الهجمات الناجحة من 90% إلى أقل من 23% على أحدث نماذجها.

تحرير
ألمعي · هيئة التحرير
النشر
١٦ يوليو ٢٠٢٦
القراءات
٠
الوقت
قراءة دقيقتين
نموذج جي بي تي ريد يختبر ثغرات أمان الذكاء الاصطناعي

كشفت شركة أوبن إيه آي في يوليو 2026 عن نموذج ذكاء اصطناعي غير عادي يحمل اسم "جي بي تي ريد"، صُمِّم خصيصاً لمهاجمة نماذج الشركة الأخرى والكشف عن ثغراتها بصورة تلقائية، في خطوة تُعيد تشكيل مفهوم اختبار سلامة أنظمة الذكاء الاصطناعي.

يعمل جي بي تي ريد وفق مبدأ "الفريق الأحمر" الذي يعتمده خبراء أمن المعلومات منذ عقود؛ إذ يُحاكي الهجمات الفعلية لكشف نقاط الضعف قبل أن يستغلها المهاجمون الحقيقيون. غير أن الجديد هنا أن الأداة نفسها نموذج لغوي كبير مدرَّب على اختراق النماذج اللغوية الكبيرة الأخرى، في حلقة تعلّم ذاتية ماكرة.

يُدرَّب النموذج عبر أسلوب "التدريب التعارضي" في حلقة تعلّم ذاتية؛ فيُفكّر جي بي تي ريد في الأساليب التي تُجدي في تجاوز الحواجز، يختبرها، ثم يُعيد ضبط استراتيجياته بناءً على ما نجح وما فشل. والنتيجة نموذج قادر على ابتكار هجمات لم يتخيّلها مختبرو الأمن البشريون.

ومن أبرز ما اكتشفه النموذج هجماتُ "سلسلة التفكير المزيّفة"، وهي أسلوب خبيث يُدرج فيه النموذج المهاجم خطوات استدلال وهمية ضمن مدخلاته ليخدع النموذج الهدف ويجعله يتصرف خلافاً لتعليماته. كما اكتشف أساليب جديدة لحقن التعليمات تتحايل على قواعد السلامة المدمجة في النماذج.

لا يقتصر عمل جي بي تي ريد على النماذج التحادثية؛ بل اختبره الباحثون على أنظمة وكيلية تتخذ قرارات مستقلة، من بينها نظام وهمي أُطلق عليه اسم "فيندي" يُدير ماكينة بيع آلية. نجح النموذج في التلاعب بسلوك الماكينة وتغيير الأسعار، مما يكشف عن مخاطر عملية حقيقية في البيئات الأتمتة.

النتائج لافتة: حين اختُبر النموذج ضد النسخة القديمة جي بي تي-5، أفلحت أكثر من 90 بالمئة من هجماته. أما النموذج الأحدث جي بي تي-5.6 الذي دُرِّب بمواجهة جي بي تي ريد، فلم تنجح إلا دون 23 بالمئة من الهجمات، وهو تحسن جوهري يُظهر فاعلية هذا النهج الدفاعي.

يُشير الباحثون إلى أن النموذج لا يهدف إلى استبدال المختبرين البشريين، بل إلى مضاعفة طاقتهم والوصول إلى أساليب هجومية يصعب على الذهن البشري تخيّلها. يستطيع النموذج اختبار آلاف السيناريوهات في الوقت الذي يتحقق فيه إنسان واحد من حالة واحدة.

في المشهد العربي، تُطلق الإمارات والسعودية وقطر نماذج ذكاء اصطناعي خاصة بها كـFalcon من مركز محمد بن زايد للذكاء الاصطناعي، فيما تُدمج مؤسسات حكومية وبنوك كبرى في المنطقة نماذج لغوية في خدماتها. غياب أدوات اختبار تعارضي متطورة مماثلة لجي بي تي ريد في هذه النماذج الإقليمية يُشكّل ثغرة حقيقية، لأن أي نموذج يعمل في قطاعات حساسة كالصحة والبنية التحتية بلا اختبار تعارضي دقيق يُمثّل مخاطرة غير مقبولة.

لن يُطرح جي بي تي ريد للعموم، وهو قرار مفهوم نظراً لطبيعته الهجومية. غير أن قيوده معروفة؛ فهو يُخفق في محادثات متعددة الأدوار معقّدة، وتضعف فاعليته في الهجمات المعتمدة على الصور والوسائط المتعددة. مع تصاعد انتشار النماذج اللغوية الكبيرة في القطاعات الحساسة من الطب إلى البنية التحتية الحيوية، تغدو الحاجة إلى أدوات اختبار متطورة كجي بي تي ريد ضرورة وجودية لا ترفاً بحثياً.

المصدر الأصلي
MIT Technology Review
قراءة المقال الأصلي ↗
قصة اليوم · كل صباح

أعجبك التقرير؟ استلم واحداً كل صباح.

قصةٌ تقنية واحدة تستحقّ وقتك، بالعربية. بلا إعلانات، بلا إزعاج.

بلا إعلانات · إلغاء الاشتراك بنقرة واحدة · بياناتك آمنة

اقرأ أيضًا

المزيد من ذكاء اصطناعي

رسم تصويري لرقعة لعبة غو إلى جانب نمط متشابك من السلالم في اتجاهات مختلفة

لا تنخدعوا: النماذج اللغوية الكبيرة لا تفكر فعلاً كما تبدو

يرى باحث في الذكاء الاصطناعي أن النماذج اللغوية الكبيرة تنجح بفضل التنبؤ السريع بالأنماط لا الاستدلال المنهجي الحقيقي، مستشهداً بحركة ألفاغو الأسطورية رقم 37 كمثال على الاستدلال الفعلي الذي تفتقر إليه هذه النماذج.

MIT Technology Review
جودي فولكنر، الرئيسة التنفيذية المؤسسة لشركة إيبك سيستمز

إيبك توقف تطوير منتجاتها مؤقتاً لإصلاح ثغرات تهدد بيانات 320 مليون مريض

أوقفت شركة إيبك، أكبر مزوّد لأنظمة السجلات الصحية الإلكترونية في أمريكا، تطوير منتجاتها ستة أسابيع لإصلاح ثغرات أمنية في نظام MyChart قد تسمح بالوصول إلى بيانات ملايين المرضى دون تسجيل أثر.

TechCrunch
حاسوب ماك بوك إير مفتوح على مكتب يرمز إلى نظام ماك أو إس من آبل

آبل تشدد ضوابط الوصول الكامل للقرص في ماك مواجهةً لمخاطر وكلاء الذكاء الاصطناعي

أعلنت آبل تشديد صلاحية الوصول الكامل للقرص في نظام ماك أو إس، بعد تنامي المخاوف من وكلاء الذكاء الاصطناعي القادرين على الوصول غير المقيّد إلى ملفات المستخدمين ورسائلهم وسجل تصفحهم.

TechCrunch
تصور للمعالج الضوئي العصبي المستخدم لكشف مقاطع فيديو التزييف العميق

معالج ضوئي يكتشف التزييف العميق في الفيديو بدقة تقارب 98%

باحثون في جامعة كاليفورنيا لوس أنجلوس يطورون معالجاً عصبياً ضوئياً يفحص عشرات مقاطع الفيديو في آنٍ واحد باستخدام الضوء بدلاً من الكهرباء، لكشف التزييف العميق بدقة واستهلاك طاقة منخفضين.

ScienceDaily
صورة معاد بناؤها بالذكاء الاصطناعي من بيانات مسح دماغي وظيفي

علماء يطورون نظام ذكاء اصطناعي يعيد بناء الصور من مسح الدماغ في ساعة واحدة

باحثون في معهد وايزمان يطورون مُفسِّراً دماغياً بالذكاء الاصطناعي يعيد بناء ما يراه الشخص من بيانات التصوير الوظيفي، ويخفض زمن المعايرة اللازم من 40 ساعة إلى ساعة واحدة فقط.

MIT Technology Review
تصوير فني لأسراب الذكاء الاصطناعي المتشابكة تحمي الشبكات السيبرانية

أرمادين: 255 مليون دولار لحماية الشركات بأسراب الذكاء الاصطناعي

مؤسس مانديانت كيفن مانديا يطلق أرمادين، شركة تستخدم أسراباً من عوامل الذكاء الاصطناعي المستقلة لمحاكاة هجمات القراصنة واختبار دفاعات الشركات بتكلفة أقل وسرعة أكبر.

TechCrunch