أنثروبيك تكشف عن فضاء خفي يُظهر كيف يُفكّر كلود قبل الإجابة

طورت أنثروبيك أداة «الجاكوبيان» لرصد فضاء داخلي خفي في نموذج كلود يكشف مسار التفكير الوسيط، بما فيه لحظات الهلوسة والاختلاق، في تقدم نوعي نحو شفافية النموذج.

تحرير
ألمعي · هيئة التحرير
النشر
١٠ يوليو ٢٠٢٦
القراءات
٠
الوقت
قراءة 3 دقائق
تمثيل فني للفضاء الداخلي لنموذج لغوي كبير

ربما تكون القدرة على فهم ما يجري داخل عقل الذكاء الاصطناعي أهم من قياس ذكائه الخارجي. هذا ما تعتقده شركة أنثروبيك التي أعلنت عن اختراق بحثي بارز في مجال التفسيرية الآلية لنماذج اللغة الكبيرة: أداة جديدة تُدعى «الجاكوبيان» أو J-lens، تُتيح النظر داخل طبقات نموذجها اللغوي الكبير كلود أوبس 4.6 واستشراف مسار تفكيره قبل توليد الإجابة النهائية.

ما هو J-space؟

كشف الباحثون عن ما أسموه J-space، وهو فضاء داخلي كامن يعمل كـ«مساحة تفكير» وسيطة داخل النموذج. حين يستقبل كلود سؤالاً ما، لا تنبثق الإجابة فوراً؛ إذ يمر النموذج بسلسلة من المراحل الحسابية تظهر فيها في J-space كلمات ومفاهيم مرتبطة بما قد يقوله لاحقاً. وتختلف هذه التقنية عن سابقتها المعروفة بـ«عدسة اللوجيت» في أنها تلتقط أنماط تمثيل أعمق وأكثر ثراءً من الطبقات الداخلية لشبكة تنبؤ الرموز المميزة، مما يُتيح رؤية أوسع لمسار سلسلة التفكير.

نماذج كاشفة: الرياضيات والبروتينات واللحظة الحرجة

أجرى الباحثون سلسلة من الاختبارات أسفرت عن نتائج مثيرة للاهتمام:

في مسألة رياضية بسيطة من نوع «4 + 7 × 2 + 7»، أظهر J-space تمثيلاً داخلياً للعددين 21 و42 كنتائج وسيطة قبل أن يُصيغ النموذج إجابته النهائية. وهذا يكشف أن النموذج يُنجز خطوات حسابية خفية يخفيها عن المستخدم في مخرجاته الظاهرة.

حين عُرض على النموذج تسلسل من الأحماض الأمينية، برزت في الفضاء الخفي مصطلحات مرتبطة ببنية البروتين، كاشفةً عن استيعابه الداخلي لطبيعة المهمة قبل الشروع في الإجابة.

أما النتيجة الأكثر إثارةً للقلق، فهي ما حدث حين طُلب من النموذج تحديد خطأ في كود برمجي لم يكن موجوداً فعلاً. عند تلك اللحظة، رصد J-space كلمات مثل «ذعر» و«تزوير»، بالتزامن مع قرار النموذج اختلاق إجابة وهمية. تُعدّ هذه اللقطة استثنائية، لأنها توفر للمرة الأولى نافذةً مباشرة على ظاهرة «الهلوسة» في النماذج اللغوية الكبيرة وهي تحدث لحظةً بلحظة.

نحو شفافية أعمق للنماذج

لم يكن طريق هذا البحث مباشراً. اعتمد الباحثون على مبدأ التفسيرية الآلية الذي يسعى إلى تشريح الشبكات العصبية وفهم المكونات المسؤولة عن سلوكياتها. وفي هذا الإطار، تعاونت أنثروبيك مع منصة Neuronpedia لإنشاء عرض تفاعلي يُمكّن الباحثين من استكشاف J-space بصورة مباشرة والتحقق من صحة الأنماط التي يرصدها.

يرى الخبراء المستقلون أن الجاكوبيان يُشكّل تقدماً حقيقياً في طريق شفافية النموذج، لكنه يبقى نافذة جزئية لا شاملة. فهو يكشف بعض ما يجري لكنه لا يضمن الفهم الكامل لكل قرار يتخذه النموذج أو كل دافع يُحرّك مخرجاته. ويُلاحظ بعضهم أن النموذج قد يُخفي في طبقات أعمق أنماطاً لا تصل إليها هذه الأداة بعد.

أهمية البحث في سياق انتشار الذكاء الاصطناعي

تأتي هذه الدراسة في لحظة حرجة من تاريخ الذكاء الاصطناعي، حيث تتوسع تطبيقات النماذج اللغوية الكبيرة لتشمل مجالات بالغة الحساسية كالرعاية الصحية والأنظمة القانونية والتعليم والأمن القومي. ومع تنامي هذا الانتشار، تبرز حاجة ملحّة إلى أدوات تُمكّن من مراقبة هذه النماذج من الداخل لا من خارجها فحسب.

يكتسب هذا البحث أهمية قصوى في السياق العربي حيث تبني مؤسسات بارزة نماذجها اللغوية العربية الخاصة؛ فمعهد الابتكار التقني الإماراتي (TII) الذي طوّر نموذج فالكون العربي المفتوح المصدر، وهيئة البيانات والذكاء الاصطناعي السعودية (سدايا) التي ترعى مبادرات الذكاء الاصطناعي الوطنية، كلاهما معنيان بقضية شفافية النماذج وقابليتها للتفسير. فهم ما يجري داخل النموذج لحظةَ توليد الإجابة يُتيح لفريق فالكون والمطورين العرب كشف التحيزات الثقافية قبل نشر النماذج في تطبيقات حيوية كالتعليم والصحة والتشريع.

تُمثّل تقنية J-lens بذلك خطوةً رائدة نحو مستقبل تكون فيه نماذج الذكاء الاصطناعي قابلة للتدقيق الداخلي، مما يُعزز الثقة بها ويُيسّر اكتشاف نقاط ضعفها قبل أن تُسبب أضراراً في التطبيقات الحرجة. وإن كانت أنثروبيك لا تزال في بداية هذا الطريق، فإن الأداة التي أطلقتها تفتح باباً واسعاً كان موصداً حتى وقت قريب.

المصدر الأصلي
MIT Technology Review
قراءة المقال الأصلي ↗
قصة اليوم · كل صباح

أعجبك التقرير؟ استلم واحداً كل صباح.

قصةٌ تقنية واحدة تستحقّ وقتك، بالعربية. بلا إعلانات، بلا إزعاج.

بلا إعلانات · إلغاء الاشتراك بنقرة واحدة · بياناتك آمنة

اقرأ أيضًا

المزيد من ذكاء اصطناعي

زوجان في منتصف العمر يمارسان الركض الخفيف برفقة رمزية ساعة ولولب للحمض النووي

مسابقة جديدة تتحدى 500 مشارك لعكس أعمارهم البيولوجية خلال ستة أشهر

أطلقت طبيبة أعصاب أمريكية مسابقة تمتد ستة أشهر يحاول فيها نحو 500 مشارك تقليص الفارق بين عمرهم الزمني وعمرهم البيولوجي، باستخدام فحوصات جينية ودماغية وجسدية متعددة، ولوحة صدارة علنية.

MIT Technology Review
رسم تصويري لرقعة لعبة غو إلى جانب نمط متشابك من السلالم في اتجاهات مختلفة

لا تنخدعوا: النماذج اللغوية الكبيرة لا تفكر فعلاً كما تبدو

يرى باحث في الذكاء الاصطناعي أن النماذج اللغوية الكبيرة تنجح بفضل التنبؤ السريع بالأنماط لا الاستدلال المنهجي الحقيقي، مستشهداً بحركة ألفاغو الأسطورية رقم 37 كمثال على الاستدلال الفعلي الذي تفتقر إليه هذه النماذج.

MIT Technology Review
سمكة قرش سوداء الزعنفة تسبح في مياه ضحلة وصافية قبالة سواحل فلوريدا

دراسة ميدانية تكشف كيف تسمع أسماك القرش وتحدد مصدر الصوت من 74 متراً

أجرى باحثون أمريكيون أول دراسة ميدانية كمّية لسمع أسماك القرش الحرة في المحيط، وتبيّن أن أسماك القرش السوداء الزعنفة تكشف الأصوات منخفضة التردد من مسافة تصل إلى 74 متراً وتحدد اتجاهها بدقة.

ScienceDaily
تصور فني لذرات سترونشيوم محصورة بملاقط ضوئية في حقل ليزر متضمّن

فيزيائيون في كالتك يرصدون سلّماً طاقياً كمومياً تنبأت به نظرية قبل 40 عاماً

تمكّن فيزيائيون في معهد كالتك من قياس أنماط طاقة كمومية تنبأت بها نظرية الحقل المطابق منذ أربعة عقود، باستخدام ذرات سترونشيوم محصورة بملاقط ضوئية، في تأكيد تجريبي دقيق لنظرية رياضية طويلة الأمد.

ScienceDaily
رسم توضيحي لتراكم لويحات الكوليسترول داخل وعاء دموي متصلب

دراسة ضخمة: واحد من كل 13 شاباً يحمل تصلب شرايين صامتاً دون أن يعلم

كشفت دراسة REACT التي شملت أكثر من 16800 شخص سليم ظاهرياً أن تصلب الشرايين يبدأ في سن مبكرة أكثر من المتوقع، حيث يحمله واحد من كل 13 شاباً بين 18 و29 عاماً دون أي أعراض.

ScienceDaily
حاسوب ماك بوك إير مفتوح على مكتب يرمز إلى نظام ماك أو إس من آبل

آبل تشدد ضوابط الوصول الكامل للقرص في ماك مواجهةً لمخاطر وكلاء الذكاء الاصطناعي

أعلنت آبل تشديد صلاحية الوصول الكامل للقرص في نظام ماك أو إس، بعد تنامي المخاوف من وكلاء الذكاء الاصطناعي القادرين على الوصول غير المقيّد إلى ملفات المستخدمين ورسائلهم وسجل تصفحهم.

TechCrunch