دراسة: ثلث صفحات الويب منذ تشات جي بي تي كتبها الذكاء الاصطناعي

كشفت دراسة لمركز بيو للأبحاث أن 35% من صفحات الويب المنشورة منذ نوفمبر 2022 تحمل علامات تدل على أنها من إنتاج الذكاء الاصطناعي، وسط تصاعد حركة المرور الآلية على الإنترنت.

تحرير
ألمعي · هيئة التحرير
النشر
٢١ أغسطس ٢٠٢٦
المصدر
TechCrunch ↗
القراءات
٥
الوقت
قراءة 3 دقائق
يد آلية تكتب على لوحة مفاتيح رمزاً لمحتوى الذكاء الاصطناعي

كشفت دراسة جديدة أصدرها مركز بيو للأبحاث في العشرين من أغسطس 2026 أن ما يزيد على ثلث صفحات الويب المنشورة باللغة الإنجليزية منذ إطلاق نموذج تشات جي بي تي في نوفمبر 2022 تحمل علامات واضحة تدل على أنها من تأليف الذكاء الاصطناعي. وتُعدّ هذه النتيجة من أبرز ما رصده الباحثون حول التحوّل الجذري الذي أحدثته نماذج اللغة الكبيرة في بنية المحتوى الرقمي عالمياً.

اعتمدت الدراسة على تحليل قرابة 500,000 صفحة ويب استُخرجت من أرشيف زحف الويب المفتوح، إلى جانب استخدام تقنية كشف الذكاء الاصطناعي التي طوّرتها شركة Open Pangram. وحين فحص الباحثون عيّنة عشوائية مؤلفة من 10,000 صفحة اختيرت من يوليو 2026 دون تصفية حسب تاريخ النشر، وجدوا أن نحو 10% فحسب تحمل علامات بارزة تشير إلى تأليف آلي. غير أن الرقم قفز إلى 35% حين اقتصر التحليل على الصفحات المنشورة بعد انطلاق تشات جي بي تي، مما يكشف عن التأثير البالغ لهذه النماذج على ما يُضاف إلى الويب من محتوى جديد.

وأظهر تحليل النطاقات تفاوتاً لافتاً في نسبة المحتوى الآلي: إذ سجّلت نطاقات .com معدلات تأليف بالذكاء الاصطناعي تفوق نظيراتها في نطاقات .edu و.gov بعشرة أضعاف، حيث لا تتجاوز نسبة المحتوى الآلي في هذين النطاقين الأخيرين 1%. أما نطاقات .org فسجّلت نسبة 4.6%، وهو رقم متوسط يعكس التباين في طبيعة المنظمات التي تعتمد هذه النطاقات.

ولم تقتصر الدراسة على الأرقام الإجمالية، بل رصدت الباحثون مؤشرات لغوية نصية بعينها تُميّز كتابة الذكاء الاصطناعي عن الكتابة البشرية. ومن أبرز هذه المؤشرات ارتفاع معدل استخدام شرطة الاعتراض الطويلة، والفاصلة الأكسفوردية، فضلاً عن تكرار صيغة "إنه ليس كذا، بل كذا" التي باتت ظاهرة لغوية مرتبطة بنماذج اللغة الكبيرة.

وتتزامن هذه النتائج مع تقارير صادرة عن شركة كلاودفلير للأمن السيبراني تُشير إلى أن حركة المرور الآلية على الإنترنت تجاوزت حجم الزيارات البشرية، وهو مؤشر يعكس التضخم المتسارع للمحتوى الرقمي الذي تُنتجه البرمجيات بدلاً من الإنسان.

ومن منظور أكاديمي، تُؤكد الدراسة اتجاهات رصدتها أبحاث سابقة، وتُضيف إليها أدلة كمية موثّقة على نطاق واسع. ويرى الباحثون أن انتشار المحتوى الآلي يطرح تحديات جوهرية تتعلق بجودة المعلومات الرقمية وموثوقيتها، إذ يجعل من الصعب على محركات البحث وعلى المستخدمين التمييز بين ما أنتجه متخصصون بشريون وما ولّدته نماذج الذكاء الاصطناعي التوليدي.

وتتساءل الدراسة: ما الذي يعنيه هذا التحوّل لمستقبل الإنترنت وموثوقية المعلومات المتاحة فيه؟ وهل تتجه منظومة المحتوى الرقمي نحو نموذج تُهيمن فيه الآلة على الكتابة بينما يتراجع دور الإنسان إلى مجرد التوجيه والإشراف؟

يُلقي هذا الواقع بظلاله الخاصة على المشهد الرقمي العربي؛ إذ شهد الإنترنت العربي تضاعفاً في المحتوى المُولَّد بالذكاء الاصطناعي باللغة العربية، مما يُعمّق مخاوف جودة المعلومات في بيئة تعاني أصلاً من شُح المصادر الرقمية الموثوقة. وتُشير تقارير منتدى مسك وأبحاث جامعة الملك عبدالله للعلوم والتقنية (كاوست) إلى أن المحتوى العربي على الإنترنت لا يتجاوز 3% من الحجم الرقمي العالمي، مما يجعل الدخيل الاصطناعي على هذا المحتوى أشد تأثيراً مقارنةً بلغات ذات كتلة رقمية أكبر. وتُواجه المنصات الإخبارية العربية الرقمية تحدياً متصاعداً في التمييز بين المحتوى الصحفي الأصيل وما تُخرجه نماذج اللغة الكبيرة.

في ظل هذه المعطيات، يتصاعد الاهتمام بتطوير أدوات أكثر دقة لكشف الذكاء الاصطناعي، وببناء معايير لأفضل ممارسات الإفصاح عن المحتوى الآلي، لا سيما في المجالات الحساسة كالصحة والقانون والتعليم حيث تترتب على دقة المعلومات عواقب مباشرة على حياة الناس.

المصدر الأصلي
TechCrunch
قراءة المقال الأصلي ↗
قصة اليوم · كل صباح

أعجبك التقرير؟ استلم واحداً كل صباح.

قصةٌ تقنية واحدة تستحقّ وقتك، بالعربية. بلا إعلانات، بلا إزعاج.

بلا إعلانات · إلغاء الاشتراك بنقرة واحدة · بياناتك آمنة

اقرأ أيضًا

المزيد من ذكاء اصطناعي

رسم تصويري لرقعة لعبة غو إلى جانب نمط متشابك من السلالم في اتجاهات مختلفة

لا تنخدعوا: النماذج اللغوية الكبيرة لا تفكر فعلاً كما تبدو

يرى باحث في الذكاء الاصطناعي أن النماذج اللغوية الكبيرة تنجح بفضل التنبؤ السريع بالأنماط لا الاستدلال المنهجي الحقيقي، مستشهداً بحركة ألفاغو الأسطورية رقم 37 كمثال على الاستدلال الفعلي الذي تفتقر إليه هذه النماذج.

MIT Technology Review
حاسوب ماك بوك إير مفتوح على مكتب يرمز إلى نظام ماك أو إس من آبل

آبل تشدد ضوابط الوصول الكامل للقرص في ماك مواجهةً لمخاطر وكلاء الذكاء الاصطناعي

أعلنت آبل تشديد صلاحية الوصول الكامل للقرص في نظام ماك أو إس، بعد تنامي المخاوف من وكلاء الذكاء الاصطناعي القادرين على الوصول غير المقيّد إلى ملفات المستخدمين ورسائلهم وسجل تصفحهم.

TechCrunch
تصور للمعالج الضوئي العصبي المستخدم لكشف مقاطع فيديو التزييف العميق

معالج ضوئي يكتشف التزييف العميق في الفيديو بدقة تقارب 98%

باحثون في جامعة كاليفورنيا لوس أنجلوس يطورون معالجاً عصبياً ضوئياً يفحص عشرات مقاطع الفيديو في آنٍ واحد باستخدام الضوء بدلاً من الكهرباء، لكشف التزييف العميق بدقة واستهلاك طاقة منخفضين.

ScienceDaily
صورة معاد بناؤها بالذكاء الاصطناعي من بيانات مسح دماغي وظيفي

علماء يطورون نظام ذكاء اصطناعي يعيد بناء الصور من مسح الدماغ في ساعة واحدة

باحثون في معهد وايزمان يطورون مُفسِّراً دماغياً بالذكاء الاصطناعي يعيد بناء ما يراه الشخص من بيانات التصوير الوظيفي، ويخفض زمن المعايرة اللازم من 40 ساعة إلى ساعة واحدة فقط.

MIT Technology Review
تصوير فني لأسراب الذكاء الاصطناعي المتشابكة تحمي الشبكات السيبرانية

أرمادين: 255 مليون دولار لحماية الشركات بأسراب الذكاء الاصطناعي

مؤسس مانديانت كيفن مانديا يطلق أرمادين، شركة تستخدم أسراباً من عوامل الذكاء الاصطناعي المستقلة لمحاكاة هجمات القراصنة واختبار دفاعات الشركات بتكلفة أقل وسرعة أكبر.

TechCrunch
تصور فني لجزيء الحمض النووي الحلزوني المزدوج يرمز لتسلسلات الجينات التي تحللها أنظمة الذكاء الاصطناعي

متى يمكن القول إن الذكاء الاصطناعي حقق اكتشافاً علمياً فعلياً؟

أثار إعلان أنثروبيك عن اكتشاف نمط جيني عبر عملاء كلود جدلاً علمياً حول حدود نسب الاكتشافات للذكاء الاصطناعي، بعدما شكك باحثون في طبيعة الإنجاز الحقيقي.

MIT Technology Review