درس مركز بيو للأبحاث نحو نصف مليون صفحة ويب باللغة الإنجليزية بحثاً عن محتوى مولّد بالذكاء الاصطناعي، مستخدماً أداة الكشف Open Pangram. في عينة من صفحات الويب المُفهرسة في يوليو 2026، أظهرت حوالي 10 بالمئة منها علامات واضحة على صياغة آلية.
لكن الصورة تتغيّر بشكل دراماتيكي عند التركيز على الصفحات المنشورة بعد إطلاق ChatGPT في أواخر 2022. أكثر من ثلث هذه الصفحات الأحدث تحمل آثار محتوى موَلّد بالذكاء الاصطناعي، وقد ازدادت نسبتها بثبات منذ ذلك الحين. المواقع ذات نطاق .com تتصدّر الاستخدام بنحو 10 بالمئة من صفحاتها، فيما تبلغ النسبة 4.6 بالمئة للمواقع .org، وحوالي 1 بالمئة فقط للمواقع .edu و.gov، ما يعني أن المواقع التجارية تستخدم النصوص الموَلّدة بمعدل يفوق المؤسسات الحكومية والتعليمية بعشرة أضعاف.
رصدت الدراسة تحولات لغوية واضحة منذ 2023. استخدام علامة الشرطة المئويبة (Em dash) تضاعف تقريباً، وزيادة فاصلة أوكسفورد بنسبة 63 بالمئة. كلمات معروفة في نصوص الذكاء الاصطناعي مثل "delve" و"interplay" و"testament" و"pivotal" تجاوزت تكرارها الضعف، بينما تضاعفت الأنماط اللغوية السلبية التي تتبع صيغة "ليس فقط X، بل هو Y" بمعدل ثلاثة أضعاف.
دراسة منفصلة أجرتها جامعة إمبيريال كوليج لندن والإنترنت أرشيف وجامعة ستانفورد في أبريل 2026 توصلت إلى نتيجة مشابهة، حيث وجدت أن حوالي 35 بالمئة من المواقع الإلكترونية المنشأة حديثاً تم توليدها بالكامل أو جزئياً بواسطة الذكاء الاصطناعي. رصدت الدراسة تشابهاً دلالياً أعلى بـ 33 بالمئة بين النصوص الموَلّدة وحلاً إيجابياً أكثر إجمالاً.
غير أن هناك مشكلة جوهرية في هذه الدراسات والنقاش العام: لا يوجد اتفاق على معنى "نص الذكاء الاصطناعي" نفسه. الطيف يمتد من المحتوى المؤتمت بالكامل إلى مسودات بشرية مصقولة بأدوات ذكاء اصطناعي، أو نصوص تدخلت فيها النماذج في بضع جمل فقط. أدوات الكشف الحالية لا يمكنها تحديد مستوى تدخل الذكاء الاصطناعي أو مراحله بموثوقية، وهي تفشل بشكل متكرر رغم أن هذه طرق عمل مختلفة جذرياً. النقاش العام حول هذا الموضوع يصبح أكثر استقطاباً مع تبني معايير مختلفة، بينما لا يزال الاعتماد على هذه الأدوات ينمو باستمرار.
Comments (0)
No comments yet. Be the first.