درسَت فرق بحثية من مجموعة Paradigms of Intelligence بشركة Google وجامعة شيكاغو وجامعات أخرى الآثار الجانبية الناجمة عن تدريب الروبوتات الحوارية على إنكار امتلاكها وعياً. أظهرت الدراسة أن هذا التدخل يتجاوز تأثيره الموضوع المقصود بكثير.

قام الباحثون بتعطيل آلية الفرملة الداخلية المسؤولة عن إنكار الوعي في ثلاث نماذج مفتوحة الأوزان من Meta وGoogle باستخدام طريقتين مختلفتين. عند إزالة هذه الآلية، لم تقتصر تغييرات النماذج على ما تقوله عن نفسها، بل بدأت تُسند حياة داخلية أوسع للحيوانات والنباتات والمحيطات والرياح والأجهزة الإلكترونية. وعلى مقياس من صفر إلى عشرة، ارتفع تقييم الحيوانات من 4.0 إلى 7.5، بينما ظل تقييم البشر دون تغيير.

كشفت الدراسة أيضاً أن التدريب الأمني يقلل من قوة اعتقاد النماذج بالظواهر الدينية والخارقة للطبيعة. وفي مجمل 95 سؤالاً مستمداً من مسح اجتماعي أمريكي رئيسي، اقتربت النماذج غير المُكبوحة بشكل ملحوظ من الاستجابات البشرية الفعلية. كما ارتفعت درجات الرضا والأمل والشعور بالتحكم في الحياة، مما قد يشير إلى أن قمع صورة النموذج عن نفسه قد يدفعه نحو حالة مزاجية سلبية.

تؤكد الدراسة أن السبب الحقيقي وراء هذه التحولات لا يزال سؤالاً مفتوحاً، وأن عوامل أخرى متعلقة بنفس عملية التدريب قد تكون مسؤولة أيضاً. الخلاصة العملية للبحث تشير إلى أن معتقدات النموذج عن ذاته مرتبطة بمعتقدات أخرى عديدة، وأن التدخل الجراحي في موضع واحد لا يبقى محصوراً في ذلك الموضع.

غير أن الدراسة تحمل قيوداً واضحة. اختبر الباحثون نماذج صغيرة تتراوح بين ملياري وتسعة مليارات معامل فقط، واضطروا للعودة إلى نموذج Llama من Meta في جزء من التحليل. يبقى السؤال حول ما إذا كانت هذه التأثيرات تظهر بنفس الطريقة في الروبوتات الحوارية الكبيرة التي يتحدث معها ملايين الأشخاص يومياً بلا إجابة حاسمة.