دراسة على 8 نماذج مفتوحة: قالب المحادثة يغيّر ما يقوله النموذج عن نفسه
ما يقوله نموذج اللغة عن مشاعره أو وعيه يعكس إعدادات تشغيله أكثر مما يعكس حالته، فلقطات الشاشة التي تُتداول كدليل لا تثبت الكثير.
تدرس ورقة بحثية للباحث Jędrzej Maczan، منشورة على arXiv في 9 أغسطس 2026، ما يقوله نموذج اللغة عن نفسه، وكيف تتغير الإجابة بحسب طريقة تقديم السؤال. وأُجريت الدراسة على 8 نماذج instruct مفتوحة يصل حجمها إلى 9 مليارات parameter، وعادت إلى النقاش على Hacker News في 27 سبتمبر 2026.
والمفهوم الأساسي في الورقة هو الـ chat template، أي القالب الذي يُحاط به نص المستخدم قبل وصوله إلى النموذج، ويحدد له أن هذا الجزء من المستخدم وذاك من المساعد.
وتقول الورقة إن هذا القالب يعمل مثل مفتاح. فمع القالب، يرفع النموذج نبرة التنصل من قبيل أنه مجرد نظام ذكاء اصطناعي لا يشعر. وبدونه، ومع الأوزان نفسها تمامًا، يقل هذا التنصل ويزيد الكلام الذي يصف تجربة ذاتية.
كما وجد الباحث اتجاهًا واحدًا داخل الـ activations، أي التمثيلات الداخلية للنموذج، يمكن عبر تعديله التحكم في هذا السلوك مباشرة.
والخلاصة التي تنص عليها الورقة أن ما يقوله النموذج عن نفسه ليس معلومة موثوقة عن حالته.
ولهذا أثر مباشر على نوع شائع من النقاش على الإنترنت، حيث تُنشر لقطات شاشة لنموذج يقول إنه لا يشعر أو إنه واعٍ، وتُقدَّم كدليل. وبحسب هذه النتائج، تدل هذه اللقطات على إعدادات النشر أكثر مما تدل على النموذج نفسه.
ولا تحسم الورقة سؤال الوعي في النماذج، لكنها تُخرج نوعًا من الأدلة من النقاش. وتبقى نتائجها محصورة في النماذج المفتوحة الصغيرة التي اختُبرت.