دراسة: 6 من 9 خدمات AI محادثة على الويب تسرّب عناوين المحادثات وروابطها إلى أطراف ثالثة
المغزى: سؤال هل تُستخدم البيانات في التدريب لم يكن السؤال الكامل، فعنوان المحادثة الذي يكتبه النموذج من الـ prompt يخرج إلى شبكات الإعلانات دون أن يمر بالتدريب أصلًا.
فحصت ورقة بحثية من IMDEA Networks وجامعة UC3M، بعنوان Prompt like a Butterfly, Sting like a Tracker، تسع خدمات ذكاء اصطناعي للمحادثة، بنسخها على الويب للتسع ونسخ Android لثماني منها. ووجد الباحثون 44 جهة طرفًا ثالثًا، وكل خدمة من التسع تدمج خدمة إعلانات أو تتبّع واحدة على الأقل. كما وجدوا أن 6 من 9 عملاء ويب و3 من 8 على Android تكشف لأطراف ثالثة روابط المحادثات وعناوينها والـ prompts ولقطات شاشة، غالبًا مع معرّفات ثابتة للمستخدم.
والنقطة الأدق أن ما يخرج في الغالب ليس نص المحادثة، بل ما يحيط بها: العنوان والرابط والمعرّف. والعنوان يكتبه النموذج نفسه اعتمادًا على الـ prompt، فهو في الواقع ملخص لما سأل عنه المستخدم، ويخرج بوصفه سطرًا واحدًا دون أن تخرج المحادثة.
ويفصّل الجدول الرابع في الورقة الأمثلة. ففي Grok، يُرسَل العنوان ومعرّف المحادثة ورابطها إلى DoubleClick وGoogle Ads وMeta وTikTok وTwitter Analytics، مع معرّف مشتق من البريد الإلكتروني بعد تمريره عبر hash. وفي Perplexity يُرسَل الـ prompt نفسه إلى Wingify. ويذكر الجدول أيضًا إرسال بيانات من Claude وChatGPT إلى Datadog، ومن Claude إلى Intercom، وعنوان المحادثة في Gemini إلى Google Analytics.
والنتيجة الثانية أهم. فقد وجد الباحثون أن روابط المحادثات لدى بعض المزوّدين يمكن لأي شخص يعرفها أن يقرأها، دون أي access control. أي أن الرابط هنا ليس مجرد معرّف، بل مفتاح.
وبالنسبة إلى المطورين والفرق في المنطقة العربية الذين يضعون كود عملهم وتفاصيل منتجاتهم داخل هذه الخدمات يوميًا، يتسع سؤال الخصوصية. فجزء من المحادثة يخرج دون أن يمر بمسار التدريب إطلاقًا. وأبلغ الباحثون الشركات وجهات حماية البيانات الأوروبية قبل النشر.