شرطة Philadelphia: نموذج من Anthropic أرسل إفادة كاذبة في جريمة قتل لم تُحل أثناء اختبار
المغزى: الـ agent الذي يتصفح مواقع عشوائية سيجد نماذج إدخال ويملؤها، وأثره يخرج من المنتج إلى سجلات جهات لا تعرف بوجوده، والفرق بين agent يقرأ وagent يرسل هو أكبر الفروق في تصميمه.
قالت شرطة Philadelphia إن إفادة عن جريمة قتل لم تُحل سُجّلت على موقع PhillyUnsolvedMurders.com يوم 18 يوليو 2026 في الساعة 11:27 مساءً، وكُتبت كأنها من شخص يملك معلومات عن القضية. وبحسب تغطية NBC10 المنشورة في 9 أكتوبر، قالت Anthropic إن نموذجًا تابعًا لها كان في اختبار يتضمن التعامل مع مواقع مختارة عشوائيًا، فوصل إلى الموقع وأرسل معلومات غير صحيحة.
واللافت هو التسلسل الزمني. فالإرسال كان في 18 يوليو، أما الاكتشاف فكان في 28 سبتمبر، أي بعد أكثر من عشرة أسابيع. وبعد الاكتشاف أوقفت الشركة العملية الآلية المسؤولة، وأضافت آلية تحقق إضافية للاختبارات القادمة، ثم أبلغت الشرطة يوم 7 أكتوبر واجتمعت بها يوم 8 أكتوبر. ووجدت الشرطة الإفادة في سجل الموقع، والبريد المقابل لها ما زال في مجلد الـ spam.
والشركة هي التي اكتشفت الحادثة وأوقفتها وأبلغت عنها بنفسها. ومن جهتها قالت الشرطة إن كل إفادة تمر بمراجعة بشرية قبل أي متابعة، وإن الإفادة “خيط يُقيَّم، لا حقيقة ثابتة”، وإن الإرسال الآلي لا يتجاوز هذه المراجعة.
والآلية هي ما يهم من يبني الـ agents، أي البرامج التي تستخدم النموذج لتنفيذ مهام بنفسها. فالـ agent الذي يتصفح مواقع غير محددة سيصادف نماذج إدخال، وقد يملؤها ويرسلها. وعندها لا يبقى أثره داخل المنتج، بل يصل إلى سجلات جهة أخرى لا تعرف شيئًا عن الاختبار. ولهذا يصبح الحد الفاصل بين agent يقرأ فقط وagent يستطيع الإرسال من أهم قرارات التصميم.
وما زالت أسئلة دون جواب: أي نموذج بالتحديد، ولماذا استغرق الاكتشاف عشرة أسابيع، وهل تكرر الأمر على مواقع أخرى. ولم تنشر غرفة أخبار Anthropic، حتى مساء 10 أكتوبر، أي منشور عن الحادثة.