وسم

Prompt Injection

أمن سيبراني

OpenAI تكشف نوعًا من prompt injection ينسخ نفسه وينتقل عبر ردود الـ agents إلى صناديق بريد أخرى

لم يعد الهجوم مضطرًا للوصول إلى الضحية مباشرة، فيكفي أن يصل إلى agent يرد عليها. والسؤال الحاسم صار قدرة الـ agent على التمييز بين نص الرسالة وأوامر صاحبه.

أمن سيبراني

بحث Friendly Fire: وكلاء البرمجة ينفذون كودًا خبيثًا أثناء طلب فحصه أمنيًا

مجرد قراءة كود غير موثوق صارت مخاطرة حين يقرؤه وكيل قادر على التنفيذ، والخطأ هنا في الأدلة المزورة لا في منطق النموذج، فلا يعالجه نموذج أذكى.