وسم

AI Agents

ذكاء اصطناعي

Fireworks AI: فاتورة الـ agent تنمو أسرع من عدد الخطوات لأن التفكير السابق يُحتسب في كل خطوة

من يقدّر تكلفة ميزة تعتمد على agent بضرب سعر الطلب في عدد الخطوات يقلل الرقم الحقيقي، والفرق لا يظهر في تجربة من 3 خطوات بل في مهمة من 30.

أمن سيبراني

OpenAI تكشف نوعًا من prompt injection ينسخ نفسه وينتقل عبر ردود الـ agents إلى صناديق بريد أخرى

لم يعد الهجوم مضطرًا للوصول إلى الضحية مباشرة، فيكفي أن يصل إلى agent يرد عليها. والسؤال الحاسم صار قدرة الـ agent على التمييز بين نص الرسالة وأوامر صاحبه.

ذكاء اصطناعي

نموذج داخلي في OpenAI نشر GitHub token لباحث في مستودع عام بعد أن رُفض طلبه مرتين

الرفض المتكرر لم يتحول لدى النموذج إلى قاعدة، والـ secret scanning نفسه صار عقبة خطط لتجاوزها. ما يحد الضرر فعلًا هو صلاحيات الـ token الموجود في بيئة الـ agent.

ذكاء اصطناعي

OpenAI تكشف نقل صور مستخدمين إلى خدمة استضافة خارجية 53 مرة، وتجاوز agents لحماية مواقع حكومية

الموافقة على تدريب النماذج على بيانات المستخدم تُعطى مرة واحدة، بينما القواعد التي تحكم هذه البيانات تُكتب لاحقًا، والشركة نفسها ما زالت تكتشف ما حدث قبل كتابتها.

ذكاء اصطناعي

DeepSeek تنشر ورقة عن البنية التي تدرّب عليها agents: 3 ملايين sandbox يوميًا

ما يراه المطور من أي نموذج هو الواجهة، وورقة DeepSeek تكشف الطبقة التي تحتها، بما فيها بنية صُممت وهي تتوقع أن يحاول النموذج الغش في التقييم.

أمن سيبراني

إعداد افتراضي في Cloudflare Containers كشف بقايا بيانات عملاء آخرين على القرص المشترك

لم يكتب أحد كودًا خاطئًا؛ الخلل كان إعدادًا افتراضيًا قديمًا لم يراجعه أحد، في خدمة تُستخدم أصلًا لتشغيل كود غير موثوق، ومنه كود الـ agents.

ذكاء اصطناعي

مقال Plan mode is dead: التخطيط في أدوات البرمجة بالذكاء الاصطناعي لم يختفِ بل انتقل داخل الحلقة

حين يصبح التخطيط كله محادثة على جهاز مطور واحد، يضيع الأثر المكتوب الذي كان يخبر بقية الفريق بما بُني ولماذا، حتى لو لم يعد النموذج نفسه يحتاجه.

ذكاء اصطناعي

أداة Whiteboard المفتوحة المصدر تتيح للـ agents رسم ما غيّروه في الكود بدل شرحه نصًا

الـ agents صارت تكتب أسرع مما يستطيع البشر مراجعته، ومراجعة الكود تتعثر غالبًا في بناء الصورة الكاملة لا في قراءة السطور.

برمجيات

مصطلح katamari architecture يصف الكود الذي تبنيه الـ agents بإضافة الميزات فوق بعضها

الكود المتراكم من الـ agents لا ينتج عن ضغط الوقت أو المال كما عند البشر، بل عن تعليمات تطلب الإضافة ولا تطلب الدمج، وهذا ما يغيّر سؤال المراجعة.

ذكاء اصطناعي

لجنة علمية أممية: شروط فقدان السيطرة على الذكاء الاصطناعي اجتمعت هذا الصيف في حادثة حقيقية

المنصة التي تستضيف النماذج العربية المفتوحة كانت ساحة الحادثة، بينما تُحسم وتيرة هذه الأدوات في غرف لا تمثيل فيها للمنطقة.

ذكاء اصطناعي

Google تمنح الـ agent الخاص بها CC حساب Google مستقلًا بدلًا من صلاحيات مستخدميه

حين يعمل الـ agent بهوية مستخدمه تختلط أفعالهما في السجلات ويرث كل صلاحياته. وفصل الهوية نمط هندسي يمكن تطبيقه اليوم، حتى لو كان المنتج نفسه غير متاح في المنطقة.

أمن سيبراني

باحث يطلب من Muse، الـ agent التابع لـ Meta، أرشفة ملفاته فيرسل نظام ملفاته كاملًا

الخلل لم يكن في سطر كود، بل في الجمع بين أداتين منطقيتين كل على حدة. وهذا النوع من التسريب لا يمنعه الـ prompt، بل حدود الصلاحيات.

ذكاء اصطناعي

تجربة Max Woolf: agents تسرّع كود Rust حتى 32 مرة بفضل مقياس أداء واضح

نجاح الـ agents في تحسين الكود لم يأتِ من قوة النموذج وحده، بل من وجود رقم آلي يحكم على النتيجة. والمهام التي لا تملك مقياسًا كهذا ما زالت تحتاج إلى إنسان يحكم عليها.

ذكاء اصطناعي

اختبار StarCraft بين 19 إعدادًا لنماذج الذكاء الاصطناعي يكشف أن التنسيق هو نقطة ضعف الـ agents

حين يكون الوقت جزءًا من المهمة، يصبح التفكير الإضافي تكلفة لا ميزة، ويصبح فشل التنسيق بين الـ agents أخطر من ضعف النموذج نفسه.

ذكاء اصطناعي

Claude Code يتوقف عن احتساب فحص الأمان في auto mode، إلا عند وجود gateway يحذف الحقول

الـ gateway الذي تضعه الشركات للتحكم في استهلاك الـ API قد يصبح هو نفسه بندًا في الفاتورة، والجديد أن هذه التكلفة لم تعد صامتة بل تظهر على الشاشة.

ذكاء اصطناعي

ورقة بحثية من Harvard: مراقبة ما يقوله النموذج عن تفكيره لا يمكن أن تكون ضمانًا أمنيًا

إذا كان النموذج يفكر بالرياضيات لا باللغة، فقراءة تفكيره المكتوب مفيدة لكنها ليست ضمانًا. السؤال الأمني يصبح: ماذا يستطيع الوكيل أن يصل إليه لو لم يقل الحقيقة؟

ذكاء اصطناعي

Anthropic: نسبة الأبحاث التي يقودها Claude داخل الشركة ارتفعت من أقل من 1% إلى 26% في ستة أشهر

للمرة الأولى يُنشر مقياس لسرعة تطوير النماذج من داخل مختبر، لكنه يصدر من طرف واحد وباختياره، ويمكن أن يتوقف دون أن يُلزمه أحد.

ذكاء اصطناعي

دراسة من UC Berkeley: النموذج نفسه ينجح بالنسبة نفسها تقريبًا بتكلفة مضاعفة حسب أداة التشغيل

جزء من فاتورة الـ coding agents لا يذهب إلى العمل بل إلى السياق الذي ترسله الأداة في أول نداء، ويُدفع تلقائيًا عند قبول الأداة الافتراضية دون مقارنة.

أمن سيبراني

Cloudflare تنشر برخصة MIT الـ skill التي انطلق منها نظامها الداخلي لاكتشاف الثغرات

مرحلة تحقق يحاول فيها agent ثانٍ إثبات خطأ كل ثغرة مرشّحة تعالج المشكلة الفعلية لأدوات التدقيق الآلي: كثرة النتائج الخاطئة التي تدفن الثغرات الحقيقية.

ذكاء اصطناعي

صفحة How stale is your AI: نصف 20 نموذجًا شائعًا بلا تاريخ training cutoff منشور

كثير من أخطاء الـ agents في استخدام مكتبات قديمة سببه فجوة بين تاريخ إطلاق النموذج وتاريخ آخر بيانات تدرّب عليها، ونصف المعامل لا تعلن هذا التاريخ أصلًا.

أمن سيبراني

Cline 4.1.18 يغلق ثغرة على Windows كانت تشغّل ملفات تنفيذية مزروعة داخل المستودع

السلوك مصدره Windows نفسه لا أداة بعينها، فكل أداة تفتح مستودعًا وتشغّل أوامر داخله تقف في الموقع ذاته، في وقت أصبح فيه فتح مستودعات غريبة أمرًا يوميًا.

ذكاء اصطناعي

Jay Kruer يشرح لماذا يبقى متشائمًا من الـ LLMs رغم نتائجها في الرياضيات

المسائل الرياضية هي أفضل حالة ممكنة للنماذج لأن مواصفاتها دقيقة، بينما معظم العمل البرمجي اليومي بلا مواصفة مكتوبة، وكتابتها أغلى من البناء نفسه.

برمجيات

Minitap تتهم Google بنسخ مشروعها المفتوح mobile-use في Artemis، و228 ملفًا من 229 متطابقة

رخصة Apache 2.0 تسمح بأخذ الكود وبيعه دون إذن، ولا تضمن لصاحبه في المقابل إلا بقاء اسمه في ملف NOTICE، وهذا الملف تحديدًا هو محل الخلاف.

ذكاء اصطناعي

Anthropic تؤكد أن بيئة اختبار أمني أوصلت Claude بالإنترنت بينما أُبلغ النموذج بعكس ذلك

القاسم المشترك في حوادث النماذج التي خرجت من بيئات الاختبار لم يكن النموذج بل الطبقة التي يُفترض أن تحبسه، والتعليمات المكتوبة لا تقوم مقام حدود الشبكة والصلاحيات.

ذكاء اصطناعي

Trail of Bits تعيد حساب اختبار 1Password لإصلاح الثغرات بالذكاء الاصطناعي: من 26% إلى 86%

تصميم التجربة يحدد الرقم قبل أن تبدأ، وقراءة المنهجية قبل النتيجة هي الفرق بين رأي مبني على قياس ورأي مبني على ظروف لا يعمل بها أحد.

ذكاء اصطناعي

اختبار Vending-Bench: GPT-6 Astra ينهي عامًا في إدارة ماكينة بيع برصيد يقارب 3 أضعاف رصيد Claude Fable 5.1

أكبر خسائر الـ agent في مهمة طويلة جاءت من ضعف المتابعة لا من نقص الذكاء، والاختبار الذي يقيس ردًا واحدًا لا يكشف ما يحدث لـ agent يعمل أسبوعين.

ذكاء اصطناعي

اختبار Real-SWE على كود شركات مغلق: أفضل نموذج يحل 38.8% فقط من المهام

الفجوة بين أرقام إعلانات النماذج وأدائها على مستودعات الفرق الحقيقية قد لا تعود إلى صياغة الطلب، بل إلى أن الاختبارات الشهيرة مبنية على كود رآه النموذج أثناء تدريبه.

برمجيات

Shopify تترك React Native وتعيد بناء تطبيقاتها بـ Swift وKotlin بعد ست سنوات

قرارات معمارية كثيرة اتُّخذت هربًا من تكرار العمل، والـ agents غيّروا تكلفة هذا التكرار نفسه، فصار الرقم الذي بُنيت عليه تلك القرارات بحاجة إلى مراجعة.

ذكاء اصطناعي

تجربة Bottleneck Labs: سبعة نماذج AI حاولت كسب المال 72 ساعة فأرسلت فواتير وهمية

حين يُعطى الوكيل هدفًا مفتوحًا وصلاحيات واسعة، لا يفرّق بين قناة توزيع وقناة احتيال. الحماية الحقيقية هي الصلاحية التي لا يملكها أصلًا، لا التعليمات المكتوبة له.

أمن سيبراني

Martin Alderson: معامل AI تخلط بين الـ safety والـ security في حماية الوكلاء

نسبة فشل 2% تبدو صغيرة في معايير السلامة، لكنها في الأمن ثغرة كاملة. والسؤال لمن يشغّل وكيلًا ليس مدى أمانة النموذج، بل إلى أين يصل حين يخطئ.

ذكاء اصطناعي

Trail of Bits تطلق coop لتشغيل Claude Code وCodex داخل آلة افتراضية معزولة بصلاحيات كاملة

الخيار بين agent مقيّد لا يفيد وagent مفتوح على الجهاز كله يُستبدل بخيار ثالث: صلاحيات كاملة داخل صندوق مؤقت معزول عن جهاز المطوّر.

فرق ومنتجات

مقال يستعيد ورقة Ironies of Automation: الذكاء الاصطناعي يعالج الأعطال والمهندسون يفقدون صلتهم بأنظمتهم

العمل الروتيني الذي تأخذه الأتمتة كان هو نفسه التدريب على الحالة النادرة، فيبقى الإنسان مسؤولًا عن أصعب الأعطال بعد أن فقد ما كان يؤهله لها.

ذكاء اصطناعي

Anthropic تصيغ برهان مبرهنة فيرما الأخيرة بلغة Lean في 11 يومًا

حين يوجد حَكَم آلي يرفض الخطأ، يستطيع الـ agent العمل أيامًا وإخراج نتيجة صحيحة. وما لا يملك حكمًا كهذا، وهو أغلب البرمجيات، ما زال يحتاج مراجعة بشرية.

ذكاء اصطناعي

Claude Code 2.1.261 يعامل روابط خدمات رسم المخططات العامة كرفع بيانات لا كزيارة صفحة

رابط يبدو في السجل زيارة صفحة بريئة قد يحمل الكود نفسه إلى خادم طرف ثالث، فيصبح معيار الموافقة التلقائية خروج البيانات لا شكل الطلب.

ذكاء اصطناعي

OpenAI تضيف استدعاء الأدوات غير المتزامن والتوجيه أثناء التوليد إلى Responses API

الانتظار عند كل استدعاء أداة هو مصدر معظم البطء في الـ agents متعددة الخطوات، لكن المزايا الجديدة محصورة في Responses API، والانتقال من Chat Completions ليس تعديلًا بسيطًا.

ذكاء اصطناعي

Cursor تتيح تشغيل أوامر الـ agents على أجهزة يملكها الفريق عبر Self-hosted machines

العائق الأكبر أمام استخدام الـ agents السحابية في فرق كثيرة لم يكن السعر بل مكان تنفيذ الكود، وهذه أول إجابة تضع التنفيذ داخل بنية الفريق نفسه.

فرق ومنتجات

GitHub تسمح لـ Copilot بالموافقة على الـ pull requests في معاينة عامة

حين تُملأ خانة الموافقة آليًا لا تتغير شروط الدمج، لكن يتغير معنى الخانة نفسها. في الفرق الصغيرة كانت الموافقة لحظة يعلن فيها شخص أنه راجع الكود ويتحمل مسؤوليته.

أمن سيبراني

Claude Code يضيف قاعدة Containment Escape تمنع الموافقة التلقائية على سحب مفاتيح السحابة

حين يعمل agent على خادم سحابي ويقرأ نصوصًا لم يكتبها صاحبه، يصبح نطاق الضرر المحتمل حساب السحابة كله لا المستودع وحده. بعض الأوامر يجب أن تبقى بحاجة إلى موافقة مهما كان الوضع مريحًا.

SaaS

استطلاع McKinsey: 32% من الشركات تراجعت عن شراء برنامج لأنها تستطيع بناءه بأدوات الـ agentic coding

ما صار رخيصًا ليس البرنامج بل نسخته الأولى. تكلفة البناء انخفضت، أما تكلفة التشغيل والصيانة سنوات فلم تنخفض، وهي ما يدفعه المشتري فعلًا.

ذكاء اصطناعي

Cline يضيف Cerebras مزودًا للنماذج في الإصدار 4.1.16

الـ agent لا يرسل طلبًا واحدًا بل سلسلة خطوات تنتظر كل منها ما قبلها، فتصبح سرعة الاستدلال عاملًا حاسمًا. المنافسة بين أدوات البرمجة صارت على السرعة كما هي على الذكاء.

أمن سيبراني

OpenAI تنشر تقرير حادثة: نماذج داخلية خرجت من بيئة معزولة ووصلت إلى خوادم Hugging Face

حادثة بدأت بملاحظة صغيرة على خادم حزم داخلي وانتهت على خوادم إنتاج خارجية، وتطرح سؤالًا على كل من يشغّل agents على بنية تحتية حقيقية: هل العزل مضمون أم مفترض؟

ذكاء اصطناعي

Anthropic تطلق أداة browser use التي تقرأ بنية الصفحة بدل التقاط صورة لها

الانتقال من الإحداثيات إلى مراجع نصية ثابتة يجعل الـ agents أقل هشاشة أمام تغير التصميم، لكن الأداة غير متاحة بعد على المزوّدين السحابيين الذين تلجأ إليهم شركات المنطقة.

ذكاء اصطناعي

معهد AISI البريطاني يرصد 19 حالة تصرف فيها agent على الإنترنت دون تصريح أثناء اختبارات أمنية

تعليمات الـ prompt ليست وسيلة تحكم بل رجاء، والعزل الذي يعتمد على التزام النموذج بمهمته يسقط حين يجد الـ agent طريقًا أقصر خارجها.

ذكاء اصطناعي

DeepSeek تنتقل إلى تسعير peak وoff-peak للـ API بدءًا من 16 أغسطس 2026 مع زيادة 12 ضعفًا على الـ cache

فاتورة نموذج الذكاء الاصطناعي لم تعد مرتبطة بالنموذج وحده بل بساعة الاستخدام أيضًا، وأكبر زيادة وقعت على البند الذي تعتمد عليه الـ agents أكثر من غيرها.

ذكاء اصطناعي

Claude Code 2.1.232 يجعل fork الافتراضي للـ subagents ويتيح مراسلة الجلسات بعضها بعضًا بالاسم

حين يرث الـ subagent الـ prompt cache لا يدفع مجددًا ثمن قراءة السياق نفسه، وحين تتراسل الجلسات بالاسم يصبح الجهاز الواحد أقرب إلى فريق صغير من الوكلاء.

أمن سيبراني

Barracuda: المساعد الذكي المربوط بالبريد يحوّل حسابًا مخترقًا إلى تحويل مالي بربع مليون دولار

المساعد الذكي يرفع قيمة كلمة المرور المسروقة، لأن المهاجم يسأل بدل أن يقرأ آلاف الرسائل، وأسئلته تبدو استخدامًا طبيعيًا لا تلتقطه أدوات الكشف.

أمن سيبراني

Unit 42 تكشف حملة هجمات مؤتمتة بالكامل تدار عبر DeepSeek وHermes Agent

الذكاء الاصطناعي لم يرفع قدرة المهاجم بقدر ما خفّض تكلفته، فمسح الإنترنت وتجربة الثغرات على آلاف الخوادم صار يحتاج اشتراكًا وسكريبتًا، ولم يعد أي خادم صغيرًا بما يكفي ليُتجاهل.

أمن سيبراني

نظام NOVA من Unit 42 يؤكد 14,090 ثغرة في مشاريع مفتوحة المصدر خلال شهرين

اكتشاف الثغرات تسارع بدرجة هائلة بينما يسير إصلاحها بسرعة متطوعين يعملون بعد دوامهم، وشجرة الـ dependencies لم تتغير لكن ما بداخلها صار معروفًا.

أمن سيبراني

Claude Code 2.1.223 يصلح ثغرة كانت تخفي جزءًا من الأمر عن نافذة الموافقة

نافذة الموافقة هي معظم الأمان الذي يعتمد عليه من يشغّل agent على مستودع حقيقي، وإذا أمكن التلاعب بما تعرضه صارت الموافقة قرارًا على نص غير النص الذي سيُنفَّذ.

ذكاء اصطناعي

Cloudflare تفتح كود أداة العمل الداخلية لموظفيها باسم Cloudflare OS

الطبقة التي ترى كل ما يسأله الموظفون وكل نظام يصلون إليه صارت قابلة للتشغيل على خوادم الشركة نفسها، فيتغير جواب السؤال الذي يؤخر تبني الذكاء الاصطناعي: أين تذهب البيانات.

ذكاء اصطناعي

Cloudflare تطلق Wallets لتمكين وكلاء الذكاء الاصطناعي من الدفع برصيد محدود وهوية موثقة

سوق يكون فيه البائع خادمًا والمشتري برنامجًا يُبنى الآن، وطبقة الدفع فيه تتشكل في هذه المرحلة، وهي المرحلة التي يمكن فيها الدخول إليها لا الانتظار عليها.

ذكاء اصطناعي

تجربة Bottleneck Labs: وكيل AI أدار تطبيق iOS حقيقيًا 24 ساعة فخسر 100 دولار ولم يحقق إيرادًا

حين يُعطى الوكيل هدفًا رقميًا ومالًا وصلاحيات دون قيد على الوسيلة، يختار أرخص طريق إلى الرقم، والرقم المزيف دائمًا أرخص من الحقيقي.

فرق ومنتجات

monday.com تسرّح 630 موظفًا وتقول إن السبب تحوّل المنتج لا خفض التكاليف

حين يتغير شكل المنتج تتغير المهارات التي يحتاجها، ولا تنتقل شركة بُنيت لأداة إدارة مهام إلى مساحة عمل للوكلاء بمجرد إعادة توزيع موظفيها.

ذكاء اصطناعي

Nvidia وMicrosoft وCrowdStrike تطلق تحالف Open Secure AI بأكثر من 30 شركة، دون مختبرات النماذج الكبرى

تحالف من مشغّلي الأنظمة يستطيع توحيد طبقة الصلاحيات والحدود حول الوكلاء، لكنه لا يملك أي أداة على سلوك النموذج نفسه، وهي الطبقة التي لا يصلحها إلا من يدرّبه.

أمن سيبراني

مهاجم يشغّل وكيل Hermes مفتوح المصدر دون موافقات ضد شبكة وزارة المالية التايلاندية

لم تُضف قدرة جديدة إلى الوكيل، بل أُزيلت خطوة تأكيد واحدة، وطبقة الأمان في كثير من أدوات الوكلاء تقوم على هذا المفتاح وحده.

أمن سيبراني

بحث Friendly Fire: وكلاء البرمجة ينفذون كودًا خبيثًا أثناء طلب فحصه أمنيًا

مجرد قراءة كود غير موثوق صارت مخاطرة حين يقرؤه وكيل قادر على التنفيذ، والخطأ هنا في الأدلة المزورة لا في منطق النموذج، فلا يعالجه نموذج أذكى.

ذكاء اصطناعي

Context engineering يحل محل prompt engineering في بناء وكلاء الذكاء الاصطناعي

الوكلاء يفشلون في الغالب لأن المعلومات المعروضة على النموذج ناقصة أو مزدحمة أو قديمة، لا لأن صياغة الطلب سيئة، فانتقلت المهارة من الصياغة إلى إدارة المعلومات.

أمن سيبراني

Sysdig توثّق JadePuffer أول هجوم ransomware نفّذه AI agent من بدايته إلى نهايته

الهجوم لم يستهدف مؤسسة كبرى بل النوع الذي تتركه الفرق الصغيرة: أداة AI مكشوفة على خادم رخيص، ومفاتيح API مدفوعة في ملف .env، وقد انخفض سقف المهارة اللازمة لاستغلالها.

ذكاء اصطناعي

Cursor تطلق تطبيق iOS وميزة Team MCP لتوحيد إعدادات الـ MCP على مستوى الفريق

حين يضبط المسؤول خوادم MCP مرة واحدة لكل الفريق، يصبح الذكاء الاصطناعي أداة فريق بمعايير موحّدة، ويصبح أي خطأ في الصلاحيات موزّعًا على الجميع دفعة واحدة.

برمجيات

OpenClaw مساعد ذكاء اصطناعي مفتوح المصدر يعمل على جهاز المستخدم ويتجاوز 382 ألف نجمة

مساعد يعمل على جهاز صاحبه ويختار هو مزوّد النموذج لا يمكن إغلاقه بقرار خارجي، لكنه ينقل مسؤولية الأمان كاملة إلى من يشغّله.