Microsoft تعلن MAI-Cyber-1-Flash ونظامها يسجل 95.95% في اختبار CyberGym بنصف التكلفة
اكتشاف الثغرات صار رخيصًا، لكن القدرة ليست موزعة بالتساوي؛ فجزء من الكود المفتوح الذي يبني عليه الجميع يُفحص داخل برامج شركاء مغلقة، ويصل الإصلاح لغيرهم متأخرًا.
أعلنت Microsoft، في 28 يوليو 2026، نموذج MAI-Cyber-1-Flash المتخصص في الأمن السيبراني. وهو نموذج من نوع mixture-of-experts، يضم 137 مليار معامل إجمالًا، ينشط منها 5 مليارات فقط في كل خطوة. وسجّل نظام MDASH الذي يعتمد عليه 95.95% في اختبار CyberGym.
والمستوى الأول من هذا الاختبار ليس أسئلة اختيار من متعدد. فهو يقدّم للوكيل وصف ثغرة وكودًا غير مُصلَح، ويطلب منه إثباتًا عمليًا على أن الثغرة قابلة للاستغلال.
والجانب الاقتصادي أهم من الرقم. فالنموذج الصغير يتولى ما يصل إلى 90% من مهام MDASH، ولا يُحال إلى GPT-5.4 الأكبر إلا أصعب 10%. والنتيجة أداء مقارب بنحو 50% من تكلفة التركيبة السابقة التي كانت تجمع GPT-5.4 وGPT-5.4-mini وGPT-5.3-Codex.
ولم يكن الإعلان حدثًا منفردًا. ففي 27 يوليو، سجّل وكيل Atlas من شركة Wiz نسبة 90.9% على الاختبار نفسه، وكشف أكثر من 200 ثغرة يوم-صفر في كود مفتوح المصدر واسع الاستخدام. كما تملك Anthropic نموذجًا من الفئة نفسها باسم Claude Mythos، وقالت صراحة إنها لا تنوي طرحه للعامة، وتقصره على برنامج شركاء مغلق هو Project Glasswing، وجد فيه الشركاء أكثر من 10,000 ثغرة عالية الخطورة أو حرجة.
والمسألة هنا في التوزيع لا في القدرة. فاكتشاف الثغرات أصبح رخيصًا، لكن الكود المفتوح الذي تبني عليه شركات المنطقة يُفحص جزء منه داخل دوائر شركاء مغلقة. والإصلاحات تصل في النهاية إلى الجميع، لكنها قد تصل إلى من هم خارج هذه الدوائر متأخرة بأشهر. ويبقى الخلاف قائمًا حول ما إذا كان ينبغي طرح قدرة كهذه للجميع أم إبقاؤها مقيدة.
المصادر
من عدد الأربعاء 15 صفر - 29 يوليو