ذكاء اصطناعيقراءة دقيقتين

نسخة 2-bit من Qwen3.8-27B بحجم 7.89 GB تتفوق على النسخة الكاملة في نداء الأدوات وتتراجع في الرياضيات

المغزى

المغزى: التوجيه ونداء الأدوات وحلقات الـ agent، وهي مهام تُدفع اليوم بأسعار النماذج الكبيرة، صارت تعمل على جهاز محلي، بينما يبقى الاستدلال الطويل على الـ API.

نشرت ConwayResearch على Hugging Face في 8 أكتوبر 2026 نموذج Underdog-Saluki-27B-1.0، وهو نسخة مكمَّمة إلى 2-bit من Qwen3.8-27B الذي نشرته Alibaba برخصة Apache 2.0. وحجم الملف 7.89 GB مقابل 54 GB للنسخة الكاملة، وترخيصه Apache 2.0، وتجاوزت تنزيلاته 59,191 خلال يومين.

والمفاجأة في جداول البطاقة أن النسخة الصغيرة تفوقت على الكاملة في نداء الأدوات: 88 مقابل 84 من 120 مهمة مأخوذة من BFCL v4، و42 مقابل 35 في النداءات المتوازية. وفي اتباع التعليمات سجلت 93.5 مقابل 91.5 على IFEval.

لكنها تراجعت بوضوح في الرياضيات. فدرجة AIME 2025 نزلت من 96.7 إلى 79.2، وAIME 2026 من 94.6 إلى 80.0. وتراجعت كذلك في MuSR من 79.6 إلى 67.5، وفي MBPP+ من 83.9 إلى 78.0، وفي SWE-bench Verified من 33 إلى 30. وتنبه البطاقة إلى أن أرقام النسخة الكاملة العامة جاءت من منصة قياس مختلفة.

ويفسر هذا التفاوت طبيعةُ التكميم نفسه. فالتكميم إلى 2-bit يُدخل خطأً صغيرًا في كل وزن. ونداء الأداة قرار قصير: اختيار دالة وملء حقولها بصيغة صحيحة، فلا يكاد الخطأ يظهر فيه. أما المسألة الرياضية فسلسلة طويلة، كل خطوة فيها تبني على ما قبلها، فيتراكم الخطأ الصغير حتى ينهار الحل.

والبطاقة صريحة في حدودها: تحتفظ النسخة بنحو 82 إلى 85% من درجة الرياضيات، وفي نحو خُمس ردود النداءات المتوازية زلات تنسيق صغيرة، والرؤية البصرية ملف إضافي بحجم 629 أو 928 ميجابايت.

ويعمل الملف على llama.cpp كما هو. وهذا يعني أن مهام التوجيه ونداء الأدوات وحلقات الـ agent يمكن أن تنتقل من فاتورة الـ API إلى جهاز محلي، دون بطاقة دفع أجنبية ولا حد شهري. غير أن البطاقة لا تذكر إلا الإنجليزية في اللغات المدعومة، ولا تتضمن أي قياس لأدائه بالعربية.

المصادر

  1. بطاقة النموذج على Hugging Face
  2. النسخة الكاملة Qwen3.8-27B
  3. مشغّل llama.cpp
  4. لوحة BFCL لاختبارات نداء الأدوات
  5. نص ترخيص Apache 2.0

من عدد الأحد 30 ربيع الآخر - 11 أكتوبر

أخبار ذات صلة

أخبار الأحد 30 ربيع الآخر - 11 أكتوبر