Moonshot AI تعلن Kimi K3 بحجم 2.8 تريليون parameter ومعمارية MoE من 896 خبيرًا
الرقم الضخم يصف سعة معرفة مخزنة لا عملًا يُنفَّذ، وقيمة الأوزان المفتوحة ليست في تشغيلها منزليًا بل في أن جهة عربية تستطيع امتلاكها وتشغيلها دون إذن أحد.
أعلنت شركة Moonshot AI الصينية في 16 يوليو 2026 نموذج Kimi K3، بحجم 2.8 تريليون parameter، ليصبح أكبر نموذج مفتوح الأوزان حتى الآن. ويدعم النموذج نافذة سياق تصل إلى مليون توكن، ومن المقرر نشر الأوزان في 27 يوليو 2026. وسعره عبر الـ API هو 3 دولارات لكل مليون input token و15 دولارًا لكل مليون output token.
لكن الرقم الكبير يحتاج إلى تفسير، لأن النموذج مبني على معمارية MoE، اختصارًا لـ Mixture of Experts.
فالنموذج التقليدي، ويُسمى dense، يشغّل كل الـ parameters عند توليد كل token. ولو كان النموذج بحجم 2.8 تريليون parameter بهذه الطريقة، لكانت تكلفة تشغيله غير عملية.
أما في MoE فيُقسَّم النموذج إلى «خبراء» متخصصين، ولدى Kimi K3 منهم 896 خبيرًا. ويمر كل token على موجّه صغير (router) يختار 16 خبيرًا فقط من بينهم. أي أن ما يعمل فعليًا عند كل token هو نحو 1.8% من النموذج.
وتمثل الـ 2.8 تريليون سعة معرفة مخزنة، لا عملًا يُنفَّذ في كل خطوة، تمامًا كمكتبة ضخمة يُقرأ منها بضعة كتب للإجابة عن سؤال واحد. وهذا ما يفسر السعر، الأرخص بكثير من نماذج غربية في المستوى نفسه.
وفي اختبار GDPval-AA v2 حصل النموذج على 1,687 نقطة، ليحل ثالثًا عالميًا بعد Fable 5 Max (1,815) وGPT-5.6 Sol Max (1,747.8)، ومتقدمًا على Claude Opus 4.8 (1,600). وجزء كبير من هذه النتائج معلن من الشركة نفسها ولم يُراجَع بشكل مستقل بعد.
ولا يعني «مفتوح الأوزان» إمكانية تشغيله على جهاز شخصي. فتشغيله يتطلب تحميل النموذج كاملًا في الذاكرة، لأن الموجّه لا يعرف مسبقًا أي خبير سيحتاج، فيجب أن يكون الخبراء جميعًا جاهزين. وهذا يعني عشرات وحدات GPU.
والفرق الحقيقي عن النموذج المغلق أن شركة أو جامعة أو جهة عربية تستطيع تنزيله على خوادمها، وتعديله (fine-tune) على بيانات عربية، وتشغيله دون استئذان أحد، ودون أن يستطيع طرف آخر إيقافه.
المصادر
من عدد الجمعة 3 صفر - 17 يوليو