مشروع Ollaya يشغّل نماذج القرار المفتوحة محليًا بزمن استجابة 8 ميلي ثانية ودعم للعربية
مهام التصنيف في المنتجات تُرسل عادة إلى API مدفوع مع كل نداء، ونماذج القرار المحلية تجعل التكلفة مرتبطة بالجهاز لا بعدد النداءات، مع بقاء البيانات داخل الشركة.
حصد مشروع مفتوح المصدر اسمه Ollaya 585 نقطة على Hacker News في 25 سبتمبر 2026. والمشروع يشغّل نوعًا من النماذج يسمى decision models على جهاز المستخدم، وهو مستقل ولا يتبع Ollama ولا TypeSafe، كما يوضح في صفحته الرئيسية.
ونماذج القرار لا تولّد نصًا أصلًا. فهي تستقبل نصًا وأسئلة مكتوبة بأنواع محددة، وتعيد إجابة عن كل سؤال مصحوبة باحتمال، في forward pass واحد، أي في مرور واحد عبر النموذج. ولذلك فهي سريعة، إذ تستغرق الإجابة عن السؤال الواحد من 8 إلى 11 ميلي ثانية.
ويعمل Ollaya بمنطق Ollama نفسه: أوامر pull وrun وserve، وواجهة API محلية.
والاستخدام العملي واضح في أغلب المنتجات. فهناك دائمًا جزء يصنّف شيئًا: إلى أي فريق تذهب هذه التذكرة، وهل هذه الرسالة spam، وهل هذه الشكوى عاجلة، وهل هذا المحتوى آمن. وغالبًا تُرسل هذه المهام إلى API مدفوع مع كل نداء. أما هنا فتجري على جهاز الشركة، دون فاتورة لكل نداء، ودون أن تغادر البيانات.
ومن النماذج المتاحة qwen3guard من فريق Qwen، وهو نموذج حماية يعمل بـ 119 لغة منها العربية. وهناك نموذج اسمه laya يوجّه النص الإنجليزي إلى نسخة والنص غير الإنجليزي إلى نسخة أخرى.
ولا يستضيف Ollaya الأوزان بنفسه، بل يسحبها من مستودعات أصحابها على Hugging Face، مثبّتة على commit محدد، ويتحقق من كل ملف ببصمة sha256، وهو تفصيل مهم للفرق التي تهتم بالحوكمة. ويتضمن المشروع أيضًا خادم MCP يتيح لأدوات مثل Claude Code وCursor أن تسأل النموذج عن قرار بدل أن تجتهد وحدها.
وهذه النماذج ليست بديلًا لنموذج لغة كبير، بل للموضع الذي يُدفع فيه سعر نموذج كبير للحصول على “نعم” أو “لا”. وفي هذا الموضع يصبح عدد النداءات الشهرية، لا سعر الـ token، هو الرقم الذي يحدد الفرق.