استقلال تقنيقراءة دقيقتين

Cohere تطلق نموذج Cohere Transcribe Arabic المفتوح لتفريغ الكلام العربي بلهجاته

المغزى

أدق نموذج مفتوح لتفريغ اللهجات العربية جاء من شركة كندية، رغم أن الخبرات والبيانات العربية موجودة، والفجوة الحقيقية في بيانات الكلام المنطوق المفرّغة.

أطلقت شركة Cohere الكندية في 7 يوليو 2026 نموذج Cohere Transcribe Arabic لتحويل الكلام العربي إلى نص. والنموذج بحجم 2B، ومفتوح برخصة Apache 2.0، أي أن أوزانه متاحة ويمكن تشغيله على خوادم خاصة.

وتُقاس دقة هذه النماذج بمقياس WER، أي Word Error Rate. ويُحسب بمقارنة النص الذي أخرجه النموذج بالنص الصحيح، وعدّ الكلمات الخاطئة والزائدة والناقصة. وكلما انخفضت النسبة كان النموذج أدق.

وسجّل النموذج متوسط WER بلغ 25.87، مقابل 28.32 لنموذج OmniASR 7B و36.86 لنموذج Whisper Large V3 الأوسع استخدامًا، وجاء الأول في 4 من 6 مجموعات اختبار. وبتقريب بسيط، يخطئ Whisper في نحو 37 كلمة من كل 100، بينما يخطئ النموذج الجديد في نحو 26. وفي تقييم بشري، فضّل متحدثون عرب النموذج على Whisper في 95.8% من المقارنات.

وتعود صعوبة العربية على هذه النماذج إلى ثلاثة أسباب تقنية. أولها الفجوة بين المكتوب والمنطوق، فأغلب النصوص المتاحة للتدريب فصحى بينما الكلام اليومي عامية. وثانيها تعدد اللهجات واتساع المسافة بين المصرية والخليجية والمغاربية. وثالثها الـ code-switching، أي خلط لغتين في جملة واحدة، كما في “الـ deploy اتعمل بس الـ tests فشلت”، إذ يجب أن يعرف النموذج متى يكتب الكلمة بحروف عربية ومتى يتركها لاتينية. ويغطي النموذج نحو 25 لهجة، ويُبقي المصطلحات التقنية بحروف لاتينية.

ولا يعني ذلك غياب الجهود العربية. فمنصة Fanar من معهد قطر لبحوث الحوسبة تضم عائلة Aura للتعرف على الكلام وتحويل النص إلى صوت، ومجموعة بيانات SADA من SDAIA السعودية تضم 667 ساعة من الصوت العربي المفرّغ، ونماذج Falcon من TII في الإمارات تتصدر نماذج النص العربي.

لكن الفرق بين الصوت والنص يفسر جزءًا من المشهد. فالنص العربي متاح على الإنترنت بكميات هائلة دون تكلفة إضافية، أما الصوت فيحتاج إلى من يسجله ومن يفرّغه يدويًا كلمة بكلمة. ولذلك تصبح بيانات الكلام المفرّغ أندر وأغلى، ومن يملكها يملك هذه الطبقة لسنوات.

المصادر

  1. إعلان Cohere الرسمي عن Transcribe Arabic
  2. أوزان النموذج على Hugging Face (Apache 2.0)
  3. نسخة تجريبية من المتصفح على Hugging Face
  4. توثيق الـ API من Cohere
  5. موقع Fanar من QCRI
  6. واجهة Fanar البرمجية
  7. الورقة البحثية لـ Fanar 2.0
  8. مجموعة بيانات SADA السعودية على Kaggle
  9. إعلان TII عن Falcon-H1 Arabic
  10. بحث يرسم خريطة تقنيات الصوت العربي
  11. بحث HARNESS عن نماذج صوت عربية خفيفة

من عدد الجمعة 25 محرم - 10 يوليو

أخبار ذات صلة

أخبار الجمعة 25 محرم - 10 يوليو