ذكاء اصطناعيقراءة دقيقتين

نموذج Mercury 2.5 من Inception يولّد 770 توكن في الثانية بتقنية diffusion

المغزى

فئة النموذج السريع والرخيص والأقل ذكاء صار فيها مرشح جدي، فأصبح اختيار النموذج قرار منتج يتعلق بما ينتظره المستخدم، لا قرارًا تقنيًا فقط.

يولّد نموذج Mercury 2.5 من شركة Inception نحو 770 توكن في الثانية، ما يجعله ثاني أسرع نموذج من أصل 174 نموذجًا في قياسات Artificial Analysis. سعره 0.25 دولار لكل مليون توكن إدخال، و0.75 دولار لكل مليون توكن إخراج، ونافذة السياق فيه 260 ألف توكن.

لماذا هو سريع

معظم نماذج اللغة المستخدمة اليوم تكتب الإجابة توكنًا بعد توكن، وكل توكن ينتظر ما قبله. أما Mercury فتصفه الشركة بأنه diffusion LLM، أي أنه يعمل بطريقة مختلفة: يُخرج الإجابة كلها دفعة واحدة كمسودة أولية، ثم يحسّنها في جولات متوازية. وهذا مصدر سرعته.

لكن الطريقة نفسها تفسر حدوده. ففي القياس ذاته حصل النموذج على 12 في مؤشر الذكاء، واحتل المرتبة 90 من 174، في حين يبلغ الوسيط 13. أي أنه ليس بديلًا عن النماذج الكبيرة في المهام التي تتطلب تفكيرًا واستنتاجًا.

في المقابل، يبدو مناسبًا للأجزاء التي تكون فيها السرعة هي المنتج نفسه: الإكمال التلقائي، والترجمة الفورية، وأي رد ينتظره المستخدم أمام الشاشة. في هذه الحالات يكون زمن الاستجابة أهم من الدقة الإضافية.

الجديد إذن ليس نموذجًا بعينه، بل أن فئة “السريع والرخيص والأقل ذكاء” صار فيها خيار جاد. وبالنسبة لفرق المنتجات، قد يعني ذلك أن تشغيل ميزة مثل الإكمال التلقائي على نموذج كبير ومكلف لم يعد الخيار الوحيد المتاح، وأن توزيع المهام بين نموذجين بحسب ما ينتظره المستخدم في كل موضع أصبح قرارًا معقولًا من ناحية التكلفة والتجربة معًا.

المصادر

  1. صفحة Mercury 2.5 على Artificial Analysis
  2. موقع Inception وشرح نماذج diffusion
  3. لوحة مقارنة النماذج على السرعة والسعر

من عدد الجمعة 14 ربيع الآخر - 25 سبتمبر

أخبار ذات صلة

أخبار الجمعة 14 ربيع الآخر - 25 سبتمبر