ذكاء اصطناعيقراءة دقيقتين

Cognition تطلق SWE-2 وتقول إنه أرخص بنسبة 64% دون نشر سعر للـ token

المغزى

نسبة توفير بلا سعر أساس معلن لا تدخل في أي حساب، ونموذج بلا API مستقل ولا أوزان مفتوحة هو اشتراك في منتج أكثر منه نموذجًا يُبنى عليه.

أطلقت شركة Cognition في 10 سبتمبر 2026 نموذجًا للبرمجة باسم SWE-2. وبحسب أرقامها، يسجل 50.0% على اختبار FrontierCode 1.1 Main، مقابل 50.9% لـ Fable 5.1، إلى جانب 73.0 على DeepSWE 1.1 و92.8 على Terminal-Bench 2.1.

وتقول الشركة إن تكلفته أقل بنسبة 64% من Fable 5.1 عند الدرجة نفسها، وإنها ربع تكلفة GPT-6 Astra، وأقل بنسبة 81% من نموذجها السابق SWE-1.7.

لكن في الإعلان ملاحظتين تحدان من قيمة هذه الأرقام.

الأولى أن FrontierCode اختبار أعدّته Cognition نفسها. وفكرته جديرة بالاهتمام، إذ يقيس ما إذا كان الـ pull request الذي كتبه النموذج سيقبله maintainer حقيقي، وهو معيار أقرب إلى العمل الفعلي من مجرد اجتياز الاختبارات. غير أن الجهة التي تضع الاختبار هي نفسها الجهة التي تُمتحن فيه.

والثانية، وهي الأهم، أنه لا يوجد سعر منشور لكل مليون token. فكل حديث التكلفة نسبي: أرخص من هذا، وربع ذاك. ونسبة من دون أساس معلن لا يمكن إدخالها في حساب تكلفة أي منتج.

ولا يتوفر للنموذج API مستقل، ولا أوزان مفتوحة. فهو يعمل داخل منتج Devin فقط، في نسختي Desktop وCLI حاليًا، على أن تصل نسختا Web وFusion لاحقًا.

وهذا يغير طبيعة العرض. فما يُباع هنا ليس نموذجًا يمكن للمطور أن يبني فوقه، بل اشتراك في منتج. والفرق جوهري لمن يقارن بين خيارات للاعتماد عليها في منتجه، لأن تقييم العرض يحتاج إلى رقمين لم يُعلنا بعد: سعر الـ token، ونتيجة النموذج على اختبارات لا يملكها صاحبه، مثل Artificial Analysis وLMArena.

المصادر

  1. إعلان Cognition عن SWE-2
  2. أسعار OpenAI المعلنة للمقارنة
  3. Artificial Analysis، مقارنات مستقلة
  4. LMArena

من عدد الجمعة 29 ربيع الأول - 11 سبتمبر

أخبار ذات صلة

أخبار الجمعة 29 ربيع الأول - 11 سبتمبر