ذكاء اصطناعيقراءة دقيقتين

OpenAI تختبر طبقة Ultrafast تشغّل GPT-5.6 Sol على شرائح Cerebras بسرعة 750 token في الثانية

المغزى

النموذج لم يتغير، والسرعة جاءت من العتاد، لكن السرعة عند OpenAI بند في الفاتورة، وما دام سعر الطبقة الجديدة غير معلن فهي اتجاه لا منتج يُخطَّط عليه.

أعلنت OpenAI في 13 أغسطس 2026 عن طبقة API جديدة باسم Ultrafast، في مرحلة معاينة (preview). وتشغّل هذه الطبقة نموذج GPT-5.6 Sol على عتاد Cerebras بسرعة تصل إلى 750 token في الثانية، أي نحو 14 ضعف سرعة الوضع العادي (Standard).

والنموذج نفسه لم يتغير. ما تغيّر هو العتاد الذي يعمل عليه.

ففي معالجات GPU، تُحفظ أوزان النموذج في ذاكرة خارج الشريحة. ومع كل token يُولَّد، يجب نقل هذه الأوزان من الذاكرة إلى وحدات الحساب. ولذلك لا يكون الاختناق في سرعة الحساب، بل في سرعة النقل.

أما Cerebras فتصنع شريحة واحدة بحجم رقاقة السيليكون (wafer) كاملة، وتبقى الأوزان على الشريحة نفسها. وبهذا تختفي خطوة النقل من المعادلة.

ولا يظهر هذا الفرق في جودة الإجابة، بل في الحالات التي يكون فيها الانتظار مكلفًا: المحادثات الصوتية، والـ agent الذي ينفّذ عشر خطوات متتالية، وأدوات إكمال الكود أثناء الكتابة.

لكن ثلاث مسائل لم تُعلَن بعد: لا يوجد سعر معلن للطبقة، ولا موعد للإتاحة العامة، والدخول عبر قائمة انتظار لعملاء مختارين.

وللمقارنة، يكلّف وضع Fast الحالي لدى OpenAI ضعف الوضع العادي: 10 دولارات للمدخلات و60 دولارًا للمخرجات لكل مليون token، مقابل 5 و30 دولارًا في الوضع العادي.

أي أن السرعة لدى OpenAI تُسعَّر بوصفها بندًا مستقلًا في الفاتورة. وإلى أن يُعلَن سعر Ultrafast، يبقى الإعلان مؤشرًا على اتجاه، أكثر منه منتجًا يمكن للفرق أن تبني حساباتها عليه.

المصادر

  1. المدونة التقنية الرسمية لـ Cerebras
  2. تقرير The Decoder
  3. تقرير MLQ عن تفاصيل المعاينة
  4. ملخص أسعار OpenAI (AI Pricing Guru)
  5. صفحة أسعار OpenAI API

من عدد الأحد 3 ربيع الأول - 16 أغسطس

أخبار ذات صلة

أخبار الأحد 3 ربيع الأول - 16 أغسطس