Anthropic وOpenAI تخفضان سعر قراءة الـ cache إلى 5% من سعر الإدخال في إصداريهما الجديدين
الوكلاء الذين يعيدون قراءة السياق نفسه طوال اليوم هم أكثر من يستفيد من هذا الخفض، وأثره يظهر في الفاتورة الشهرية لا في العرض التجريبي، بينما يبقى سببه دون تأكيد رسمي.
تُظهر صفحتا التسعير الرسميتان لدى Anthropic وOpenAI أن سعر قراءة الـ cache انخفض إلى النصف لدى الشركتين، كلٌّ في إصدارها الأحدث. كانت القراءة من الـ cache تُحتسب بنسبة 10% من سعر الإدخال، وأصبحت 5%.
بالأرقام، كان سعر قراءة الـ cache في Opus 5 يبلغ 0.50 دولار لكل مليون token، وأصبح في Opus 5.5 يبلغ 0.20 دولار. ولدى OpenAI كان السعر في GPT-5.6 Sol يبلغ 0.40 دولار، وأصبح في GPT-6.1 Sol يبلغ 0.10 دولار. ووصفت Artificial Analysis التغيير نفسه بصيغة أخرى، إذ قالت إن خصم قراءة الـ cache ارتفع من 90% إلى 95%.
والمقصود بقراءة الـ cache أن يرسل المطور السياق نفسه مرة أخرى، كتعليمات النظام أو الملفات التي يعمل عليها الوكيل، فلا يدفع عليه السعر الكامل لأن النموذج سبق أن عالجه واحتفظ بنتيجة المعالجة.
أما سبب تزامن الخفض لدى شركتين مختلفتين وبالنسبة نفسها، فلم تعلنه أي منهما. ويرجعه تحليل منشور في 29 سبتمبر 2026 إلى تحسينات على الـ KV cache نشرتها DeepSeek مفتوحة للجميع، ولم تؤكد Anthropic ولا OpenAI ذلك. والـ KV cache هو ما يحتفظ به النموذج من حسابات السياق السابق في ذاكرة الـ VRAM على بطاقات الرسوميات. وكلما صغر حجمه انخفضت تكلفة تشغيله، فيصبح خفض السعر ممكنًا.
ويظهر أثر هذا التغيير أكثر ما يظهر في الوكلاء الذين يدورون على الملفات نفسها طوال اليوم، فمعظم ما يرسلونه سياق متكرر. والفارق هنا لا يظهر في تجربة قصيرة، بل في فاتورة آخر الشهر.
ويكشف الخبر أيضًا أن سعر جزء أساسي من تكلفة المنتجات المبنية على هذه النماذج يتحرك بقرار من الشركات المالكة لها وحدها، ودون شرح لأسبابه.