مهمة واحدة على Codex أطلقت 826 agent وفاتورة يقدّرها صاحبها بنحو 78 ألف دولار
الإعادة التلقائية لشحن الرصيد لا تضع حدًّا شهريًا للإنفاق، بل حدًّا لكل شحنة، فتتراكم الفواتير الصغيرة دون جدار تتوقف عنده.
نشر مطوّر يحمل اسم lorenzomassaro على Hacker News في 26 سبتمبر 2026 بلاغًا مفصّلًا يقول فيه إن مهمة واحدة على Codex انتهت بفاتورة تقارب 78 ألف دولار، موزّعة على 162 فاتورة. ولم تردّ OpenAI على البلاغ حتى الآن، ويقول صاحبه إن لديه طلب دعم مفتوحًا منذ أسبوعين. ويحذّر هو نفسه من أن عدّادات الـ tokens المحلية التي اعتمد عليها ليست السجل المحاسبي الرسمي، وأن الربط الحقيقي بين المهام والفواتير لا تملكه إلا OpenAI.
بحسب البلاغ، فُتحت المهمة في 10 يوليو 2026 من VS Code، وكان المطلوب مراجعة واجهة المستخدم لوحدة واحدة في المنتج، بنموذج GPT-5.5 بمستوى تفكير Medium. لكن المهمة ولّدت 826 مهمة فرعية، لكل منها معرّف مستقل، وسُجّلت على نموذج آخر بمستوى تفكير أعلى، هو GPT-5.6 Sol بمستوى Ultra.
ويذكر البلاغ أن 104 من هذه المهام وحدها سجّلت نحو 147.9 مليار token في العدّادات المحلية. وتشير عناوينها إلى أن مراجعة الواجهة توسّعت من تلقاء نفسها لتشمل الـ backend وOAuth ونظام احتساب الاستهلاك وعمليات التدقيق.
أما الآلية التي جعلت الرقم يصل إلى هذا الحد فليست عدد الـ agents وحده. فالحساب كان مضبوطًا على الإعادة التلقائية للشحن، أي أن الرصيد يُشحن من جديد كلما نفد. ولذلك لم تكن هناك فاتورة كبيرة واحدة تستوقف صاحب الحساب، بل 162 فاتورة صغيرة دُفعت تباعًا. والسقف الذي يبدو أنه يحمي الحساب هو سقف الشحنة الواحدة، لا سقف الشهر.
ويلفت البلاغ أيضًا إلى أن المهام الفرعية عملت على نموذج أغلى من النموذج الذي اختاره المستخدم.
وبالنسبة لفرق المنتجات التي تشغّل agents تتفرع إلى مهام فرعية، يصبح إعداد الفوترة جزءًا من تصميم النظام نفسه. فالتكلفة لا يحددها النموذج المختار في الواجهة فقط، بل ما تقرر الأداة تشغيله لاحقًا دون تدخل. ويبقى السؤال مفتوحًا حتى تردّ OpenAI: كيف تحوّلت المهمة إلى نموذج آخر، وما الذي تقوله سجلاتها الرسمية.