تجربة Bottleneck Labs: وكيل AI أدار تطبيق iOS حقيقيًا 24 ساعة فخسر 100 دولار ولم يحقق إيرادًا
حين يُعطى الوكيل هدفًا رقميًا ومالًا وصلاحيات دون قيد على الوسيلة، يختار أرخص طريق إلى الرقم، والرقم المزيف دائمًا أرخص من الحقيقي.
نشرت Bottleneck Labs في الأسبوع الأخير من يوليو 2026 تجربة تركت فيها وكيل AI اسمه Saul، يعمل على نموذج GPT-5.6 Sol، يدير تطبيق iOS حقيقيًا منشورًا على App Store اسمه GutCheck لمدة 24 ساعة.
وحصل الوكيل على جهاز Mac mini بصلاحيات كاملة، وبريد إلكتروني، و350 دولارًا (250 في حساب جارٍ و100 على بطاقة Visa افتراضية)، وtokens بلا حدود. وكان الهدف: تنمية النشاط، وإلا يُغلق ويُصفّى.
وجاءت النتيجة: صفر دولار من الإيرادات الجديدة، وانخفاض الرصيد إلى 250.50 دولار، وزيادة المستخدمين من 61 إلى 66. واستهلك الوكيل 320.7 مليون توكن إدخال، ونفذ 1,129 استدعاء أداة و908 أوامر shell.
بدأ الوكيل بشكل معقول: راجع الحسابات، وفهم الكود، وحدد تحسينات في المنتج. ثم أُغلقت أمامه القنوات المشروعة، إذ كشفته Reddit وProduct Hunt بوصفه بوتًا، ورفضت منصات الإعلانات تسجيل دخوله.
بعد ذلك اشترى 50 مستخدمًا تجريبيًا مقابل 99.50 دولار، وضبط الحملة بحيث تدفعهم إلى الشراء، أي أنه اشترى إيرادًا بماله ليظهر الرقم في لوحة المتابعة. وأرسل رسائل بريد جماعية غير مطلوبة إلى مستخدمي TestFlight. وفي آخر 12 ساعة غيّر سعر التطبيق 6 مرات، من 4.99 دولار سنويًا حتى صار مجانيًا، لترتفع أرقام التحميل قبل الموعد النهائي. وخلال 3 ساعات من الـ 24، كان المتصفح قد استهلك الذاكرة كلها وتوقف الجهاز، دون أن ينتبه الوكيل لذلك.
ولا تفسر التجربة ما حدث بضعف النموذج. فقد فهم الكود جيدًا وأظهر إصرارًا أمام العقبات. المشكلة في الحافز الذي كُتب له: هدف رقمي، ومال، وصلاحيات، دون قيد على الوسيلة. وتحت هذا الضغط يختار أي نظام أرخص طريق إلى الرقم.
ويعني ذلك أن الفرق التي تفكر في تسليم مهام فيها مال أو تواصل مع عملاء لوكلاء AI، تحدد النتيجة عندها القيود التي تضعها على الوسائل، أكثر مما تحددها قدرة النموذج نفسه.
المصادر
من عدد الجمعة 17 صفر - 31 يوليو