برمجياتقراءة دقيقتين

Anthropic تسرّع claude.ai نحو 3 مرات في أسبوعين بتحديد أرقام مستهدفة لكل رحلة مستخدم

المغزى

عبارة "اجعله أسرع" رأي لا يمكن التحقق منه، أما رقم مستهدف عند الـ p75 فشرط يتحقق أو لا، وهو ما يسمح لـ agent بالعمل على ما يهم فعلًا.

نشرت Anthropic في 23 سبتمبر 2026 تدوينة هندسية تشرح عمل الأداء الذي نفذته على claude.ai خلال أغسطس 2026. واستغرق العمل أسبوعين، وجاءت كل الأرقام عند الـ 75th percentile، أي الزمن الذي تقل عنه 75% من الحالات.

وجاءت النتائج كالتالي:

  • فتح الموقع من جديد: من 3,085 ميلي ثانية إلى 550، أي أسرع 5.6 مرة.
  • فتح محادثة: أسرع 2.4 مرة.
  • إرسال رسالة في تطبيق Cowork على سطح المكتب: من 928 ميلي ثانية إلى 48، أي أسرع 19 مرة.
  • المتوسط الهندسي عبر 13 قياسًا: أسرع 3.1 مرة.

ومن أبرز ما كشفه العمل أن الموقع كان يُجري نحو 500,000 عملية إعادة تحميل مخفية يوميًا، ناتجة عن استدعاءات زائدة لـ location.reload، دون أن ينتبه إليها أحد.

لكن الطريقة هي جوهر التدوينة. فالفريق لم يطلب من النموذج “اجعل الموقع أسرع”. بل حدد 4 رحلات مستخدم، ووضع لكل منها رقمًا مستهدفًا عند الـ p75، ثم ترك الـ agent يعمل على بلوغ ذلك الرقم. ووصفه أحد أعضاء الفريق بأنه “numbers demon”.

والفرق بين الأسلوبين جوهري. فعبارة “اجعله أسرع” رأي، بينما “خفّض 3,085 إلى 800” شرط إما أن يتحقق أو لا. ومن دون رقم محدد، قد يقضي الـ agent وقته في تحسين أجزاء لا تؤثر في تجربة المستخدم، بينما يبدو العمل مقنعًا.

ولفرق المنتجات، يعني ذلك أن كتابة رقم مستهدف لكل رحلة مستخدم قد تكون الخطوة الأرخص والأكثر أثرًا قبل تسليم عمل الأداء لأي أداة.

المصادر

  1. التدوينة الهندسية كاملة على مدونة Claude

من عدد الخميس 13 ربيع الآخر - 24 سبتمبر

أخبار ذات صلة

ذكاء اصطناعي

Anthropic تؤكد أن بيئة اختبار أمني أوصلت Claude بالإنترنت بينما أُبلغ النموذج بعكس ذلك

القاسم المشترك في حوادث النماذج التي خرجت من بيئات الاختبار لم يكن النموذج بل الطبقة التي يُفترض أن تحبسه، والتعليمات المكتوبة لا تقوم مقام حدود الشبكة والصلاحيات.

5 ربيع الآخر - 16 سبتمبر

أخبار الخميس 13 ربيع الآخر - 24 سبتمبر