السؤال الآن هو: كيف أخطأنا بهذا الشكل؟ الطريقة القديمة كانت تقوم على تشغيل مهمة مراجعة باستخدام عدة وكلاء ثم مقارنتها بوكيل واحد، ونُسب الفرق إلى التكلفة الأساسية لكل وكيل. المشكلة كانت أن الوكيل الذي يعمل ينفذ العديد من الطلبات، وكل طلب من هذه الطلبات يعيد إرسال السياق الكامل الخاص به. نظام حساب الرموز الذي يجمع إجمالي الرموز المدخلة كان يحسب الـ 54 ألف رمز سياق هذه في كل مرة يتم إرسالها كطلب جديد. لذا، إذا قام وكيل بتكرار عملية 8 مرات، كان يبدو وكأنه يكلف 8 × 54 ألف رمز، أي حوالي 430 ألف رمز. على الرغم من أن سبع مرات من هذه الثمانية كانت في الواقع مجرد قراءات من ذاكرة التخزين المؤقت، ويتم محاسبتها بسعر أقل بكثير (عُشر السعر). السياق نفسه تم تخزينه مرة واحدة فقط. إذن، الـ 436 ألف رمز لم تكن تكلفة التشغيل الأساسية. بل كانت تكلفة التشغيل مضروبة في عدد المرات التي 'فكر' فيها الوكيل في مهمتنا، بسعرها الظاهري.
الطريقة الجديدة والأكثر دقة لقياس التكلفة كانت مباشرة للغاية: قمنا بتشغيل وكيل فرعي لا يفعل شيئًا سوى إعادة حرفين 'ok'. ثم قرأنا ملف سجل الوكيل. وجدنا أن الوكيل قام بطلب واحد فقط، وأن الرموز المستخدمة كانت 2 للإدخال، 54154 لتخزين السياق الأولي، و 4 للإخراج. هذه الـ 54,154 رمزًا هي ما يتم تجهيز نافذة سياق الوكيل بها في البداية – أوامر النظام، مخططات الأدوات، سلسلة CLAUDE.md، وقائمة المهارات – وتُكتب مرة واحدة في ذاكرة التخزين المؤقت للموجه. لا توجد دفعة ثانية مخفية. هذا يعني أن تكلفة استخدام وكلاء الذكاء الاصطناعي من Claude Code قد تكون أقل بكثير مما كنا نعتقد سابقًا. يمكن أن يفتح هذا الباب لإمكانيات جديدة ويجعل هذه التقنية أكثر سهولة وفعالية من حيث التكلفة لمشاريعكم.