لا يستدعي وكيل الذكاء الاصطناعي النموذج مرة واحدة لكل مهمة. فهو يخطط ويستدعي أداة ويقرأ النتيجة ثم يستدعي النموذج من جديد، وكثيرًا ما يكرر ذلك مرات عدة. وكل استدعاء يعيد إرسال كل ما جُمع حتى الآن، فتنمو تكلفة المهمة أسرع بكثير من عدد خطواتها. تحاكي هذه الحاسبة تلك الحلقة لتسعّر ميزة الوكيل قبل وصول الزيارات الفعلية.
روجعت الأرقام في بواسطة Muhammad Ahmad بالاستناد إلى وثائق منصة Claude: الأسعار، أسعار واجهة OpenAI API و أسعار واجهة Gemini API. الأسعار والقواعد تتغير، فتأكد من المصدر الرسمي قبل الاعتماد عليها. كيف نتحقق من الحسابات
كيف تعمل
تُرسل كل خطوة الموجّه الثابت (تعليمات النظام وتعريفات الأدوات) إضافةً إلى السياق الذي بنته الخطوات السابقة: مخرجات كل خطوة سابقة ونتائج الأدوات التي أنتجتها.
لعدد n من الخطوات، إجمالي الإدخال = n × الموجّه + (المخرجات + نتائج الأدوات) × n(n − 1) ÷ 2. والحد الثاني هو السياق المتراكم، وينمو مع مربع عدد الخطوات. وإجمالي الإخراج = n × المخرجات في كل خطوة.
تكلفة التشغيل = رموز الإدخال ÷ 1,000,000 × سعر الإدخال للنموذج + رموز الإخراج ÷ 1,000,000 × سعر الإخراج. وتضاعفها إعادة المحاولات: فمعدل إعادة 10% يجعل متوسط تكلفة المهمة 1.1 تشغيل.
تأتي الأسعار من مجموعة البيانات الموثّقة نفسها المستخدمة في حاسبة تكلفة واجهة AI API. وتستخدم الحاسبة الأسعار القياسية، لذا فإن التخزين المؤقت للموجّه، الذي يطبقه كثير من المزوّدين على الموجّه المتكرر، سيخفض الفاتورة الفعلية.
مثال محلول
وكيل من 8 خطوات بموجّه من 3,000 رمز و400 رمز مخرجات و800 رمز من نتائج الأدوات في كل خطوة يرسل 57,600 رمز إدخال و3,200 رمز إخراج في كل تشغيل. والخطوة الأخيرة وحدها تحمل 11,400 رمز إدخال. وعلى Claude Sonnet 5 (2 دولار للإدخال و10 دولارات للإخراج لكل مليون) يكون ذلك 0.1472 دولار للتشغيل، أو 0.1619 دولار للمهمة مع إعادة محاولات بنسبة 10%: أي 161.92 دولارًا شهريًا لألف مهمة. وأكثر من نصف الإدخال، وهو 58.3%، سياق متراكم لا الموجّه الثابت.
أمثلة إضافية
مضاعفة الوكيل من 8 إلى 16 خطوة ترفع تكلفة المهمة من 0.16 دولار إلى 0.49 دولار، أي نحو ثلاثة أضعاف، لأن كل خطوة تعيد إرسال السياق المتنامي.
على GPT-6 Sol تكلف المهمة الافتراضية المبلغ نفسه كما على Claude Sonnet 5، أي 0.16 دولار، لأن سعر كليهما 2 دولار / 10 دولارات لكل مليون رمز.
أخطاء شائعة
- تقدير التكلفة لكل خطوة بدل كل مهمة مكتملة.
- نسيان إعادة المحاولات والتشغيلات الفاشلة.
- ترك السياق ينمو دون اقتطاع أو تلخيص.
- استخدام النموذج الأغلى في كل خطوة بدل توجيه الخطوات البسيطة إلى نماذج أرخص.
أسئلة يطرحها الناس
لماذا تكلف وكلاء الذكاء الاصطناعي أكثر من روبوتات المحادثة؟
يجري الوكلاء استدعاءات كثيرة للنموذج في كل مهمة ويعيدون إليه نتائج الأدوات، فيحمل كل استدعاء سياقًا أكبر من سابقه. ويمكن لمهمة من 8 خطوات أن تستهلك بسهولة عشرة أضعاف رموز رد محادثة واحد.
كيف أخفض تكلفة وكيل الذكاء الاصطناعي؟
خزّن مؤقتًا الموجّه الثابت وتعريفات الأدوات، واقتطع نتائج الأدوات أو لخّصها قبل إعادتها، وضع حدًا أقصى لعدد الخطوات، ووجّه الخطوات البسيطة إلى نموذج أرخص.
هل تُحتسب رموز التفكير أو الاستدلال؟
أدخلها ضمن المخرجات في كل خطوة. فالمزوّدون يحتسبون رموز الاستدلال كمخرجات، وفي المهام الطويلة قد تكون أكبر جزء من فاتورة المخرجات.
هل يغيّر التخزين المؤقت للموجّه النتيجة؟
نعم. يحتسب معظم المزوّدين الإدخال المخزَّن مؤقتًا بجزء من السعر القياسي، والوكلاء يكررون الموجّه نفسه في كل خطوة. اعتبر هذه النتيجة تقديرًا أعلى إن كنت تستخدم التخزين المؤقت.
هل يمكن أن يكون النموذج الأغلى أرخص للوكلاء؟
أحيانًا. فقد يكلف نموذج أقوى ينهي المهمة بخطوات أقل، أو يخفق أقل، تكلفة أقل لكل مهمة من نموذج رخيص يدور في حلقات. قارن التكلفة لكل مهمة مكتملة، لا السعر لكل رمز.