حاسبة تكلفة الوكيل
يعمل الوكيل في حلقة: يعيد كل استدعاء إرسال كل ما سبق، بالإضافة إلى أحدث نتيجة للأداة. صِف هذه الحلقة مرة واحدة، واعرف تكلفة المهمة وتكلفة مهام شهر كامل على كل نموذج في جدول الأسعار لدينا.
| النموذج | لكل مهمة | 30 يومًا بمعدل 50 يوميًا |
|---|---|---|
| GPT-6 Luna | 0.099 US$ | 148 US$ |
| Qwen3.7-Flash28 استدعاءات بسعر المطالبات الطويلة | 0.101 US$ | 152 US$ |
| GLM-5.3-Flash | 0.182 US$ | 273 US$ |
| DeepSeek-V4.1-Flash | 0.218 US$ | 327 US$ |
| Gemini 3.5 Flash-Lite | 0.333 US$ | 499 US$ |
| Qwen3.7-Plus | 0.343 US$ | 515 US$ |
| Mistral Small 4 | 0.526 US$ | 788 US$ |
| Gemini 3.8 Flash | 0.742 US$ | 1,112 US$ |
| DeepSeek-V4-Pro-0813 | 0.961 US$ | 1,441 US$ |
| Claude Haiku 4.5 | 0.989 US$ | 1,483 US$ |
| Amazon Nova 2 Liteسعر جهة خارجية | 1.10 US$ | 1,647 US$ |
| Grok Build 0.1 | 1.16 US$ | 1,746 US$ |
| Muse Spark 1.3 | 1.23 US$ | 1,852 US$ |
| Grok 4.3 | 1.31 US$ | 1,970 US$ |
| Gemini 3.5 Flash | 1.54 US$ | 2,306 US$ |
| Qwen3.8-Max | 1.63 US$ | 2,443 US$ |
| GLM-5.3 | 1.63 US$ | 2,446 US$ |
| GPT-6.1 Sol | 1.69 US$ | 2,541 US$ |
| Claude Sonnet 5.5 | 1.98 US$ | 2,966 US$ |
| Gemini 3.1 Pro Preview | 2.05 US$ | 3,074 US$ |
| Grok 4.7 | 2.68 US$ | 4,026 US$ |
| Kimi K3 | 2.97 US$ | 4,449 US$ |
| Claude Opus 5.5 | 3.39 US$ | 5,082 US$ |
| Amazon Nova 2 Proسعر جهة خارجية | 4.56 US$ | 6,840 US$ |
| Mistral Medium 3.5 | 5.31 US$ | 7,965 US$ |
| Claude Fable 5.1 | 7.76 US$ | 11,642 US$ |
| Command A+يتجاوز نافذة السياقسعر جهة خارجية | 8.76 US$ | 13,140 US$ |
| GPT-6 Astra | 9.89 US$ | 14,831 US$ |
آلية التقدير
لكل استدعاء في الحلقة، نحتسب حجم المطالبة: المطالبة الأولى مضافًا إليها الزيادة الناتجة عن كل خطوة سابقة، ثم نقسمها إلى جزء مخزّن مؤقتًا وجزء جديد. يكون الاستدعاء الأول جديدًا دائمًا. تُحتسب الرموز الجديدة بسعر الإدخال، والرموز المخزّنة مؤقتًا بسعر التخزين المؤقت، أما الإخراج فيُحتسب بسعر الإخراج.
إذا تجاوزت مطالبة منفردة الحدّ المعيّن للسياق الطويل لدى مزود الخدمة، تُحتسب تلك المكالمة بالكامل بسعر المطالبات الطويلة، كما تفعل OpenAI وGoogle وxAI وQwen. وإذا تجاوزت أكبر مطالبة نافذة سياق النموذج، نضع علامة على الصف، لأن على الوكيل الفعلي اختصار سجل المحادثة أو تلخيصه أولًا.
تختلف المهام التي تنفذها الوكلاء الفعلية، وقد تعيد تنفيذ الخطوات الفاشلة، وتتوقف أحيانًا مبكرًا. استخدم هذه الأرقام لمقارنة النماذج على عبء العمل نفسه، ثم قِس أعداد الرموز الفعلية من سجلات التنفيذ لديك قبل إعداد الميزانية.
أسئلة عن تكاليف الوكلاء
كم رمزًا يستخدم وكيل الذكاء الاصطناعي في كل مهمة؟
يعتمد ذلك أساسًا على عدد الخطوات ومقدار ما تضيفه كل خطوة. قد يستهلك حوار دعم قصير 30K من رموز الإدخال؛ أما مهمة برمجية من 30 خطوة تبدأ بمطالبة من 25K رمزًا، فترسل أكثر من ثلاثة ملايين رمز، لأن السجل كاملًا يُرسل مجددًا مع كل استدعاء.
كيف أخفض تكلفة الوكيل؟
أبقِ بداية المطالبة متطابقة بين الاستدعاءات كي تُخزّن مؤقتًا، واختصر نتائج الأدوات لتقتصر على ما يحتاج إليه النموذج، ولخّص الأدوار القديمة أو احذفها، واستخدم نموذجًا صغيرًا للخطوات الاعتيادية وآخر كبيرًا للتخطيط فقط، وخفّض مستوى جهد الاستدلال متى سمحت الجودة بذلك.
هل يحدث التخزين المؤقت للمطالبات تلقائيًا؟
يحدث ذلك مع OpenAI وDeepSeek وKimi ومع التخزين المؤقت الضمني في Gemini، عندما تشترك المطالبات في بادئة طويلة. تتطلب نقاط نهاية Anthropic وبعض نقاط نهاية Qwen علامات تخزين مؤقت صريحة، كما تفرض Anthropic رسومًا إضافية على الكتابة الأولى.
لماذا لا يكون النموذج الأقل سعرًا لكل رمز هو الأقل تكلفة لكل مهمة؟
تختلف خصومات التخزين المؤقت بين النماذج، ويحتسب بعض مزودي الخدمة المطالبات الطويلة بسعر أعلى، كما تستهلك نماذج الاستدلال رموز إخراج أثناء التفكير. وقد تكون الكلفة الإجمالية أقل أيضًا مع نموذج يحتاج إلى خطوات أو محاولات إعادة أقل، وهو ما لا تستطيع هذه الحاسبة رصده.