النماذج وأسعار API لمطوري الوكلاء
يدفع الوكيل مقابل كل خطوة ينفذها، ويذهب معظم ما يدفعه إلى مدخلات سبق أن أرسلها. يجمع هذا الجدول الأسعار المعلنة وخصومات التخزين المؤقت وحدود السياق في مكان واحد، لتختار نموذجًا بناءً على تكلفة المهمة كاملة، لا السعر المعلن وحده.
كل النماذج في جدول واحد
| المزوّد | ||||||
|---|---|---|---|---|---|---|
| GPT-6 Astra | OpenAI | 10 US$* | 1 US$ | 50 US$ | 1.05M | 2026-09-08 |
| Claude Fable 5.1 | Anthropic | 10 US$ | 0.25 US$ | 50 US$ | 1M | 2026-09-01 |
| Claude Opus 5.5 | Anthropic | 4 US$ | 0.20 US$ | 20 US$ | 1M | 2026-09-22 |
| Kimi K3 | Moonshot AI (Kimi) | 3 US$ | 0.30 US$ | 15 US$ | 1.05M | 2026-07-16 |
| Command A+سعر جهة خارجية | Cohere | 2.50 US$ | — | 10 US$ | 128K | 2026-05-20 |
| GPT-6.1 Sol | OpenAI | 2 US$* | 0.10 US$ | 10 US$ | 1.05M | 2026-09-29 |
| Claude Sonnet 5.5 | Anthropic | 2 US$ | 0.20 US$ | 10 US$ | 1M | 2026-09-28 |
| Gemini 3.1 Pro Previewمعاينة | 2 US$* | 0.20 US$ | 12 US$ | 1.05M | 2026-02-19 | |
| Grok 4.7 | xAI | 2 US$* | 0.50 US$ | 6 US$ | 500K | 2026-09-21 |
| Qwen3.8-Max | Alibaba Cloud (Qwen) | 1.65 US$ | 0.21 US$ | 4.95 US$ | 1M | 2026-08-03 |
| Gemini 3.5 Flash | 1.50 US$ | 0.15 US$ | 9 US$ | 1.05M | 2026-05-19 | |
| Mistral Medium 3.5 | Mistral AI | 1.50 US$ | — | 7.50 US$ | 256K | 2026-04-28 |
| GLM-5.3 | Z.ai (Zhipu) | 1.40 US$ | 0.26 US$ | 4.40 US$ | 1M | 2026-08-14 |
| DeepSeek-V4-Pro-0813 | DeepSeek | 1.32 US$ | 0.044 US$ | 3.96 US$ | 1M | 2026-08-13 |
| Grok 4.3 | xAI | 1.25 US$* | 0.20 US$ | 2.50 US$ | 1M | — |
| Muse Spark 1.3 | Meta | 1.25 US$ | 0.15 US$ | 4.25 US$ | 1M | 2026-09-02 |
| Amazon Nova 2 Proمعاينةسعر جهة خارجية | Amazon | 1.25 US$ | — | 10 US$ | — | — |
| Claude Haiku 4.5 | Anthropic | 1 US$ | 0.10 US$ | 5 US$ | 200K | — |
| Grok Build 0.1 | xAI | 1 US$* | 0.20 US$ | 2 US$ | 256K | — |
| Gemini 3.8 Flash | 0.75 US$ | 0.075 US$ | 3.75 US$ | 1.05M | 2026-09-02 | |
| Gemini 3.5 Flash-Lite | 0.30 US$ | 0.030 US$ | 2.50 US$ | 1.05M | 2026-07-21 | |
| DeepSeek-V4.1-Flash | DeepSeek | 0.30 US$ | 0.006 US$ | 1.20 US$ | 1M | 2026-09-10 |
| Amazon Nova 2 Liteسعر جهة خارجية | Amazon | 0.30 US$ | — | 2.50 US$ | 1M | 2025-12-02 |
| Qwen3.7-Plus | Alibaba Cloud (Qwen) | 0.28 US$* | 0.056 US$ | 1.10 US$ | 1M | 2026-05-26 |
| Mistral Small 4 | Mistral AI | 0.15 US$ | — | 0.60 US$ | 256K | 2026-03-16 |
| GLM-5.3-Flash | Z.ai (Zhipu) | 0.15 US$ | 0.030 US$ | 0.50 US$ | 1M | — |
| GPT-6 Luna | OpenAI | 0.10 US$* | 0.010 US$ | 0.50 US$ | 1.05M | 2026-09-22 |
| Qwen3.7-Flash | Alibaba Cloud (Qwen) | 0.028 US$* | 0.006 US$ | 0.11 US$ | 1M | 2026-07-15 |
كيفية قراءة هذه الأسعار
سعر الإدخال المخزّن مؤقتًا هو الأهم
في حلقة الوكيل، يُعاد إرسال موجّه النظام وتعريفات الأدوات والأدوار السابقة مع كل استدعاء. يفرض مزودو الخدمة جزءًا من سعر الإدخال المعتاد عندما تُقدَّم هذه البادئة من الذاكرة المؤقتة، وغالبًا ما يكون السعر عُشر السعر المعتاد أو أقل. لذلك قد يتفوق نموذج ذو سعر منخفض للذاكرة المؤقتة على نموذج يبدو أرخص وفق سعره المعلن.
قد تؤدي الموجّهات الطويلة إلى رفع تكلفة الاستدعاء بالكامل
ترفع OpenAI وGoogle's Pro preview وxAI وQwen السعر عندما يتجاوز الموجّه الواحد حدًا معينًا، مثل 200K أو 272K token، وينطبق السعر الأعلى على كل token في ذلك الطلب. أما Anthropic فتحتسب حاليًا تكلفة نافذة المليون token كاملة بالسعر القياسي.
تُحتسب تكلفة token الاستدلال ضمن الإخراج
تفرض النماذج التي تفكر قبل الإجابة رسومًا على الاستدلال المخفي بسعر الإخراج. خفّض إعداد مستوى الجهد للخطوات الاعتيادية، واحتفظ بالإعدادات المرتفعة للتخطيط أو لتصحيح الأخطاء الصعبة.
نادرًا ما تناسب خصومات المعالجة الدفعية وخارج أوقات الذروة الوكلاء
تخفض نقاط نهاية المعالجة الدفعية السعر إلى النصف، لكنها تعيد النتائج خلال ساعات، ما يجعلها مناسبة للتقييمات وعمليات الاستكمال بأثر رجعي، لا للوكلاء المباشرين. ويُعد سعر DeepSeek خارج أوقات الذروة استثناءً قد يناسب المهام المجدولة.
أسئلة يطرحها المطورون
ما النموذج الأقل تكلفة لوكيل ذكاء اصطناعي؟
في عبء العمل البرمجي لدينا، المؤلف من 30 خطوة، أقل النماذج تكلفةً هي النماذج الصغيرة: GPT-6 Luna وQwen3.7-Flash وGLM-5.3-Flash، إذ تبلغ تكلفة المهمة الواحدة لكل منها نحو 10 إلى 20 سنتًا. لكن انخفاض تكلفة الخطوة الواحدة لا يعني انخفاض تكلفة المهمة كلها إذا احتاج النموذج إلى خطوات أكثر أو محاولات إضافية؛ لذا اختبر نموذجين أو ثلاثة على آثار التنفيذ لديك.
لماذا تتجاوز تكلفة وكيلي بكثير ما يوحي به سعر token؟
لأن كل خطوة تعيد إرسال المحادثة بعد أن تطول. فالمهمة المؤلفة من 30 خطوة، مع موجّه ابتدائي حجمه 25K token، ترسل إجمالًا أكثر بكثير من ثلاثة ملايين token من المدخلات. ويقلل التخزين المؤقت للموجّهات ومخرجات الأدوات الأقصر وتلخيص الأدوار القديمة هذه التكلفة أكثر مما يفعل تبديل النماذج.
هل هذه هي الأسعار النهائية؟
هذه هي الأسعار المعلنة بالدولار الأمريكي في صفحات الأسعار الخاصة بكل مزود بتاريخ 1 October 2026، قبل الضرائب والرسوم الإضافية الإقليمية والخصومات المتفاوض عليها. أما الأسعار المعلّمة بأنها من جهة خارجية، فلم يتسنَّ الاطلاع عليها في صفحة المورّد نفسه.
ما الفرق بين الإدخال المخزّن مؤقتًا وكتابة البيانات إلى الذاكرة المؤقتة؟
قراءة الذاكرة المؤقتة هي السعر المخفّض للـtoken الموجود فيها مسبقًا. ويفرض بعض مزودي الخدمة، ومنهم Anthropic، أيضًا تكلفة إضافية عند كتابة بادئة إلى الذاكرة المؤقتة للمرة الأولى. يعرض الجدول أسعار القراءة؛ أما أسعار الكتابة فتُذكر في صفحة كل نموذج عند انطباقها.