dotsagent.io
اللغة:العربية
البناء · تم التحقق من الأسعار في 1 October 2026

النماذج وأسعار API لمطوري الوكلاء

يدفع الوكيل مقابل كل خطوة ينفذها، ويذهب معظم ما يدفعه إلى مدخلات سبق أن أرسلها. يجمع هذا الجدول الأسعار المعلنة وخصومات التخزين المؤقت وحدود السياق في مكان واحد، لتختار نموذجًا بناءً على تكلفة المهمة كاملة، لا السعر المعلن وحده.

كل النماذج في جدول واحد

أسعار API القياسية للنماذج المستخدمة في بناء الوكلاء
المزوّد
GPT-6 Astra
gpt-6-astra
OpenAI⁨‏10 US$⁩*⁨‏1 US$⁩⁨‏50 US$⁩1.05M2026-09-08
Claude Fable 5.1
claude-fable-5-1
Anthropic⁨‏10 US$⁩⁨‏0.25 US$⁩⁨‏50 US$⁩1M2026-09-01
Claude Opus 5.5
claude-opus-5-5
Anthropic⁨‏4 US$⁩⁨‏0.20 US$⁩⁨‏20 US$⁩1M2026-09-22
Kimi K3
kimi-k3
Moonshot AI (Kimi)⁨‏3 US$⁩⁨‏0.30 US$⁩⁨‏15 US$⁩1.05M2026-07-16
Command A+سعر جهة خارجية
command-a-plus-05-2026
Cohere⁨‏2.50 US$⁩—⁨‏10 US$⁩128K2026-05-20
GPT-6.1 Sol
gpt-6.1-sol
OpenAI⁨‏2 US$⁩*⁨‏0.10 US$⁩⁨‏10 US$⁩1.05M2026-09-29
Claude Sonnet 5.5
claude-sonnet-5-5
Anthropic⁨‏2 US$⁩⁨‏0.20 US$⁩⁨‏10 US$⁩1M2026-09-28
Gemini 3.1 Pro Previewمعاينة
gemini-3.1-pro-preview
Google⁨‏2 US$⁩*⁨‏0.20 US$⁩⁨‏12 US$⁩1.05M2026-02-19
Grok 4.7
grok-4.7
xAI⁨‏2 US$⁩*⁨‏0.50 US$⁩⁨‏6 US$⁩500K2026-09-21
Qwen3.8-Max
qwen3.8-max
Alibaba Cloud (Qwen)⁨‏1.65 US$⁩⁨‏0.21 US$⁩⁨‏4.95 US$⁩1M2026-08-03
Gemini 3.5 Flash
gemini-3.5-flash
Google⁨‏1.50 US$⁩⁨‏0.15 US$⁩⁨‏9 US$⁩1.05M2026-05-19
Mistral Medium 3.5
mistral-medium-3-5
Mistral AI⁨‏1.50 US$⁩—⁨‏7.50 US$⁩256K2026-04-28
GLM-5.3
glm-5.3
Z.ai (Zhipu)⁨‏1.40 US$⁩⁨‏0.26 US$⁩⁨‏4.40 US$⁩1M2026-08-14
DeepSeek-V4-Pro-0813
deepseek-v4-pro
DeepSeek⁨‏1.32 US$⁩⁨‏0.044 US$⁩⁨‏3.96 US$⁩1M2026-08-13
Grok 4.3
grok-4.3
xAI⁨‏1.25 US$⁩*⁨‏0.20 US$⁩⁨‏2.50 US$⁩1M—
Muse Spark 1.3
muse-spark-1.3
Meta⁨‏1.25 US$⁩⁨‏0.15 US$⁩⁨‏4.25 US$⁩1M2026-09-02
Amazon Nova 2 Proمعاينةسعر جهة خارجيةAmazon⁨‏1.25 US$⁩—⁨‏10 US$⁩——
Claude Haiku 4.5
claude-haiku-4-5-20251001
Anthropic⁨‏1 US$⁩⁨‏0.10 US$⁩⁨‏5 US$⁩200K—
Grok Build 0.1
grok-build-0.1
xAI⁨‏1 US$⁩*⁨‏0.20 US$⁩⁨‏2 US$⁩256K—
Gemini 3.8 Flash
gemini-3.8-flash
Google⁨‏0.75 US$⁩⁨‏0.075 US$⁩⁨‏3.75 US$⁩1.05M2026-09-02
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Google⁨‏0.30 US$⁩⁨‏0.030 US$⁩⁨‏2.50 US$⁩1.05M2026-07-21
DeepSeek-V4.1-Flash
deepseek-flash
DeepSeek⁨‏0.30 US$⁩⁨‏0.006 US$⁩⁨‏1.20 US$⁩1M2026-09-10
Amazon Nova 2 Liteسعر جهة خارجيةAmazon⁨‏0.30 US$⁩—⁨‏2.50 US$⁩1M2025-12-02
Qwen3.7-Plus
qwen3.7-plus
Alibaba Cloud (Qwen)⁨‏0.28 US$⁩*⁨‏0.056 US$⁩⁨‏1.10 US$⁩1M2026-05-26
Mistral Small 4
mistral-small-2603
Mistral AI⁨‏0.15 US$⁩—⁨‏0.60 US$⁩256K2026-03-16
GLM-5.3-Flash
glm-5.3-flash
Z.ai (Zhipu)⁨‏0.15 US$⁩⁨‏0.030 US$⁩⁨‏0.50 US$⁩1M—
GPT-6 Luna
gpt-6-luna
OpenAI⁨‏0.10 US$⁩*⁨‏0.010 US$⁩⁨‏0.50 US$⁩1.05M2026-09-22
Qwen3.7-Flash
qwen3.7-flash
Alibaba Cloud (Qwen)⁨‏0.028 US$⁩*⁨‏0.006 US$⁩⁨‏0.11 US$⁩1M2026-07-15

بالدولار الأمريكي لكل مليون رمز، للفئة القياسية وسعر المطالبات القصيرة · * تكلفة المطالبات الطويلة أعلى

احسب تكلفة عبء العمل لديك

كيفية قراءة هذه الأسعار

سعر الإدخال المخزّن مؤقتًا هو الأهم

في حلقة الوكيل، يُعاد إرسال موجّه النظام وتعريفات الأدوات والأدوار السابقة مع كل استدعاء. يفرض مزودو الخدمة جزءًا من سعر الإدخال المعتاد عندما تُقدَّم هذه البادئة من الذاكرة المؤقتة، وغالبًا ما يكون السعر عُشر السعر المعتاد أو أقل. لذلك قد يتفوق نموذج ذو سعر منخفض للذاكرة المؤقتة على نموذج يبدو أرخص وفق سعره المعلن.

قد تؤدي الموجّهات الطويلة إلى رفع تكلفة الاستدعاء بالكامل

ترفع OpenAI وGoogle's Pro preview وxAI وQwen السعر عندما يتجاوز الموجّه الواحد حدًا معينًا، مثل 200K أو 272K token، وينطبق السعر الأعلى على كل token في ذلك الطلب. أما Anthropic فتحتسب حاليًا تكلفة نافذة المليون token كاملة بالسعر القياسي.

تُحتسب تكلفة token الاستدلال ضمن الإخراج

تفرض النماذج التي تفكر قبل الإجابة رسومًا على الاستدلال المخفي بسعر الإخراج. خفّض إعداد مستوى الجهد للخطوات الاعتيادية، واحتفظ بالإعدادات المرتفعة للتخطيط أو لتصحيح الأخطاء الصعبة.

نادرًا ما تناسب خصومات المعالجة الدفعية وخارج أوقات الذروة الوكلاء

تخفض نقاط نهاية المعالجة الدفعية السعر إلى النصف، لكنها تعيد النتائج خلال ساعات، ما يجعلها مناسبة للتقييمات وعمليات الاستكمال بأثر رجعي، لا للوكلاء المباشرين. ويُعد سعر DeepSeek خارج أوقات الذروة استثناءً قد يناسب المهام المجدولة.

أسئلة يطرحها المطورون

ما النموذج الأقل تكلفة لوكيل ذكاء اصطناعي؟

في عبء العمل البرمجي لدينا، المؤلف من 30 خطوة، أقل النماذج تكلفةً هي النماذج الصغيرة: GPT-6 Luna وQwen3.7-Flash وGLM-5.3-Flash، إذ تبلغ تكلفة المهمة الواحدة لكل منها نحو 10 إلى 20 سنتًا. لكن انخفاض تكلفة الخطوة الواحدة لا يعني انخفاض تكلفة المهمة كلها إذا احتاج النموذج إلى خطوات أكثر أو محاولات إضافية؛ لذا اختبر نموذجين أو ثلاثة على آثار التنفيذ لديك.

لماذا تتجاوز تكلفة وكيلي بكثير ما يوحي به سعر token؟

لأن كل خطوة تعيد إرسال المحادثة بعد أن تطول. فالمهمة المؤلفة من 30 خطوة، مع موجّه ابتدائي حجمه 25K token، ترسل إجمالًا أكثر بكثير من ثلاثة ملايين token من المدخلات. ويقلل التخزين المؤقت للموجّهات ومخرجات الأدوات الأقصر وتلخيص الأدوار القديمة هذه التكلفة أكثر مما يفعل تبديل النماذج.

هل هذه هي الأسعار النهائية؟

هذه هي الأسعار المعلنة بالدولار الأمريكي في صفحات الأسعار الخاصة بكل مزود بتاريخ 1 October 2026، قبل الضرائب والرسوم الإضافية الإقليمية والخصومات المتفاوض عليها. أما الأسعار المعلّمة بأنها من جهة خارجية، فلم يتسنَّ الاطلاع عليها في صفحة المورّد نفسه.

ما الفرق بين الإدخال المخزّن مؤقتًا وكتابة البيانات إلى الذاكرة المؤقتة؟

قراءة الذاكرة المؤقتة هي السعر المخفّض للـtoken الموجود فيها مسبقًا. ويفرض بعض مزودي الخدمة، ومنهم Anthropic، أيضًا تكلفة إضافية عند كتابة بادئة إلى الذاكرة المؤقتة للمرة الأولى. يعرض الجدول أسعار القراءة؛ أما أسعار الكتابة فتُذكر في صفحة كل نموذج عند انطباقها.