Ajan maliyet hesaplayıcı
Ajan bir döngüden oluşur: her çağrı, o ana kadarki her şeyi ve en son araç sonucunu yeniden gönderir. Bu döngüyü bir kez tanımlayın; fiyat tablomuzdaki her modelde tek bir görevin ve bir aylık görevlerin maliyetini görün.
| Model | Görev başına | 50 günlük kullanım üzerinden 30 gün |
|---|---|---|
| GPT-6 Luna | $0,099 | $148 |
| Qwen3.7-FlashUzun prompt tarifesiyle 28 çağrı | $0,101 | $152 |
| GLM-5.3-Flash | $0,182 | $273 |
| DeepSeek-V4.1-Flash | $0,218 | $327 |
| Gemini 3.5 Flash-Lite | $0,333 | $499 |
| Qwen3.7-Plus | $0,343 | $515 |
| Mistral Small 4 | $0,526 | $788 |
| Gemini 3.8 Flash | $0,742 | $1.112 |
| DeepSeek-V4-Pro-0813 | $0,961 | $1.441 |
| Claude Haiku 4.5 | $0,989 | $1.483 |
| Amazon Nova 2 Liteüçüncü taraf fiyatı | $1,10 | $1.647 |
| Grok Build 0.1 | $1,16 | $1.746 |
| Muse Spark 1.3 | $1,23 | $1.852 |
| Grok 4.3 | $1,31 | $1.970 |
| Gemini 3.5 Flash | $1,54 | $2.306 |
| Qwen3.8-Max | $1,63 | $2.443 |
| GLM-5.3 | $1,63 | $2.446 |
| GPT-6.1 Sol | $1,69 | $2.541 |
| Claude Sonnet 5.5 | $1,98 | $2.966 |
| Gemini 3.1 Pro Preview | $2,05 | $3.074 |
| Grok 4.7 | $2,68 | $4.026 |
| Kimi K3 | $2,97 | $4.449 |
| Claude Opus 5.5 | $3,39 | $5.082 |
| Amazon Nova 2 Proüçüncü taraf fiyatı | $4,56 | $6.840 |
| Mistral Medium 3.5 | $5,31 | $7.965 |
| Claude Fable 5.1 | $7,76 | $11.642 |
| Command A+bağlam penceresini aşıyorüçüncü taraf fiyatı | $8,76 | $13.140 |
| GPT-6 Astra | $9,89 | $14.831 |
Tahmin nasıl hesaplanıyor?
Döngüdeki her çağrı için prompt boyutunu, yani ilk promptu ve önceki her adımdan gelen büyümeyi hesaplayıp önbelleğe alınan ve yeni içerik olarak ikiye ayırıyoruz. İlk çağrı her zaman yenidir. Yeni tokenlar giriş tarifesinden, önbellekteki tokenlar önbellek tarifesinden, çıkış tokenları ise çıkış tarifesinden ücretlendirilir.
Tek bir prompt sağlayıcının uzun bağlam eşiğini aşarsa, OpenAI, Google, xAI ve Qwen'de olduğu gibi çağrının tamamı uzun prompt tarifesinden ücretlendirilir. En büyük prompt modelin bağlam penceresinden büyükse satır işaretlenir; çünkü gerçek bir agent önce geçmişini kısaltmak veya özetlemek zorunda kalır.
Gerçek agent'larda görevler farklılık gösterir; başarısız adımlar yeniden denenebilir ve işlemler bazen erken sonlandırılır. Bu rakamları aynı iş yükünde modelleri karşılaştırmak için kullanın. Bütçe belirlemeden önce kendi iz kayıtlarınızdaki gerçek token sayılarını ölçün.
Agent maliyetleri hakkında sorular
Bir AI agent görev başına kaç token kullanır?
Bu, çoğunlukla adım sayısına ve her adımda ne kadar içerik eklendiğine bağlıdır. Kısa bir destek görüşmesi 30K giriş tokenı kullanabilir. Başlangıç promptu 25K token olan 30 adımlı bir kodlama görevi ise her çağrıda geçmişin tamamı yeniden gönderildiğinden üç milyondan fazla token kullanır.
Bir agent'ın maliyetini nasıl düşürebilirim?
Önbelleğe alınabilmesi için çağrılar arasında promptun başlangıç kısmını aynı tutun. Araç sonuçlarını modelin ihtiyaç duyduğu içerikle sınırlayın, eski mesajları özetleyin veya kaldırın, rutin adımlarda küçük bir model kullanıp büyük modeli yalnızca planlama için tercih edin ve kaliteyi düşürmeden mümkün olduğunda akıl yürütme düzeyini azaltın.
Prompt önbelleğe alma otomatik olarak gerçekleşir mi?
OpenAI, DeepSeek, Kimi ve Gemini'nin örtük önbelleğe alması, promptların uzun bir öneki paylaşması durumunda otomatik gerçekleşir. Anthropic ve bazı Qwen endpoint'lerinde açık önbellek işaretçileri gerekir; Anthropic ilk yazma için ek ücret alır.
Token başına en ucuz model neden görev başına en ucuz model olmuyor?
Önbellek indirimleri modellere göre değişir, bazı sağlayıcılar uzun promptları daha yüksek tarifeden ücretlendirir ve akıl yürütme modelleri düşünürken çıkış tokenları kullanır. Daha az adım veya yeniden deneme gerektiren bir model de daha ucuza gelebilir; bu hesaplayıcı bunu hesaba katamaz.