dotsagent.io
Język:Polski
Build · narzędzie

Kalkulator kosztów agenta

Agent działa w pętli: każde wywołanie ponownie wysyła cały dotychczasowy kontekst wraz z najnowszym wynikiem narzędzia. Opisz tę pętlę raz i sprawdź, ile kosztuje zadanie oraz miesiąc pracy przy użyciu każdego modelu z naszej tabeli cen.

Zacznij od obciążenia

Czyta pliki, edytuje kod i uruchamia testy w repozytorium. Duży prompt systemowy ze schematami narzędzi, a każdy krok dodaje plik lub log z testów.

Jedno zadanie wysyła 3 360 000 tokenów wejściowych i otrzymuje 36 000 tokenów wyjściowych. Największy pojedynczy prompt ma 199 000 tokenów.

Szacowany koszt zadania i miesiąca dla każdego modelu
ModelNa zadanie30 dni po 50 dziennie
GPT-6 Luna · OpenAI⁨0,099 USD⁩⁨148 USD⁩
Qwen3.7-Flash · Alibaba Cloud (Qwen)28 wywołań według stawki za długi prompt⁨0,101 USD⁩⁨152 USD⁩
GLM-5.3-Flash · Z.ai (Zhipu)⁨0,182 USD⁩⁨273 USD⁩
DeepSeek-V4.1-Flash · DeepSeek⁨0,218 USD⁩⁨327 USD⁩
Gemini 3.5 Flash-Lite · Google⁨0,333 USD⁩⁨499 USD⁩
Qwen3.7-Plus · Alibaba Cloud (Qwen)⁨0,343 USD⁩⁨515 USD⁩
Mistral Small 4 · Mistral AI⁨0,526 USD⁩⁨788 USD⁩
Gemini 3.8 Flash · Google⁨0,742 USD⁩⁨1112 USD⁩
DeepSeek-V4-Pro-0813 · DeepSeek⁨0,961 USD⁩⁨1441 USD⁩
Claude Haiku 4.5 · Anthropic⁨0,989 USD⁩⁨1483 USD⁩
Amazon Nova 2 Lite · Amazoncena zewnętrznego dostawcy⁨1,10 USD⁩⁨1647 USD⁩
Grok Build 0.1 · xAI⁨1,16 USD⁩⁨1746 USD⁩
Muse Spark 1.3 · Meta⁨1,23 USD⁩⁨1852 USD⁩
Grok 4.3 · xAI⁨1,31 USD⁩⁨1970 USD⁩
Gemini 3.5 Flash · Google⁨1,54 USD⁩⁨2306 USD⁩
Qwen3.8-Max · Alibaba Cloud (Qwen)⁨1,63 USD⁩⁨2443 USD⁩
GLM-5.3 · Z.ai (Zhipu)⁨1,63 USD⁩⁨2446 USD⁩
GPT-6.1 Sol · OpenAI⁨1,69 USD⁩⁨2541 USD⁩
Claude Sonnet 5.5 · Anthropic⁨1,98 USD⁩⁨2966 USD⁩
Gemini 3.1 Pro Preview · Google⁨2,05 USD⁩⁨3074 USD⁩
Grok 4.7 · xAI⁨2,68 USD⁩⁨4026 USD⁩
Kimi K3 · Moonshot AI (Kimi)⁨2,97 USD⁩⁨4449 USD⁩
Claude Opus 5.5 · Anthropic⁨3,39 USD⁩⁨5082 USD⁩
Amazon Nova 2 Pro · Amazoncena zewnętrznego dostawcy⁨4,56 USD⁩⁨6840 USD⁩
Mistral Medium 3.5 · Mistral AI⁨5,31 USD⁩⁨7965 USD⁩
Claude Fable 5.1 · Anthropic⁨7,76 USD⁩⁨11 642 USD⁩
Command A+ · Cohereprzekracza okno kontekstucena zewnętrznego dostawcy⁨8,76 USD⁩⁨13 140 USD⁩
GPT-6 Astra · OpenAI⁨9,89 USD⁩⁨14 831 USD⁩

Ceny katalogowe, standardowy poziom, dolary amerykańskie. Nie uwzględniono zapisu do cache, podatków, opłat za narzędzia, takich jak wyszukiwanie w sieci, ani dopłat regionalnych.

Jak działa szacowanie

Dla każdego wywołania w pętli bierzemy rozmiar promptu — pierwszy prompt powiększony o przyrost z każdego wcześniejszego kroku — i dzielimy go na część z cache oraz nową część. Pierwsze wywołanie zawsze obejmuje wyłącznie nowe tokeny. Nowe tokeny są rozliczane według stawki za dane wejściowe, tokeny z cache według stawki za cache, a tokeny wyjściowe według stawki za dane wyjściowe.

Jeśli pojedynczy prompt przekracza próg długiego kontekstu dostawcy, całe wywołanie jest rozliczane według stawki za długi prompt — tak robią OpenAI, Google, xAI i Qwen. Jeśli największy prompt przekracza okno kontekstu modelu, wiersz zostaje oznaczony, ponieważ rzeczywisty agent musiałby najpierw skrócić historię lub ją podsumować.

Rzeczywiste agenty różnią się w zależności od zadania, ponawiają nieudane kroki, a czasem kończą działanie wcześniej. Traktuj te wartości jako sposób na porównanie modeli przy takim samym obciążeniu, a przed zaplanowaniem budżetu zmierz rzeczywistą liczbę tokenów we własnych śladach.

Pytania o koszty agentów

Ile tokenów zużywa agent AI na zadanie?

Zależy to głównie od liczby kroków i tego, jak dużo dodaje każdy z nich. Krótka rozmowa z pomocą techniczną może zużyć 30K tokenów wejściowych; 30-etapowe zadanie programistyczne z promptem początkowym o rozmiarze 25K tokenów wysyła ich ponad trzy miliony, ponieważ przy każdym wywołaniu ponownie przesyłana jest cała historia.

Jak obniżyć koszt działania agenta?

Zachowaj identyczny początek promptu między wywołaniami, aby można było użyć cache, ograniczaj wyniki narzędzi do informacji potrzebnych modelowi, podsumowuj lub usuwaj starsze wypowiedzi, używaj małego modelu do rutynowych kroków, a dużego tylko do planowania, i zmniejsz poziom rozumowania, jeśli nie wpłynie to na jakość.

Czy buforowanie promptów odbywa się automatycznie?

W przypadku OpenAI, DeepSeek, Kimi i niejawnego buforowania w Gemini — tak, jeśli prompty mają długi wspólny prefiks. Anthropic i niektóre endpointy Qwen wymagają jawnych znaczników cache, a Anthropic pobiera dodatkową opłatę za pierwszy zapis.

Dlaczego model z najniższą ceną za token nie jest najtańszy w przeliczeniu na zadanie?

Zniżki za cache różnią się między modelami, niektórzy dostawcy naliczają wyższą stawkę za długie prompty, a modele rozumujące zużywają tokeny wyjściowe na myślenie. Korzystniejszy może się też okazać model wymagający mniejszej liczby kroków lub ponowień — ten kalkulator tego nie uwzględnia.

Niezależne źródło informacji dla osób tworzących agentów AI. Nie jesteśmy powiązani z żadnym wymienionym tu dostawcą.

© 2026 DotsAgent · Dane sprawdzone 1 października 2026