---
title: "Ceny API modeli LLM dla agentów AI: porównanie 28 modeli · DotsAgent"
description: "Ceny za milion tokenów wejściowych, z cache i wyjściowych dla 28 modeli OpenAI, Anthropic, Google, xAI, DeepSeek, Qwen i innych. Zawiera limity kontekstu i funkcje dla agentów."
url: https://dotsagent.io/pl/models
---

Tworzenie · ceny sprawdzone 1 października 2026

# Modele i ceny API dla twórców agentów

Agent płaci za każdy wykonany krok, a większość kosztów stanowią dane wejściowe wysłane już wcześniej. Ta tabela zestawia ceny katalogowe, rabaty za cache i limity kontekstu, aby ułatwić wybór modelu na podstawie kosztu całego zadania, a nie ceny nagłówkowej.

- [DeepSeek-V4.1-Flash](https://dotsagent.io/pl/models/deepseek-v4-1-flash): 0,22 USD

- [Qwen3.7-Plus](https://dotsagent.io/pl/models/qwen3-7-plus): 0,34 USD

- [GPT-6 Luna](https://dotsagent.io/pl/models/gpt-6-luna): 0,10 USD

## Wszystkie modele w jednej tabeli

| — | Dostawca | — | — | — | — | — |
| --- | --- | --- | --- | --- | --- | --- |
| [GPT-6 Astra](https://dotsagent.io/pl/models/gpt-6-astra)gpt-6-astra | [OpenAI](https://dotsagent.io/pl/providers/openai) | 10 USD* | 1 USD | 50 USD | 1,05M | 2026-09-08 |
| [Claude Fable 5.1](https://dotsagent.io/pl/models/claude-fable-5-1)claude-fable-5-1 | [Anthropic](https://dotsagent.io/pl/providers/anthropic) | 10 USD | 0,25 USD | 50 USD | 1M | 2026-09-01 |
| [Claude Opus 5.5](https://dotsagent.io/pl/models/claude-opus-5-5)claude-opus-5-5 | [Anthropic](https://dotsagent.io/pl/providers/anthropic) | 4 USD | 0,20 USD | 20 USD | 1M | 2026-09-22 |
| [Kimi K3](https://dotsagent.io/pl/models/kimi-k3)kimi-k3 | [Moonshot AI (Kimi)](https://dotsagent.io/pl/providers/moonshot) | 3 USD | 0,30 USD | 15 USD | 1,05M | 2026-07-16 |
| [Command A+](https://dotsagent.io/pl/models/command-a-plus)cena zewnętrznego dostawcycommand-a-plus-05-2026 | [Cohere](https://dotsagent.io/pl/providers/cohere) | 2,50 USD | — | 10 USD | 128K | 2026-05-20 |
| [GPT-6.1 Sol](https://dotsagent.io/pl/models/gpt-6-1-sol)gpt-6.1-sol | [OpenAI](https://dotsagent.io/pl/providers/openai) | 2 USD* | 0,10 USD | 10 USD | 1,05M | 2026-09-29 |
| [Claude Sonnet 5.5](https://dotsagent.io/pl/models/claude-sonnet-5-5)claude-sonnet-5-5 | [Anthropic](https://dotsagent.io/pl/providers/anthropic) | 2 USD | 0,20 USD | 10 USD | 1M | 2026-09-28 |
| [Gemini 3.1 Pro Preview](https://dotsagent.io/pl/models/gemini-3-1-pro-preview)wersja podglądowagemini-3.1-pro-preview | [Google](https://dotsagent.io/pl/providers/google) | 2 USD* | 0,20 USD | 12 USD | 1,05M | 2026-02-19 |
| [Grok 4.7](https://dotsagent.io/pl/models/grok-4-7)grok-4.7 | [xAI](https://dotsagent.io/pl/providers/xai) | 2 USD* | 0,50 USD | 6 USD | 500K | 2026-09-21 |
| [Qwen3.8-Max](https://dotsagent.io/pl/models/qwen3-8-max)qwen3.8-max | [Alibaba Cloud (Qwen)](https://dotsagent.io/pl/providers/qwen) | 1,65 USD | 0,21 USD | 4,95 USD | 1M | 2026-08-03 |
| [Gemini 3.5 Flash](https://dotsagent.io/pl/models/gemini-3-5-flash)gemini-3.5-flash | [Google](https://dotsagent.io/pl/providers/google) | 1,50 USD | 0,15 USD | 9 USD | 1,05M | 2026-05-19 |
| [Mistral Medium 3.5](https://dotsagent.io/pl/models/mistral-medium-3-5)mistral-medium-3-5 | [Mistral AI](https://dotsagent.io/pl/providers/mistral) | 1,50 USD | — | 7,50 USD | 256K | 2026-04-28 |
| [GLM-5.3](https://dotsagent.io/pl/models/glm-5-3)glm-5.3 | [Z.ai (Zhipu)](https://dotsagent.io/pl/providers/zhipu) | 1,40 USD | 0,26 USD | 4,40 USD | 1M | 2026-08-14 |
| [DeepSeek-V4-Pro-0813](https://dotsagent.io/pl/models/deepseek-v4-pro-0813)deepseek-v4-pro | [DeepSeek](https://dotsagent.io/pl/providers/deepseek) | 1,32 USD | 0,044 USD | 3,96 USD | 1M | 2026-08-13 |
| [Grok 4.3](https://dotsagent.io/pl/models/grok-4-3)grok-4.3 | [xAI](https://dotsagent.io/pl/providers/xai) | 1,25 USD* | 0,20 USD | 2,50 USD | 1M | — |
| [Muse Spark 1.3](https://dotsagent.io/pl/models/muse-spark-1-3)muse-spark-1.3 | [Meta](https://dotsagent.io/pl/providers/meta) | 1,25 USD | 0,15 USD | 4,25 USD | 1M | 2026-09-02 |
| [Amazon Nova 2 Pro](https://dotsagent.io/pl/models/amazon-nova-2-pro)wersja podglądowacena zewnętrznego dostawcy | [Amazon](https://dotsagent.io/pl/providers/amazon) | 1,25 USD | — | 10 USD | — | — |
| [Claude Haiku 4.5](https://dotsagent.io/pl/models/claude-haiku-4-5)claude-haiku-4-5-20251001 | [Anthropic](https://dotsagent.io/pl/providers/anthropic) | 1 USD | 0,10 USD | 5 USD | 200K | — |
| [Grok Build 0.1](https://dotsagent.io/pl/models/grok-build-0-1)grok-build-0.1 | [xAI](https://dotsagent.io/pl/providers/xai) | 1 USD* | 0,20 USD | 2 USD | 256K | — |
| [Gemini 3.8 Flash](https://dotsagent.io/pl/models/gemini-3-8-flash)gemini-3.8-flash | [Google](https://dotsagent.io/pl/providers/google) | 0,75 USD | 0,075 USD | 3,75 USD | 1,05M | 2026-09-02 |
| [Gemini 3.5 Flash-Lite](https://dotsagent.io/pl/models/gemini-3-5-flash-lite)gemini-3.5-flash-lite | [Google](https://dotsagent.io/pl/providers/google) | 0,30 USD | 0,030 USD | 2,50 USD | 1,05M | 2026-07-21 |
| [DeepSeek-V4.1-Flash](https://dotsagent.io/pl/models/deepseek-v4-1-flash)deepseek-flash | [DeepSeek](https://dotsagent.io/pl/providers/deepseek) | 0,30 USD | 0,006 USD | 1,20 USD | 1M | 2026-09-10 |
| [Amazon Nova 2 Lite](https://dotsagent.io/pl/models/amazon-nova-2-lite)cena zewnętrznego dostawcy | [Amazon](https://dotsagent.io/pl/providers/amazon) | 0,30 USD | — | 2,50 USD | 1M | 2025-12-02 |
| [Qwen3.7-Plus](https://dotsagent.io/pl/models/qwen3-7-plus)qwen3.7-plus | [Alibaba Cloud (Qwen)](https://dotsagent.io/pl/providers/qwen) | 0,28 USD* | 0,056 USD | 1,10 USD | 1M | 2026-05-26 |
| [Mistral Small 4](https://dotsagent.io/pl/models/mistral-small-4)mistral-small-2603 | [Mistral AI](https://dotsagent.io/pl/providers/mistral) | 0,15 USD | — | 0,60 USD | 256K | 2026-03-16 |
| [GLM-5.3-Flash](https://dotsagent.io/pl/models/glm-5-3-flash)glm-5.3-flash | [Z.ai (Zhipu)](https://dotsagent.io/pl/providers/zhipu) | 0,15 USD | 0,030 USD | 0,50 USD | 1M | — |
| [GPT-6 Luna](https://dotsagent.io/pl/models/gpt-6-luna)gpt-6-luna | [OpenAI](https://dotsagent.io/pl/providers/openai) | 0,10 USD* | 0,010 USD | 0,50 USD | 1,05M | 2026-09-22 |
| [Qwen3.7-Flash](https://dotsagent.io/pl/models/qwen3-7-flash)qwen3.7-flash | [Alibaba Cloud (Qwen)](https://dotsagent.io/pl/providers/qwen) | 0,028 USD* | 0,006 USD | 0,11 USD | 1M | 2026-07-15 |

Dolary amerykańskie za milion tokenów, standardowa klasa, stawka dla krótkich promptów · * dłuższe prompty kosztują więcej

[Oblicz koszt własnego scenariusza](https://dotsagent.io/pl/cost)

## Jak czytać te ceny

### Najważniejsza jest cena tokenów wejściowych z cache

W pętli agenta prompt systemowy, definicje narzędzi i wcześniejsze tury są wysyłane ponownie przy każdym wywołaniu. Gdy dostawca pobiera ten prefiks z cache, nalicza ułamek standardowej stawki za dane wejściowe — często jedną dziesiątą lub mniej. Dlatego model z tanim cache może być korzystniejszy niż model z niższą ceną nagłówkową.

### Długie prompty mogą podnieść koszt całego wywołania

OpenAI, wersja preview Pro od Google, xAI i Qwen naliczają wyższą stawkę, gdy pojedynczy prompt przekroczy próg, na przykład 200K lub 272K tokenów. Wyższa stawka obejmuje wtedy wszystkie tokeny w tym żądaniu. Anthropic obecnie rozlicza całe okno miliona tokenów według standardowej stawki.

### Tokeny używane do rozumowania są rozliczane jak tokeny wyjściowe

Modele, które analizują problem przed udzieleniem odpowiedzi, rozliczają ukryte tokeny rozumowania według stawki za dane wyjściowe. Przy rutynowych krokach obniż poziom wysiłku, a wyższe ustawienia zostaw do planowania lub trudnego debugowania.

### Rabaty za Batch i godziny poza szczytem rzadko sprawdzają się w agentach

Endpointy Batch obniżają cenę o połowę, ale zwracają wyniki w ciągu kilku godzin, więc lepiej nadają się do ewaluacji i uzupełniania danych niż do agentów działających na żywo. Wyjątkiem jest stawka DeepSeek poza godzinami szczytu, która może sprawdzić się w zaplanowanych zadaniach.

## Pytania twórców

### Który model jest najtańszy dla agenta AI?

W naszym 30-etapowym scenariuszu programistycznym najtańsze są małe modele: GPT-6 Luna, Qwen3.7-Flash i GLM-5.3-Flash. Koszt każdego z nich wynosi około 10–20 centów za zadanie. Niska cena za krok nie oznacza niskiego kosztu całego zadania, jeśli model potrzebuje więcej kroków lub ponowień. Przetestuj dwóch lub trzech kandydatów na własnych śladach działania.

### Dlaczego mój agent kosztuje znacznie więcej, niż wynikałoby z ceny za token?

Ponieważ przy każdym kroku wysyłana jest ponownie coraz dłuższa rozmowa. Zadanie składające się z 30 kroków i rozpoczynające się promptem o długości 25K tokenów wysyła łącznie znacznie ponad trzy miliony tokenów wejściowych. Cache promptów, krótsze wyniki narzędzi i streszczanie wcześniejszych tur pozwalają ograniczyć ten koszt skuteczniej niż zmiana modelu.

### Czy te ceny są ostateczne?

To ceny katalogowe w dolarach amerykańskich, podane na stronach z cennikami poszczególnych dostawców 1 października 2026. Nie uwzględniają podatków, dopłat regionalnych ani rabatów negocjowanych. Cen oznaczonych jako pochodzące od zewnętrznego dostawcy nie udało się odczytać z oficjalnej strony sprzedawcy.

### Czym różni się odczyt z cache od zapisu do cache?

Odczyt z cache oznacza obniżoną stawkę za tokeny, które już się w nim znajdują. Niektórzy dostawcy, w tym Anthropic, naliczają też wyższą opłatę za pierwsze zapisanie prefiksu do cache. Tabela pokazuje ceny odczytu; ceny zapisu podano na stronie danego modelu, jeśli mają zastosowanie.

Niezależne źródło informacji dla osób tworzących agentów AI. Nie jesteśmy powiązani z żadnym wymienionym tu dostawcą.

© 2026 DotsAgent · Dane sprawdzone 1 października 2026
