dotsagent.io
Язык:Русский
Разработка · инструмент

Калькулятор стоимости агента

Агент работает в цикле: при каждом вызове он повторно отправляет всё накопленное и результат последнего вызова инструмента. Опишите этот цикл один раз и узнайте, сколько стоит одна задача и месяц задач на каждой модели из нашей таблицы цен.

Выберите готовый сценарий

Читает файлы, редактирует код и запускает тесты в репозитории. Большой системный prompt со схемами инструментов; на каждом шаге добавляется файл или журнал тестов.

Одна задача отправляет 3 360 000 входных токенов и получает 36 000 выходных токенов. Самый длинный промпт содержит 199 000 токенов.

Расчётная стоимость одной задачи и месяца для каждой модели
МодельЗа задачуЗа 30 дней при 50 задачах в день
GPT-6 Luna · OpenAI⁨0,099 $⁩⁨148 $⁩
Qwen3.7-Flash · Alibaba Cloud (Qwen)28 вызовов по тарифу для длинных промптов⁨0,101 $⁩⁨152 $⁩
GLM-5.3-Flash · Z.ai (Zhipu)⁨0,182 $⁩⁨273 $⁩
DeepSeek-V4.1-Flash · DeepSeek⁨0,218 $⁩⁨327 $⁩
Gemini 3.5 Flash-Lite · Google⁨0,333 $⁩⁨499 $⁩
Qwen3.7-Plus · Alibaba Cloud (Qwen)⁨0,343 $⁩⁨515 $⁩
Mistral Small 4 · Mistral AI⁨0,526 $⁩⁨788 $⁩
Gemini 3.8 Flash · Google⁨0,742 $⁩⁨1 112 $⁩
DeepSeek-V4-Pro-0813 · DeepSeek⁨0,961 $⁩⁨1 441 $⁩
Claude Haiku 4.5 · Anthropic⁨0,989 $⁩⁨1 483 $⁩
Amazon Nova 2 Lite · Amazonцена стороннего провайдера⁨1,10 $⁩⁨1 647 $⁩
Grok Build 0.1 · xAI⁨1,16 $⁩⁨1 746 $⁩
Muse Spark 1.3 · Meta⁨1,23 $⁩⁨1 852 $⁩
Grok 4.3 · xAI⁨1,31 $⁩⁨1 970 $⁩
Gemini 3.5 Flash · Google⁨1,54 $⁩⁨2 306 $⁩
Qwen3.8-Max · Alibaba Cloud (Qwen)⁨1,63 $⁩⁨2 443 $⁩
GLM-5.3 · Z.ai (Zhipu)⁨1,63 $⁩⁨2 446 $⁩
GPT-6.1 Sol · OpenAI⁨1,69 $⁩⁨2 541 $⁩
Claude Sonnet 5.5 · Anthropic⁨1,98 $⁩⁨2 966 $⁩
Gemini 3.1 Pro Preview · Google⁨2,05 $⁩⁨3 074 $⁩
Grok 4.7 · xAI⁨2,68 $⁩⁨4 026 $⁩
Kimi K3 · Moonshot AI (Kimi)⁨2,97 $⁩⁨4 449 $⁩
Claude Opus 5.5 · Anthropic⁨3,39 $⁩⁨5 082 $⁩
Amazon Nova 2 Pro · Amazonцена стороннего провайдера⁨4,56 $⁩⁨6 840 $⁩
Mistral Medium 3.5 · Mistral AI⁨5,31 $⁩⁨7 965 $⁩
Claude Fable 5.1 · Anthropic⁨7,76 $⁩⁨11 642 $⁩
Command A+ · Cohereпревышает размер контекстного окнацена стороннего провайдера⁨8,76 $⁩⁨13 140 $⁩
GPT-6 Astra · OpenAI⁨9,89 $⁩⁨14 831 $⁩

Публичные цены, стандартный тариф, доллары США. Запись в кэш, налоги, плата за инструменты (например, веб-поиск) и региональные надбавки не учитываются.

Как рассчитывается стоимость

Для каждого вызова в цикле мы берём размер промпта — исходный промпт плюс прирост на каждом предыдущем шаге — и делим его на закэшированную и новую части. Первый вызов всегда новый. За новые токены берётся плата по тарифу на входные токены, за закэшированные — по тарифу на токены из кэша, а за выходные — по тарифу на выходные токены.

Если размер отдельного промпта превышает порог длинного контекста у провайдера, весь вызов тарифицируется по повышенной ставке для длинных промптов, как у OpenAI, Google, xAI и Qwen. Если самый длинный промпт превышает контекстное окно модели, строка помечается: реальному агенту пришлось бы сначала сократить или обобщить историю.

Реальные агенты выполняют разные задачи, повторяют неудачные шаги и иногда останавливаются раньше. Используйте эти цифры, чтобы сравнить модели на одинаковой нагрузке, а затем оцените фактическое число токенов по своим трассировкам, прежде чем планировать бюджет.

Вопросы о стоимости агентов

Сколько токенов использует AI-агент на одну задачу?

В основном это зависит от числа шагов и объёма данных, добавляемых на каждом шаге. Короткий диалог со службой поддержки может потребовать 30K входных токенов; задача по программированию из 30 шагов с начальным промптом на 25K токенов отправляет более трёх миллионов токенов, поскольку вся история повторно передаётся при каждом вызове.

Как снизить стоимость агента?

Сохраняйте начало промпта неизменным между вызовами, чтобы оно кэшировалось; сокращайте результаты инструментов до необходимого модели; обобщайте или удаляйте старые сообщения; используйте небольшую модель для рутинных шагов, а большую — только для планирования; снижайте интенсивность рассуждений, если качество остаётся приемлемым.

Кэширование промптов происходит автоматически?

В OpenAI, DeepSeek, Kimi и Gemini при неявном кэшировании — да, если промпты имеют длинный общий префикс. Для Anthropic и некоторых endpoint-ов Qwen нужны явные маркеры кэширования, а Anthropic дополнительно взимает плату за первую запись.

Почему модель с самой низкой ценой за токен не всегда обходится дешевле на задачу?

Скидки за кэш различаются у разных моделей, некоторые провайдеры берут больше за длинные промпты, а модели с рассуждениями расходуют выходные токены на обдумывание. Выгоднее также может оказаться модель, которой нужно меньше шагов или повторных попыток, но этот калькулятор этого не учитывает.