Калькулятор стоимости агента
Агент работает в цикле: при каждом вызове он повторно отправляет всё накопленное и результат последнего вызова инструмента. Опишите этот цикл один раз и узнайте, сколько стоит одна задача и месяц задач на каждой модели из нашей таблицы цен.
| Модель | За задачу | За 30 дней при 50 задачах в день |
|---|---|---|
| GPT-6 Luna | 0,099 $ | 148 $ |
| Qwen3.7-Flash28 вызовов по тарифу для длинных промптов | 0,101 $ | 152 $ |
| GLM-5.3-Flash | 0,182 $ | 273 $ |
| DeepSeek-V4.1-Flash | 0,218 $ | 327 $ |
| Gemini 3.5 Flash-Lite | 0,333 $ | 499 $ |
| Qwen3.7-Plus | 0,343 $ | 515 $ |
| Mistral Small 4 | 0,526 $ | 788 $ |
| Gemini 3.8 Flash | 0,742 $ | 1 112 $ |
| DeepSeek-V4-Pro-0813 | 0,961 $ | 1 441 $ |
| Claude Haiku 4.5 | 0,989 $ | 1 483 $ |
| Amazon Nova 2 Liteцена стороннего провайдера | 1,10 $ | 1 647 $ |
| Grok Build 0.1 | 1,16 $ | 1 746 $ |
| Muse Spark 1.3 | 1,23 $ | 1 852 $ |
| Grok 4.3 | 1,31 $ | 1 970 $ |
| Gemini 3.5 Flash | 1,54 $ | 2 306 $ |
| Qwen3.8-Max | 1,63 $ | 2 443 $ |
| GLM-5.3 | 1,63 $ | 2 446 $ |
| GPT-6.1 Sol | 1,69 $ | 2 541 $ |
| Claude Sonnet 5.5 | 1,98 $ | 2 966 $ |
| Gemini 3.1 Pro Preview | 2,05 $ | 3 074 $ |
| Grok 4.7 | 2,68 $ | 4 026 $ |
| Kimi K3 | 2,97 $ | 4 449 $ |
| Claude Opus 5.5 | 3,39 $ | 5 082 $ |
| Amazon Nova 2 Proцена стороннего провайдера | 4,56 $ | 6 840 $ |
| Mistral Medium 3.5 | 5,31 $ | 7 965 $ |
| Claude Fable 5.1 | 7,76 $ | 11 642 $ |
| Command A+превышает размер контекстного окнацена стороннего провайдера | 8,76 $ | 13 140 $ |
| GPT-6 Astra | 9,89 $ | 14 831 $ |
Как рассчитывается стоимость
Для каждого вызова в цикле мы берём размер промпта — исходный промпт плюс прирост на каждом предыдущем шаге — и делим его на закэшированную и новую части. Первый вызов всегда новый. За новые токены берётся плата по тарифу на входные токены, за закэшированные — по тарифу на токены из кэша, а за выходные — по тарифу на выходные токены.
Если размер отдельного промпта превышает порог длинного контекста у провайдера, весь вызов тарифицируется по повышенной ставке для длинных промптов, как у OpenAI, Google, xAI и Qwen. Если самый длинный промпт превышает контекстное окно модели, строка помечается: реальному агенту пришлось бы сначала сократить или обобщить историю.
Реальные агенты выполняют разные задачи, повторяют неудачные шаги и иногда останавливаются раньше. Используйте эти цифры, чтобы сравнить модели на одинаковой нагрузке, а затем оцените фактическое число токенов по своим трассировкам, прежде чем планировать бюджет.
Вопросы о стоимости агентов
Сколько токенов использует AI-агент на одну задачу?
В основном это зависит от числа шагов и объёма данных, добавляемых на каждом шаге. Короткий диалог со службой поддержки может потребовать 30K входных токенов; задача по программированию из 30 шагов с начальным промптом на 25K токенов отправляет более трёх миллионов токенов, поскольку вся история повторно передаётся при каждом вызове.
Как снизить стоимость агента?
Сохраняйте начало промпта неизменным между вызовами, чтобы оно кэшировалось; сокращайте результаты инструментов до необходимого модели; обобщайте или удаляйте старые сообщения; используйте небольшую модель для рутинных шагов, а большую — только для планирования; снижайте интенсивность рассуждений, если качество остаётся приемлемым.
Кэширование промптов происходит автоматически?
В OpenAI, DeepSeek, Kimi и Gemini при неявном кэшировании — да, если промпты имеют длинный общий префикс. Для Anthropic и некоторых endpoint-ов Qwen нужны явные маркеры кэширования, а Anthropic дополнительно взимает плату за первую запись.
Почему модель с самой низкой ценой за токен не всегда обходится дешевле на задачу?
Скидки за кэш различаются у разных моделей, некоторые провайдеры берут больше за длинные промпты, а модели с рассуждениями расходуют выходные токены на обдумывание. Выгоднее также может оказаться модель, которой нужно меньше шагов или повторных попыток, но этот калькулятор этого не учитывает.