---
title: "Precios de API de LLM para agentes de IA: 28 modelos comparados · DotsAgent"
description: "Precios de entrada, entrada en caché y salida por millón de tokens para 28 modelos de OpenAI, Anthropic, Google, xAI, DeepSeek, Qwen y más, con tamaños de contexto y funciones para agentes."
url: https://dotsagent.io/es/models
---

Desarrollo · precios verificados el 1 October 2026

# Modelos y precios de API para crear agentes

Un agente paga por cada paso que ejecuta, y la mayor parte del coste corresponde a la entrada que ya ha enviado. Esta tabla reúne precios de lista, descuentos por caché y límites de contexto para que elijas un modelo según el coste de una tarea completa, no por la tarifa destacada.

- [DeepSeek-V4.1-Flash](https://dotsagent.io/es/models/deepseek-v4-1-flash): 0,22 US$

- [Qwen3.7-Plus](https://dotsagent.io/es/models/qwen3-7-plus): 0,34 US$

- [GPT-6 Luna](https://dotsagent.io/es/models/gpt-6-luna): 0,10 US$

## Todos los modelos, en una tabla

| — | Proveedor | — | — | — | — | — |
| --- | --- | --- | --- | --- | --- | --- |
| [GPT-6 Astra](https://dotsagent.io/es/models/gpt-6-astra)gpt-6-astra | [OpenAI](https://dotsagent.io/es/providers/openai) | 10 US$* | 1 US$ | 50 US$ | 1,05M | 2026-09-08 |
| [Claude Fable 5.1](https://dotsagent.io/es/models/claude-fable-5-1)claude-fable-5-1 | [Anthropic](https://dotsagent.io/es/providers/anthropic) | 10 US$ | 0,25 US$ | 50 US$ | 1M | 2026-09-01 |
| [Claude Opus 5.5](https://dotsagent.io/es/models/claude-opus-5-5)claude-opus-5-5 | [Anthropic](https://dotsagent.io/es/providers/anthropic) | 4 US$ | 0,20 US$ | 20 US$ | 1M | 2026-09-22 |
| [Kimi K3](https://dotsagent.io/es/models/kimi-k3)kimi-k3 | [Moonshot AI (Kimi)](https://dotsagent.io/es/providers/moonshot) | 3 US$ | 0,30 US$ | 15 US$ | 1,05M | 2026-07-16 |
| [Command A+](https://dotsagent.io/es/models/command-a-plus)precio de terceroscommand-a-plus-05-2026 | [Cohere](https://dotsagent.io/es/providers/cohere) | 2,50 US$ | — | 10 US$ | 128K | 2026-05-20 |
| [GPT-6.1 Sol](https://dotsagent.io/es/models/gpt-6-1-sol)gpt-6.1-sol | [OpenAI](https://dotsagent.io/es/providers/openai) | 2 US$* | 0,10 US$ | 10 US$ | 1,05M | 2026-09-29 |
| [Claude Sonnet 5.5](https://dotsagent.io/es/models/claude-sonnet-5-5)claude-sonnet-5-5 | [Anthropic](https://dotsagent.io/es/providers/anthropic) | 2 US$ | 0,20 US$ | 10 US$ | 1M | 2026-09-28 |
| [Gemini 3.1 Pro Preview](https://dotsagent.io/es/models/gemini-3-1-pro-preview)versión preliminargemini-3.1-pro-preview | [Google](https://dotsagent.io/es/providers/google) | 2 US$* | 0,20 US$ | 12 US$ | 1,05M | 2026-02-19 |
| [Grok 4.7](https://dotsagent.io/es/models/grok-4-7)grok-4.7 | [xAI](https://dotsagent.io/es/providers/xai) | 2 US$* | 0,50 US$ | 6 US$ | 500K | 2026-09-21 |
| [Qwen3.8-Max](https://dotsagent.io/es/models/qwen3-8-max)qwen3.8-max | [Alibaba Cloud (Qwen)](https://dotsagent.io/es/providers/qwen) | 1,65 US$ | 0,21 US$ | 4,95 US$ | 1M | 2026-08-03 |
| [Gemini 3.5 Flash](https://dotsagent.io/es/models/gemini-3-5-flash)gemini-3.5-flash | [Google](https://dotsagent.io/es/providers/google) | 1,50 US$ | 0,15 US$ | 9 US$ | 1,05M | 2026-05-19 |
| [Mistral Medium 3.5](https://dotsagent.io/es/models/mistral-medium-3-5)mistral-medium-3-5 | [Mistral AI](https://dotsagent.io/es/providers/mistral) | 1,50 US$ | — | 7,50 US$ | 256K | 2026-04-28 |
| [GLM-5.3](https://dotsagent.io/es/models/glm-5-3)glm-5.3 | [Z.ai (Zhipu)](https://dotsagent.io/es/providers/zhipu) | 1,40 US$ | 0,26 US$ | 4,40 US$ | 1M | 2026-08-14 |
| [DeepSeek-V4-Pro-0813](https://dotsagent.io/es/models/deepseek-v4-pro-0813)deepseek-v4-pro | [DeepSeek](https://dotsagent.io/es/providers/deepseek) | 1,32 US$ | 0,044 US$ | 3,96 US$ | 1M | 2026-08-13 |
| [Grok 4.3](https://dotsagent.io/es/models/grok-4-3)grok-4.3 | [xAI](https://dotsagent.io/es/providers/xai) | 1,25 US$* | 0,20 US$ | 2,50 US$ | 1M | — |
| [Muse Spark 1.3](https://dotsagent.io/es/models/muse-spark-1-3)muse-spark-1.3 | [Meta](https://dotsagent.io/es/providers/meta) | 1,25 US$ | 0,15 US$ | 4,25 US$ | 1M | 2026-09-02 |
| [Amazon Nova 2 Pro](https://dotsagent.io/es/models/amazon-nova-2-pro)versión preliminarprecio de terceros | [Amazon](https://dotsagent.io/es/providers/amazon) | 1,25 US$ | — | 10 US$ | — | — |
| [Claude Haiku 4.5](https://dotsagent.io/es/models/claude-haiku-4-5)claude-haiku-4-5-20251001 | [Anthropic](https://dotsagent.io/es/providers/anthropic) | 1 US$ | 0,10 US$ | 5 US$ | 200K | — |
| [Grok Build 0.1](https://dotsagent.io/es/models/grok-build-0-1)grok-build-0.1 | [xAI](https://dotsagent.io/es/providers/xai) | 1 US$* | 0,20 US$ | 2 US$ | 256K | — |
| [Gemini 3.8 Flash](https://dotsagent.io/es/models/gemini-3-8-flash)gemini-3.8-flash | [Google](https://dotsagent.io/es/providers/google) | 0,75 US$ | 0,075 US$ | 3,75 US$ | 1,05M | 2026-09-02 |
| [Gemini 3.5 Flash-Lite](https://dotsagent.io/es/models/gemini-3-5-flash-lite)gemini-3.5-flash-lite | [Google](https://dotsagent.io/es/providers/google) | 0,30 US$ | 0,030 US$ | 2,50 US$ | 1,05M | 2026-07-21 |
| [DeepSeek-V4.1-Flash](https://dotsagent.io/es/models/deepseek-v4-1-flash)deepseek-flash | [DeepSeek](https://dotsagent.io/es/providers/deepseek) | 0,30 US$ | 0,006 US$ | 1,20 US$ | 1M | 2026-09-10 |
| [Amazon Nova 2 Lite](https://dotsagent.io/es/models/amazon-nova-2-lite)precio de terceros | [Amazon](https://dotsagent.io/es/providers/amazon) | 0,30 US$ | — | 2,50 US$ | 1M | 2025-12-02 |
| [Qwen3.7-Plus](https://dotsagent.io/es/models/qwen3-7-plus)qwen3.7-plus | [Alibaba Cloud (Qwen)](https://dotsagent.io/es/providers/qwen) | 0,28 US$* | 0,056 US$ | 1,10 US$ | 1M | 2026-05-26 |
| [Mistral Small 4](https://dotsagent.io/es/models/mistral-small-4)mistral-small-2603 | [Mistral AI](https://dotsagent.io/es/providers/mistral) | 0,15 US$ | — | 0,60 US$ | 256K | 2026-03-16 |
| [GLM-5.3-Flash](https://dotsagent.io/es/models/glm-5-3-flash)glm-5.3-flash | [Z.ai (Zhipu)](https://dotsagent.io/es/providers/zhipu) | 0,15 US$ | 0,030 US$ | 0,50 US$ | 1M | — |
| [GPT-6 Luna](https://dotsagent.io/es/models/gpt-6-luna)gpt-6-luna | [OpenAI](https://dotsagent.io/es/providers/openai) | 0,10 US$* | 0,010 US$ | 0,50 US$ | 1,05M | 2026-09-22 |
| [Qwen3.7-Flash](https://dotsagent.io/es/models/qwen3-7-flash)qwen3.7-flash | [Alibaba Cloud (Qwen)](https://dotsagent.io/es/providers/qwen) | 0,028 US$* | 0,006 US$ | 0,11 US$ | 1M | 2026-07-15 |

Dólares estadounidenses por millón de tokens, nivel estándar, tarifa para prompts cortos · * los prompts largos cuestan más

[Calcula el precio de tu carga de trabajo](https://dotsagent.io/es/cost)

## Cómo interpretar estos precios

### El precio de la entrada en caché es el que importa

En un ciclo de agente, el prompt del sistema, las definiciones de herramientas y los turnos anteriores se vuelven a enviar en cada llamada. Los proveedores cobran una fracción de la tarifa normal de entrada cuando ese prefijo se sirve desde la caché, a menudo una décima parte o menos. Por eso, un modelo con una caché barata puede resultar más económico que otro con un precio destacado inferior.

### Los prompts largos pueden encarecer toda la llamada

OpenAI, la versión preliminar Pro de Google, xAI y Qwen cobran una tarifa más alta cuando un solo prompt supera un umbral como 200K o 272K tokens, y la tarifa superior se aplica a todos los tokens de esa solicitud. Actualmente, Anthropic factura toda su ventana de un millón de tokens con la tarifa estándar.

### Los tokens de razonamiento se facturan como salida

Los modelos que razonan antes de responder cobran el razonamiento oculto a la tarifa de salida. Reduce el nivel de esfuerzo en los pasos rutinarios y reserva los niveles altos para la planificación o la depuración de problemas complejos.

### Los descuentos por lotes y en horas valle rara vez sirven para agentes

Los endpoints de procesamiento por lotes reducen el precio a la mitad, pero entregan los resultados en unas horas; son adecuados para evaluaciones y cargas históricas, no para agentes en tiempo real. La tarifa de DeepSeek en horas valle es la excepción que puede funcionar para tareas programadas.

## Preguntas frecuentes de quienes crean agentes

### ¿Qué modelo es el más barato para un agente de IA?

En nuestra carga de trabajo de programación de 30 pasos, los modelos más baratos son los pequeños: GPT-6 Luna, Qwen3.7-Flash y GLM-5.3-Flash, con un coste de entre 10 y 20 centavos por tarea cada uno. Un precio bajo por paso no implica un coste bajo por tarea si el modelo necesita más pasos o reintentos, así que prueba dos o tres candidatos con tus propios registros de ejecución.

### ¿Por qué mi agente cuesta mucho más de lo que sugiere el precio por token?

Porque en cada paso se vuelve a enviar la conversación, que va creciendo. Una tarea de 30 pasos con un prompt inicial de 25K tokens envía en total más de tres millones de tokens de entrada. La caché de prompts, las salidas más breves de las herramientas y los resúmenes de turnos anteriores reducen ese coste más que cambiar de modelo.

### ¿Son definitivos estos precios?

Son los precios de lista en dólares estadounidenses publicados en la página de precios de cada proveedor el 1 October 2026, antes de impuestos, recargos regionales o descuentos negociados. Los precios marcados como de terceros no pudieron verificarse en la página del propio proveedor.

### ¿Qué diferencia hay entre la entrada en caché y las escrituras en caché?

La lectura de caché es la tarifa con descuento para los tokens que ya están en la caché. Algunos proveedores, entre ellos Anthropic, también cobran un recargo la primera vez que se escribe un prefijo en la caché. La tabla muestra los precios de lectura; los precios de escritura se indican en la página de cada modelo cuando corresponda.

Referencia independiente para quienes crean agentes de IA. No estamos afiliados a ninguno de los proveedores mencionados aquí.

© 2026 DotsAgent · Datos verificados el 1 de octubre de 2026
