Precios y especificaciones de la API de DeepSeek-V4.1-Flash
El modelo más reciente de DeepSeek, que según la empresa supera a V4-Pro en calidad, velocidad y precio, y acepta los formatos de solicitud de OpenAI y Anthropic.
Los nombres anteriores deepseek-v4-flash y deepseek-v4-flash-vision-exp ahora redirigen a este modelo. Las lecturas de caché cuestan $0.006 por millón en horas punta y la mitad fuera de ellas.
DeepSeek cobra la mitad fuera de las horas punta. Las horas punta son de 01:00 a 04:00 y de 06:00 a 10:00 UTC entre semana; el resto de las horas, incluidos los fines de semana, son horas valle. La tabla muestra los precios de las horas punta.
Ficha técnica
- Identificador del modelo en la API
deepseek-flash- Proveedor
- DeepSeek
- Contexto
- 1M tokens
- Salida máxima
- 384K tokens
- Publicado
- 10 de septiembre de 2026
- Batch API
- No se indica ningún descuento por lotes
- Funciones para agentes documentadas
- Llamada a herramientasSalida estructuradaRazonamiento ajustableEntrada de imágenes
Cuánto cuesta una tarea
Cuatro cargas de trabajo de referencia, calculadas con los precios de lista de este modelo y aplicando la caché después de la primera llamada. Tus cifras pueden variar; con la calculadora puedes cambiar todos los supuestos.
| Carga de trabajo | Por tarea | Por cada 1.000 tareas |
|---|---|---|
| Bot de soporte | 0,007 US$ | 7 US$ |
| Agente de programación | 0,218 US$ | 218 US$ |
| Agente de navegador | 0,186 US$ | 186 US$ |
| Agente de investigación | 0,180 US$ | 180 US$ |
Otros modelos de DeepSeek
Coste similar con otros proveedores
Modelos de otros proveedores cuyo coste para la carga de trabajo de programación de 30 pasos es más parecido al de este modelo.