Preços e especificações da API de DeepSeek-V4.1-Flash
O modelo mais recente da DeepSeek, que, segundo a empresa, supera o V4-Pro em qualidade, velocidade e preço, e aceita formatos de requisição da OpenAI e da Anthropic.
Os nomes antigos deepseek-v4-flash e deepseek-v4-flash-vision-exp agora direcionam para este modelo. Os acertos de cache custam $0.006 por milhão nos horários de pico e metade disso fora deles.
A DeepSeek cobra metade do preço fora do horário de pico. Nos dias úteis, o horário de pico é das 01:00 às 04:00 e das 06:00 às 10:00 UTC. Todos os outros horários, incluindo fins de semana, são fora de pico. A tabela mostra os preços de pico.
Ficha técnica
- Identificador do modelo na API
deepseek-flash- Provedor
- DeepSeek
- Contexto
- 1M tokens
- Saída máxima
- 384K tokens
- Lançamento
- 10 de setembro de 2026
- Batch API
- Nenhum desconto para processamento em lote informado
- Recursos documentados para agentes
- Chamada de ferramentasSaída estruturadaRaciocínio ajustávelEntrada de imagem
Quanto custa uma tarefa
Quatro cargas de trabalho de referência, calculadas com os preços de tabela deste modelo e com o cache aplicado após a primeira chamada. Seus valores podem ser diferentes; use a calculadora para alterar todas as premissas.
| Carga de trabalho | Por tarefa | Por 1.000 tarefas |
|---|---|---|
| Bot de suporte | US$ 0,007 | US$ 7 |
| Agente de programação | US$ 0,218 | US$ 218 |
| Agente de navegador | US$ 0,186 | US$ 186 |
| Agente de pesquisa | US$ 0,180 | US$ 180 |
Outros modelos da DeepSeek
Custos semelhantes em outros provedores
Modelos de outros provedores cujo custo na carga de trabalho de programação de 30 etapas é mais próximo deste.