Preços e especificações da API de Qwen3.7-Flash
O modelo mais barato desta tabela, com modos de raciocínio e sem raciocínio e cache de contexto.
O preço aumenta conforme o tamanho do prompt: acima de 32K tokens, a tarifa triplica; acima de 256K, aumenta novamente, para $0.165 por milhão de tokens de entrada e $0.66 por milhão de tokens de saída.
Prompts com mais de 32K tokens são cobrados por milhão a US$ 0,083 para entrada, US$ 0,017 para tokens em cache e US$ 0,33 para saída. A tarifa mais alta se aplica à solicitação inteira.
Ficha técnica
- Identificador do modelo na API
qwen3.7-flash- Provedor
- Alibaba Cloud (Qwen)
- Contexto
- 1M tokens
- Saída máxima
- 131K tokens
- Lançamento
- 15 de julho de 2026
- Batch API
- 50% de desconto, resultados em poucas horas
- Recursos documentados para agentes
- Chamada de ferramentasRaciocínio ajustável
Quanto custa uma tarefa
Quatro cargas de trabalho de referência, calculadas com os preços de tabela deste modelo e com o cache aplicado após a primeira chamada. Seus valores podem ser diferentes; use a calculadora para alterar todas as premissas.
| Carga de trabalho | Por tarefa | Por 1.000 tarefas |
|---|---|---|
| Bot de suporte | US$ 0,001 | US$ 1 |
| Agente de programação 28 chamadas com a tarifa para prompts longos | US$ 0,101 | US$ 101 |
| Agente de navegador 18 chamadas com a tarifa para prompts longos | US$ 0,060 | US$ 60 |
| Agente de pesquisa 12 chamadas com a tarifa para prompts longos | US$ 0,054 | US$ 54 |
Outros modelos da Alibaba Cloud (Qwen)
Custos semelhantes em outros provedores
Modelos de outros provedores cujo custo na carga de trabalho de programação de 30 etapas é mais próximo deste.