Alibaba Cloud (Qwen) · Topo de linha
Preços e especificações da API de Qwen3.8-Max
O primeiro modelo Qwen Max com pesos abertos, com modos de raciocínio e sem raciocínio e até 262K tokens de raciocínio.
US$ 1,65
US$ 0,21
US$ 4,95
Leituras explícitas do cache custam $0.137 por milhão e a criação do cache, $2.063. A região de Singapura cobra $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída. O preço para processamento em lote está disponível apenas na região de Pequim.
Ficha técnica
- Identificador do modelo na API
qwen3.8-max- Provedor
- Alibaba Cloud (Qwen)
- Contexto
- 1M tokens
- Saída máxima
- 131K tokens
- Lançamento
- 3 de agosto de 2026
- Batch API
- Nenhum desconto para processamento em lote informado
- Recursos documentados para agentes
- Chamada de ferramentasSaída estruturadaBusca na web integradaRaciocínio ajustávelEntrada de imagem
Quanto custa uma tarefa
Quatro cargas de trabalho de referência, calculadas com os preços de tabela deste modelo e com o cache aplicado após a primeira chamada. Seus valores podem ser diferentes; use a calculadora para alterar todas as premissas.
| Carga de trabalho | Por tarefa | Por 1.000 tarefas |
|---|---|---|
| Bot de suporte | US$ 0,039 | US$ 39 |
| Agente de programação | US$ 1,63 | US$ 1.629 |
| Agente de navegador | US$ 1,15 | US$ 1.153 |
| Agente de pesquisa | US$ 1,04 | US$ 1.037 |
Outros modelos da Alibaba Cloud (Qwen)
Custos semelhantes em outros provedores
Modelos de outros provedores cujo custo na carga de trabalho de programação de 30 etapas é mais próximo deste.