Precios y especificaciones de la API de Qwen3.7-Flash
El modelo más barato de esta tabla, con modos de razonamiento y sin razonamiento, y caché de contexto.
El precio aumenta según la longitud del prompt: por encima de 32K tokens, se triplica; por encima de 256K, vuelve a subir hasta $0.165 de entrada y $0.66 de salida por millón.
Los prompts de más de 32K tokens se facturan a 0,083 US$ por millón de tokens de entrada, 0,017 US$ por millón de tokens en caché y 0,33 US$ por millón de tokens de salida. La tarifa más alta se aplica a toda la solicitud.
Ficha técnica
- Identificador del modelo en la API
qwen3.7-flash- Proveedor
- Alibaba Cloud (Qwen)
- Contexto
- 1M tokens
- Salida máxima
- 131K tokens
- Publicado
- 15 de julio de 2026
- Batch API
- 50% de descuento, resultados en unas horas
- Funciones para agentes documentadas
- Llamada a herramientasRazonamiento ajustable
Cuánto cuesta una tarea
Cuatro cargas de trabajo de referencia, calculadas con los precios de lista de este modelo y aplicando la caché después de la primera llamada. Tus cifras pueden variar; con la calculadora puedes cambiar todos los supuestos.
| Carga de trabajo | Por tarea | Por cada 1.000 tareas |
|---|---|---|
| Bot de soporte | 0,001 US$ | 1 US$ |
| Agente de programación 28 llamadas con la tarifa para prompts largos | 0,101 US$ | 101 US$ |
| Agente de navegador 18 llamadas con la tarifa para prompts largos | 0,060 US$ | 60 US$ |
| Agente de investigación 12 llamadas con la tarifa para prompts largos | 0,054 US$ | 54 US$ |
Otros modelos de Alibaba Cloud (Qwen)
Coste similar con otros proveedores
Modelos de otros proveedores cuyo coste para la carga de trabajo de programación de 30 pasos es más parecido al de este modelo.