Prezzi e specifiche API di Qwen3.7-Flash
Il modello meno costoso di questa tabella, con modalità di ragionamento e senza ragionamento e caching del contesto.
Il prezzo aumenta in base alla lunghezza del prompt: oltre 32K token, la tariffa triplica; oltre 256K, aumenta di nuovo, arrivando a $0.165 per milione di token in input e $0.66 in output.
I prompt che superano 32K token vengono fatturati a 0,083 USD per i token di input, 0,017 USD per quelli in cache e 0,33 USD per quelli di output, per milione di token. La tariffa più alta si applica all'intera richiesta.
Scheda tecnica
- Nome del modello nell'API
qwen3.7-flash- Provider
- Alibaba Cloud (Qwen)
- Contesto
- 1M token
- Output massimo
- 131K token
- Rilascio
- 15 luglio 2026
- API Batch
- Sconto del 50%, risultati entro poche ore
- Funzionalità per agenti documentate
- Chiamata di toolRagionamento regolabile
Quanto costa un'attività
Quattro carichi di lavoro di riferimento, calcolati con i prezzi di listino del modello e con la cache applicata dopo la prima chiamata. I tuoi valori saranno diversi; con il calcolatore puoi modificare ogni ipotesi.
| Carico di lavoro | Per attività | Per 1.000 attività |
|---|---|---|
| Bot di supporto | 0,001 USD | 1 USD |
| Agente di programmazione 28 chiamate con la tariffa per prompt lunghi | 0,101 USD | 101 USD |
| Agente browser 18 chiamate con la tariffa per prompt lunghi | 0,060 USD | 60 USD |
| Agente di ricerca 12 chiamate con la tariffa per prompt lunghi | 0,054 USD | 54 USD |
Altri modelli di Alibaba Cloud (Qwen)
Costi simili presso altri fornitori
Modelli di altri fornitori il cui costo per il carico di lavoro di programmazione in 30 passaggi è più simile a quello di questo modello.