Alibaba Cloud (Qwen) · Di punta
Prezzi e specifiche API di Qwen3.8-Max
Il primo modello Qwen Max open-weight, con modalità di ragionamento e senza ragionamento, e fino a 262K token di ragionamento.
1,65 USD
0,21 USD
4,95 USD
Le letture esplicite dalla cache costano $0.137 per milione e la creazione della cache $2.063. Nella regione di Singapore, i costi sono $2 in input e $6 in output. Il prezzo per l'elaborazione batch è disponibile solo nella regione di Pechino.
Scheda tecnica
- Nome del modello nell'API
qwen3.8-max- Provider
- Alibaba Cloud (Qwen)
- Contesto
- 1M token
- Output massimo
- 131K token
- Rilascio
- 3 agosto 2026
- API Batch
- Nessuno sconto batch indicato
- Funzionalità per agenti documentate
- Chiamata di toolOutput strutturatoRicerca web integrataRagionamento regolabileInput di immagini
Quanto costa un'attività
Quattro carichi di lavoro di riferimento, calcolati con i prezzi di listino del modello e con la cache applicata dopo la prima chiamata. I tuoi valori saranno diversi; con il calcolatore puoi modificare ogni ipotesi.
| Carico di lavoro | Per attività | Per 1.000 attività |
|---|---|---|
| Bot di supporto | 0,039 USD | 39 USD |
| Agente di programmazione | 1,63 USD | 1629 USD |
| Agente browser | 1,15 USD | 1153 USD |
| Agente di ricerca | 1,04 USD | 1037 USD |
Altri modelli di Alibaba Cloud (Qwen)
Costi simili presso altri fornitori
Modelli di altri fornitori il cui costo per il carico di lavoro di programmazione in 30 passaggi è più simile a quello di questo modello.