dotsagent.io
Lingua:Italiano

Prezzi e specifiche API di Qwen3.8-Max

Il primo modello Qwen Max open-weight, con modalità di ragionamento e senza ragionamento, e fino a 262K token di ragionamento.

Input
⁨1,65 USD⁩
Input in cache
⁨0,21 USD⁩
Output
⁨4,95 USD⁩

Dollari USA per milione di token, fascia standard, tariffa per prompt brevi

Le letture esplicite dalla cache costano $0.137 per milione e la creazione della cache $2.063. Nella regione di Singapore, i costi sono $2 in input e $6 in output. Il prezzo per l'elaborazione batch è disponibile solo nella regione di Pechino.

Scheda tecnica

Nome del modello nell'API
qwen3.8-max
Provider
Alibaba Cloud (Qwen)
Contesto
1M token
Output massimo
131K token
Rilascio
3 agosto 2026
API Batch
Nessuno sconto batch indicato
Funzionalità per agenti documentate
Chiamata di toolOutput strutturatoRicerca web integrataRagionamento regolabileInput di immagini

Quanto costa un'attività

Quattro carichi di lavoro di riferimento, calcolati con i prezzi di listino del modello e con la cache applicata dopo la prima chiamata. I tuoi valori saranno diversi; con il calcolatore puoi modificare ogni ipotesi.

Carico di lavoroPer attivitàPer 1.000 attività
Bot di supporto
4 chiamate, brevi consultazioni dei tool
⁨0,039 USD⁩⁨39 USD⁩
Agente di programmazione
30 chiamate, file e output dei test
⁨1,63 USD⁩⁨1629 USD⁩
Agente browser
25 chiamate, screenshot e testo delle pagine
⁨1,15 USD⁩⁨1153 USD⁩
Agente di ricerca
15 chiamate, risultati di ricerca lunghi
⁨1,04 USD⁩⁨1037 USD⁩

Modifica le ipotesi

Altri modelli di Alibaba Cloud (Qwen)

Costi simili presso altri fornitori

Modelli di altri fornitori il cui costo per il carico di lavoro di programmazione in 30 passaggi è più simile a quello di questo modello.

Fonti

  1. alibabacloud.com/help/en/model-studio/qwen3-8-max
  2. alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  3. qwen.ai/blog?id=qwen3.8