dotsagent.io
Lingua:Italiano
Z.ai (Zhipu) · Di punta

Prezzi e specifiche API di GLM-5.3

Il modello di punta di Z.ai: condivide il modello base con GLM-5.2, ma offre un post-training migliore e il ragionamento non può essere disattivato.

Input
⁨1,40 USD⁩
Input in cache
⁨0,26 USD⁩
Output
⁨4,40 USD⁩

Dollari USA per milione di token, fascia standard, tariffa per prompt brevi

L'archiviazione degli input in cache è gratuita per un periodo limitato. Le richieste con il ragionamento disattivato ora falliscono: rimuovi quel flag se stai migrando da GLM-5.2.

Scheda tecnica

Nome del modello nell'API
glm-5.3
Provider
Z.ai (Zhipu)
Contesto
1M token
Output massimo
—
Rilascio
14 agosto 2026
API Batch
Nessuno sconto batch indicato
Funzionalità per agenti documentate
Chiamata di toolRagionamento regolabile

Quanto costa un'attività

Quattro carichi di lavoro di riferimento, calcolati con i prezzi di listino del modello e con la cache applicata dopo la prima chiamata. I tuoi valori saranno diversi; con il calcolatore puoi modificare ogni ipotesi.

Carico di lavoroPer attivitàPer 1.000 attività
Bot di supporto
4 chiamate, brevi consultazioni dei tool
⁨0,035 USD⁩⁨35 USD⁩
Agente di programmazione
30 chiamate, file e output dei test
⁨1,63 USD⁩⁨1631 USD⁩
Agente browser
25 chiamate, screenshot e testo delle pagine
⁨1,05 USD⁩⁨1052 USD⁩
Agente di ricerca
15 chiamate, risultati di ricerca lunghi
⁨0,926 USD⁩⁨926 USD⁩

Modifica le ipotesi

Altri modelli di Z.ai (Zhipu)

Costi simili presso altri fornitori

Modelli di altri fornitori il cui costo per il carico di lavoro di programmazione in 30 passaggi è più simile a quello di questo modello.

Fonti

  1. docs.z.ai/guides/overview/pricing
  2. z.ai/blog/glm-5.3
  3. docs.z.ai/guides/overview/overview