dotsagent.io
Langue:Français
Z.ai (Zhipu) · Modèle phare

Tarifs et caractéristiques de l'API GLM-5.3

Le modèle phare de Z.ai, basé sur le même modèle que GLM-5.2 mais avec un post-entraînement amélioré et un raisonnement qui ne peut pas être désactivé.

Entrée
⁨1,40 $US⁩
Entrée mise en cache
⁨0,26 $US⁩
Sortie
⁨4,40 $US⁩

Dollars US par million de tokens, catégorie standard, tarif pour les prompts courts

Le stockage des entrées mises en cache est gratuit pendant une durée limitée. Les requêtes avec le raisonnement désactivé échouent désormais : supprimez ce flag lors de la migration depuis GLM-5.2.

Fiche technique

Identifiant du modèle dans l'API
glm-5.3
Fournisseur
Z.ai (Zhipu)
Contexte
1M tokens
Sortie maximale
—
Date de sortie
14 août 2026
Batch API
Aucune réduction Batch indiquée
Fonctionnalités d'agent documentées
Appel d'outilsRaisonnement ajustable

Coût d'une tâche

Quatre charges de référence, tarifées selon les prix catalogue de ce modèle, avec mise en cache à partir du deuxième appel. Vos chiffres varieront ; le calculateur vous permet de modifier chaque hypothèse.

Charge de travailPar tâchePour 1 000 tâches
Bot d’assistance
4 appels, recherches rapides avec des outils
⁨0,035 $US⁩⁨35 $US⁩
Agent de programmation
30 appels, fichiers et résultats de tests
⁨1,63 $US⁩⁨1 631 $US⁩
Agent de navigation
25 appels, captures d’écran et texte des pages
⁨1,05 $US⁩⁨1 052 $US⁩
Agent de recherche
15 appels, longs résultats de recherche
⁨0,926 $US⁩⁨926 $US⁩

Modifier les hypothèses

Autres modèles Z.ai (Zhipu)

Coût comparable chez d'autres fournisseurs

Modèles d'autres fournisseurs dont le coût pour la charge de travail de codage en 30 étapes est le plus proche de celui-ci.

Sources

  1. docs.z.ai/guides/overview/pricing
  2. z.ai/blog/glm-5.3
  3. docs.z.ai/guides/overview/overview