dotsagent.io
Sprache:Deutsch
Z.ai (Zhipu) · Klein und schnell

GLM-5.3-Flash: API-Preise und Spezifikationen

Das kompakte, kostengünstige GLM-Modell von Z.ai.

Eingabe
⁨0,15 $⁩
Zwischengespeicherte Eingabe
⁨0,030 $⁩
Ausgabe
⁨0,50 $⁩

US-Dollar pro Million Token, Standardklasse, Preis für kurze Prompts

Der Einführungsrabatt endete am 9 September 2026. Eine schnellere FlashX-Variante kostet $0.37 pro Million Eingabe- und $1.25 pro Million Ausgabetokens.

Datenblatt

API-Modellname
glm-5.3-flash
Anbieter
Z.ai (Zhipu)
Kontext
1M Tokens
Max. Output
—
Veröffentlicht
—
Batch API
Kein Batch-Rabatt angegeben
Dokumentierte Agent-Funktionen
Auf der Seite des Anbieters sind für dieses Modell keine aufgeführt.

Was eine Aufgabe kostet

Vier typische Workloads, berechnet zu den Listenpreisen dieses Modells; Caching wird ab dem zweiten Aufruf berücksichtigt. Ihre Kosten können abweichen. Im Rechner können Sie alle Annahmen ändern.

WorkloadPro AufgabePro 1.000 Aufgaben
Support-Bot
4 Aufrufe, kurze Tool-Abfragen
⁨0,004 $⁩⁨4 $⁩
Coding-Agent
30 Aufrufe, Dateien und Testausgaben
⁨0,182 $⁩⁨182 $⁩
Browser-Agent
25 Aufrufe, Screenshots und Seitentext
⁨0,115 $⁩⁨115 $⁩
Recherche-Agent
15 Aufrufe, lange Suchergebnisse
⁨0,101 $⁩⁨101 $⁩

Annahmen ändern

Weitere Z.ai (Zhipu)-Modelle

Ähnliche Kosten bei anderen Anbietern

Modelle anderer Anbieter, deren Kosten für den 30-Schritte-Coding-Workload diesem Modell am nächsten kommen.

Quellen

  1. docs.z.ai/guides/overview/pricing
  2. docs.z.ai/guides/overview/overview