dotsagent.io
Idioma:Português
Z.ai (Zhipu) · Pequeno e rápido

Preços e especificações da API de GLM-5.3-Flash

O modelo GLM pequeno e de baixo custo da Z.ai.

Entrada
⁨US$ 0,15⁩
Entrada em cache
⁨US$ 0,030⁩
Saída
⁨US$ 0,50⁩

Dólares americanos por milhão de tokens, categoria padrão, preço para prompts curtos

O desconto de lançamento terminou em 9 September 2026. Uma variante FlashX mais rápida custa $0.37 por milhão de tokens de entrada e $1.25 por milhão de tokens de saída.

Ficha técnica

Identificador do modelo na API
glm-5.3-flash
Provedor
Z.ai (Zhipu)
Contexto
1M tokens
Saída máxima
—
Lançamento
—
Batch API
Nenhum desconto para processamento em lote informado
Recursos documentados para agentes
A página do fornecedor não lista nenhum recurso para este modelo.

Quanto custa uma tarefa

Quatro cargas de trabalho de referência, calculadas com os preços de tabela deste modelo e com o cache aplicado após a primeira chamada. Seus valores podem ser diferentes; use a calculadora para alterar todas as premissas.

Carga de trabalhoPor tarefaPor 1.000 tarefas
Bot de suporte
4 chamadas, consultas curtas a ferramentas
⁨US$ 0,004⁩⁨US$ 4⁩
Agente de programação
30 chamadas, arquivos e saída de testes
⁨US$ 0,182⁩⁨US$ 182⁩
Agente de navegador
25 chamadas, capturas de tela e texto de páginas
⁨US$ 0,115⁩⁨US$ 115⁩
Agente de pesquisa
15 chamadas, resultados de busca longos
⁨US$ 0,101⁩⁨US$ 101⁩

Alterar as premissas

Outros modelos da Z.ai (Zhipu)

Custos semelhantes em outros provedores

Modelos de outros provedores cujo custo na carga de trabalho de programação de 30 etapas é mais próximo deste.

Fontes

  1. docs.z.ai/guides/overview/pricing
  2. docs.z.ai/guides/overview/overview

Referência independente para quem cria agentes de IA. Não temos vínculo com nenhum dos fornecedores mencionados aqui.

© 2026 DotsAgent · Fatos verificados em 1 de outubro de 2026