---
title: "GLM-5.3-Flash API 定价：输入 ⁨US$0.15⁩，输出 ⁨US$0.50⁩ · DotsAgent"
description: "Z.ai (Zhipu) 的 GLM-5.3-Flash：每百万输入、缓存和输出 token 的价格、上下文窗口、智能体功能，以及实际智能体任务的成本。"
url: https://dotsagent.io/zh/models/glm-5-3-flash
---

[Z.ai (Zhipu)](https://dotsagent.io/zh/providers/zhipu)

· 小型高速

# GLM-5.3-Flash API 定价与规格

Z.ai 的小型低成本 GLM 模型。

输入

US$0.15

缓存输入

US$0.030

输出

US$0.50

每百万 token 的美元价格；标准级别、短 prompt 费率

发布折扣已于 9 September 2026 结束。更快的 FlashX 变体输入每百万收费 $0.37，输出每百万收费 $1.25。

## 规格表

- **API 模型标识**: `glm-5.3-flash`
- **提供商**: [Z.ai (Zhipu)](https://dotsagent.io/zh/providers/zhipu)
- **上下文**: 1M token
- **最大输出**: —
- **发布时间**: —
- **Batch API**: 未列出批处理折扣
- **已文档化的智能体功能**: 供应商页面未列出此模型的相关功能。

## 任务成本

以下是按此模型标价计算的四种参考工作负载，缓存从首次调用后开始应用。实际费用会有所不同；你可以在计算器中调整所有假设。

| 工作负载 | 每项任务 | 每 1,000 项任务 |
| --- | --- | --- |
| 客服机器人 4 次调用，简短的工具查询 | US$0.004 | US$4 |
| 编程智能体 30 次调用，文件和测试输出 | US$0.182 | US$182 |
| 浏览器智能体 25 次调用，截图和网页文本 | US$0.115 | US$115 |
| 研究智能体 15 次调用，较长的搜索结果 | US$0.101 | US$101 |

[更改假设](https://dotsagent.io/zh/cost#model=glm-5-3-flash)

## 其他 Z.ai (Zhipu) 模型

- [GLM-5.3](https://dotsagent.io/zh/models/glm-5-3): US$1.40 / US$4.40

## 其他供应商的相近成本模型

在 30 步编码工作负载下，成本与此模型最接近的其他供应商模型。

- [DeepSeek-V4.1-Flash](https://dotsagent.io/zh/models/deepseek-v4-1-flash): US$0.218 每项编码任务

- [Qwen3.7-Flash](https://dotsagent.io/zh/models/qwen3-7-flash): US$0.101 每项编码任务

- [Gemini 3.5 Flash-Lite](https://dotsagent.io/zh/models/gemini-3-5-flash-lite): US$0.333 每项编码任务

- [GPT-6 Luna](https://dotsagent.io/zh/models/gpt-6-luna): US$0.099 每项编码任务

## 来源

1. [docs.z.ai](https://docs.z.ai/guides/overview/pricing)/guides/overview/pricing
2. [docs.z.ai](https://docs.z.ai/guides/overview/overview)/guides/overview/overview

为 AI agent 开发者提供的独立参考资料。与此处提及的任何厂商均无关联。

© 2026 DotsAgent · 事实核查日期：2026年10月1日
