Alibaba Cloud (Qwen) · 小型高速
Qwen3.7-Flash API 定价与规格
此价格表中价格最低的模型,支持思考和非思考模式以及上下文缓存。
US$0.028
US$0.006
US$0.11
价格随 prompt 长度递增:超过 32K tokens 后费率翻三倍,超过 256K 后则再次上涨至输入每百万 $0.165、输出每百万 $0.66。
超过 32K 个 token 的提示词按每百万 token 的输入 US$0.083、缓存 US$0.017 和输出 US$0.33 计费,且较高费率适用于整个请求。
规格表
- API 模型标识
qwen3.7-flash- 提供商
- Alibaba Cloud (Qwen)
- 上下文
- 1M token
- 最大输出
- 131K token
- 发布时间
- 2026年7月15日
- Batch API
- 优惠 50%,数小时内返回结果
- 已文档化的智能体功能
- 工具调用可调节推理
任务成本
以下是按此模型标价计算的四种参考工作负载,缓存从首次调用后开始应用。实际费用会有所不同;你可以在计算器中调整所有假设。
| 工作负载 | 每项任务 | 每 1,000 项任务 |
|---|---|---|
| 客服机器人 | US$0.001 | US$1 |
| 编程智能体 按长提示词费率计费的 28 次调用 | US$0.101 | US$101 |
| 浏览器智能体 按长提示词费率计费的 18 次调用 | US$0.060 | US$60 |
| 研究智能体 按长提示词费率计费的 12 次调用 | US$0.054 | US$54 |
其他 Alibaba Cloud (Qwen) 模型
其他供应商的相近成本模型
在 30 步编码工作负载下,成本与此模型最接近的其他供应商模型。