dotsagent.io
语言:简体中文
Alibaba Cloud (Qwen) · 小型高速

Qwen3.7-Flash API 定价与规格

此价格表中价格最低的模型,支持思考和非思考模式以及上下文缓存。

输入
⁨US$0.028⁩
缓存输入
⁨US$0.006⁩
输出
⁨US$0.11⁩

每百万 token 的美元价格;标准级别、短 prompt 费率

价格随 prompt 长度递增:超过 32K tokens 后费率翻三倍,超过 256K 后则再次上涨至输入每百万 $0.165、输出每百万 $0.66。

超过 32K 个 token 的提示词按每百万 token 的输入 ⁨US$0.083⁩、缓存 ⁨US$0.017⁩ 和输出 ⁨US$0.33⁩ 计费,且较高费率适用于整个请求。

规格表

API 模型标识
qwen3.7-flash
提供商
Alibaba Cloud (Qwen)
上下文
1M token
最大输出
131K token
发布时间
2026年7月15日
Batch API
优惠 50%,数小时内返回结果
已文档化的智能体功能
工具调用可调节推理

任务成本

以下是按此模型标价计算的四种参考工作负载,缓存从首次调用后开始应用。实际费用会有所不同;你可以在计算器中调整所有假设。

工作负载每项任务每 1,000 项任务
客服机器人
4 次调用,简短的工具查询
⁨US$0.001⁩⁨US$1⁩
编程智能体
30 次调用,文件和测试输出
按长提示词费率计费的 28 次调用
⁨US$0.101⁩⁨US$101⁩
浏览器智能体
25 次调用,截图和网页文本
按长提示词费率计费的 18 次调用
⁨US$0.060⁩⁨US$60⁩
研究智能体
15 次调用,较长的搜索结果
按长提示词费率计费的 12 次调用
⁨US$0.054⁩⁨US$54⁩

更改假设

其他 Alibaba Cloud (Qwen) 模型

其他供应商的相近成本模型

在 30 步编码工作负载下,成本与此模型最接近的其他供应商模型。

来源

  1. alibabacloud.com/help/en/model-studio/qwen3-7-flash
  2. help.aliyun.com/en/model-studio/model-pricing

为 AI agent 开发者提供的独立参考资料。与此处提及的任何厂商均无关联。

© 2026 DotsAgent · 事实核查日期:2026年10月1日