Alibaba Cloud (Qwen) · 旗舰
Qwen3.8-Max API 定价与规格
首款开放权重的 Qwen Max 模型,支持思考和非思考模式,推理长度最高可达 262K tokens。
US$1.65
US$0.21
US$4.95
显式缓存读取每百万收费 $0.137,缓存创建收费 $2.063。新加坡区域的输入价格为 $2,输出价格为 $6。批量定价仅适用于北京区域。
规格表
- API 模型标识
qwen3.8-max- 提供商
- Alibaba Cloud (Qwen)
- 上下文
- 1M token
- 最大输出
- 131K token
- 发布时间
- 2026年8月3日
- Batch API
- 未列出批处理折扣
- 已文档化的智能体功能
- 工具调用结构化输出内置网页搜索可调节推理图像输入
任务成本
以下是按此模型标价计算的四种参考工作负载,缓存从首次调用后开始应用。实际费用会有所不同;你可以在计算器中调整所有假设。
| 工作负载 | 每项任务 | 每 1,000 项任务 |
|---|---|---|
| 客服机器人 | US$0.039 | US$39 |
| 编程智能体 | US$1.63 | US$1,629 |
| 浏览器智能体 | US$1.15 | US$1,153 |
| 研究智能体 | US$1.04 | US$1,037 |
其他 Alibaba Cloud (Qwen) 模型
其他供应商的相近成本模型
在 30 步编码工作负载下,成本与此模型最接近的其他供应商模型。