dotsagent.io
语言:简体中文

Qwen3.8-Max API 定价与规格

首款开放权重的 Qwen Max 模型,支持思考和非思考模式,推理长度最高可达 262K tokens。

输入
⁨US$1.65⁩
缓存输入
⁨US$0.21⁩
输出
⁨US$4.95⁩

每百万 token 的美元价格;标准级别、短 prompt 费率

显式缓存读取每百万收费 $0.137,缓存创建收费 $2.063。新加坡区域的输入价格为 $2,输出价格为 $6。批量定价仅适用于北京区域。

规格表

API 模型标识
qwen3.8-max
提供商
Alibaba Cloud (Qwen)
上下文
1M token
最大输出
131K token
发布时间
2026年8月3日
Batch API
未列出批处理折扣
已文档化的智能体功能
工具调用结构化输出内置网页搜索可调节推理图像输入

任务成本

以下是按此模型标价计算的四种参考工作负载,缓存从首次调用后开始应用。实际费用会有所不同;你可以在计算器中调整所有假设。

工作负载每项任务每 1,000 项任务
客服机器人
4 次调用,简短的工具查询
⁨US$0.039⁩⁨US$39⁩
编程智能体
30 次调用,文件和测试输出
⁨US$1.63⁩⁨US$1,629⁩
浏览器智能体
25 次调用,截图和网页文本
⁨US$1.15⁩⁨US$1,153⁩
研究智能体
15 次调用,较长的搜索结果
⁨US$1.04⁩⁨US$1,037⁩

更改假设

其他 Alibaba Cloud (Qwen) 模型

其他供应商的相近成本模型

在 30 步编码工作负载下,成本与此模型最接近的其他供应商模型。

来源

  1. alibabacloud.com/help/en/model-studio/qwen3-8-max
  2. alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  3. qwen.ai/blog?id=qwen3.8

为 AI agent 开发者提供的独立参考资料。与此处提及的任何厂商均无关联。

© 2026 DotsAgent · 事实核查日期:2026年10月1日