Presyo at mga spec ng Qwen3.7-Flash API
Ang model na may pinakamababang presyo sa talahanayang ito, na may mga mode na may reasoning at walang reasoning, at context caching.
Tumataas ang presyo ayon sa haba ng prompt: triple ang rate kapag lampas 32K token, at tataas muli kapag lampas 256K, hanggang $0.165 bawat milyong input token at $0.66 bawat milyong output token.
Sinisingil ang mga prompt na lampas sa 32K token nang $0.083 para sa input, $0.017 para sa cached, at $0.33 para sa output kada milyon; ang mas mataas na rate ang ilalapat sa buong request.
Mga detalye
- Model string ng API
qwen3.7-flash- Provider
- Alibaba Cloud (Qwen)
- Context
- 1M token
- Pinakamaraming output
- 131K token
- Inilabas
- Hulyo 15, 2026
- Batch API
- 50% mas mura, may resulta sa loob ng ilang oras
- Mga dokumentadong feature para sa agent
- Pagtawag ng toolNaa-adjust na pangangatwiran
Magkano ang isang gawain
Apat na workload na sanggunian na kinuwenta gamit ang list rate ng modelong ito, kung saan inilalapat ang caching pagkatapos ng unang tawag. Magkakaiba ang mga numero mo; puwede mong baguhin ang bawat palagay sa calculator.
| Workload | Bawat gawain | Bawat 1,000 gawain |
|---|---|---|
| Bot para sa suporta | $0.001 | $1 |
| Coding agent 28 tawag sa rate para sa mahahabang prompt | $0.101 | $101 |
| Browser agent 18 tawag sa rate para sa mahahabang prompt | $0.060 | $60 |
| Research agent 12 tawag sa rate para sa mahahabang prompt | $0.054 | $54 |
Iba pang model ng Alibaba Cloud (Qwen)
Kahawig na halaga mula sa ibang provider
Mga model mula sa ibang provider na pinakamalapit ang halaga sa modelong ito para sa 30-step coding workload.