Harga dan spesifikasi API Qwen3.7-Flash
Model dengan harga terendah di tabel ini, dilengkapi mode penalaran dan tanpa penalaran, serta caching konteks.
Tarif meningkat seiring panjang prompt: di atas 32K token, tarifnya menjadi tiga kali lipat; di atas 256K token, tarifnya naik lagi menjadi $0.165 untuk input dan $0.66 untuk output per juta token.
Prompt yang melebihi 32K token dikenai tarif per juta sebesar US$0,083 untuk input, US$0,017 untuk token dalam cache, dan US$0,33 untuk output. Tarif yang lebih tinggi berlaku untuk seluruh permintaan.
Spesifikasi
- String model API
qwen3.7-flash- Penyedia
- Alibaba Cloud (Qwen)
- Konteks
- 1M token
- Output maksimum
- 131K token
- Dirilis
- 15 Juli 2026
- Batch API
- Diskon 50%, hasil tersedia dalam hitungan jam
- Fitur agent yang terdokumentasi
- Pemanggilan toolPenalaran yang dapat disesuaikan
Biaya tugas
Empat contoh beban kerja yang dihitung dengan harga daftar model ini, dengan cache diterapkan setelah panggilan pertama. Biaya Anda bisa berbeda; gunakan kalkulator untuk mengubah setiap asumsi.
| Beban kerja | Per tugas | Per 1.000 tugas |
|---|---|---|
| Bot dukungan | US$0,001 | US$1 |
| Agent coding 28 panggilan dengan tarif prompt panjang | US$0,101 | US$101 |
| Agent browser 18 panggilan dengan tarif prompt panjang | US$0,060 | US$60 |
| Agent riset 12 panggilan dengan tarif prompt panjang | US$0,054 | US$54 |
Model Alibaba Cloud (Qwen) lainnya
Biaya serupa dari penyedia lain
Model dari penyedia lain dengan biaya paling mendekati model ini untuk beban kerja coding 30 langkah.