dotsagent.io
Bahasa:Bahasa Indonesia

Harga dan spesifikasi API Qwen3.8-Max

Model Qwen Max pertama dengan bobot terbuka, dilengkapi mode penalaran dan tanpa penalaran, serta kemampuan penalaran hingga 262K token.

Input
⁨US$1,65⁩
Input yang di-cache
⁨US$0,21⁩
Output
⁨US$4,95⁩

Dolar AS per satu juta token, kelas standar, tarif prompt pendek

Pembacaan cache eksplisit dikenai biaya $0.137 per juta token, sedangkan pembuatan cache dikenai biaya $2.063. Wilayah Singapura mengenakan biaya $2 untuk input dan $6 untuk output. Harga batch hanya tersedia di wilayah Beijing.

Spesifikasi

String model API
qwen3.8-max
Penyedia
Alibaba Cloud (Qwen)
Konteks
1M token
Output maksimum
131K token
Dirilis
3 Agustus 2026
Batch API
Tidak ada diskon batch yang tercantum
Fitur agent yang terdokumentasi
Pemanggilan toolOutput terstrukturPenelusuran web bawaanPenalaran yang dapat disesuaikanInput gambar

Biaya tugas

Empat contoh beban kerja yang dihitung dengan harga daftar model ini, dengan cache diterapkan setelah panggilan pertama. Biaya Anda bisa berbeda; gunakan kalkulator untuk mengubah setiap asumsi.

Beban kerjaPer tugasPer 1.000 tugas
Bot dukungan
4 panggilan, pencarian tool singkat
⁨US$0,039⁩⁨US$39⁩
Agent coding
30 panggilan, file dan output tes
⁨US$1,63⁩⁨US$1.629⁩
Agent browser
25 panggilan, screenshot dan teks halaman
⁨US$1,15⁩⁨US$1.153⁩
Agent riset
15 panggilan, hasil pencarian panjang
⁨US$1,04⁩⁨US$1.037⁩

Ubah asumsi

Model Alibaba Cloud (Qwen) lainnya

Biaya serupa dari penyedia lain

Model dari penyedia lain dengan biaya paling mendekati model ini untuk beban kerja coding 30 langkah.

Sumber

  1. alibabacloud.com/help/en/model-studio/qwen3-8-max
  2. alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  3. qwen.ai/blog?id=qwen3.8

Referensi independen bagi mereka yang membangun agen AI. Tidak berafiliasi dengan vendor mana pun yang disebutkan di sini.

© 2026 DotsAgent · Fakta diperiksa 1 Oktober 2026