dotsagent.io
Langue:Français
Alibaba Cloud (Qwen) · Modèle phare

Tarifs et caractéristiques de l'API Qwen3.8-Max

Le premier modèle Qwen Max à poids ouverts, avec des modes avec ou sans raisonnement et jusqu'à 262K tokens de raisonnement.

Entrée
⁨1,65 $US⁩
Entrée mise en cache
⁨0,21 $US⁩
Sortie
⁨4,95 $US⁩

Dollars US par million de tokens, catégorie standard, tarif pour les prompts courts

La lecture explicite du cache coûte $0.137 par million et sa création, $2.063. Dans la région de Singapour, le tarif est de $2 en entrée et de $6 en sortie. La tarification par lots est proposée uniquement dans la région de Pékin.

Fiche technique

Identifiant du modèle dans l'API
qwen3.8-max
Fournisseur
Alibaba Cloud (Qwen)
Contexte
1M tokens
Sortie maximale
131K tokens
Date de sortie
3 août 2026
Batch API
Aucune réduction Batch indiquée
Fonctionnalités d'agent documentées
Appel d'outilsSortie structuréeRecherche web intégréeRaisonnement ajustableEntrée d'images

Coût d'une tâche

Quatre charges de référence, tarifées selon les prix catalogue de ce modèle, avec mise en cache à partir du deuxième appel. Vos chiffres varieront ; le calculateur vous permet de modifier chaque hypothèse.

Charge de travailPar tâchePour 1 000 tâches
Bot d’assistance
4 appels, recherches rapides avec des outils
⁨0,039 $US⁩⁨39 $US⁩
Agent de programmation
30 appels, fichiers et résultats de tests
⁨1,63 $US⁩⁨1 629 $US⁩
Agent de navigation
25 appels, captures d’écran et texte des pages
⁨1,15 $US⁩⁨1 153 $US⁩
Agent de recherche
15 appels, longs résultats de recherche
⁨1,04 $US⁩⁨1 037 $US⁩

Modifier les hypothèses

Autres modèles Alibaba Cloud (Qwen)

Coût comparable chez d'autres fournisseurs

Modèles d'autres fournisseurs dont le coût pour la charge de travail de codage en 30 étapes est le plus proche de celui-ci.

Sources

  1. alibabacloud.com/help/en/model-studio/qwen3-8-max
  2. alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  3. qwen.ai/blog?id=qwen3.8