Alibaba Cloud (Qwen) · Modèle phare
Tarifs et caractéristiques de l'API Qwen3.8-Max
Le premier modèle Qwen Max à poids ouverts, avec des modes avec ou sans raisonnement et jusqu'à 262K tokens de raisonnement.
1,65 $US
0,21 $US
4,95 $US
La lecture explicite du cache coûte $0.137 par million et sa création, $2.063. Dans la région de Singapour, le tarif est de $2 en entrée et de $6 en sortie. La tarification par lots est proposée uniquement dans la région de Pékin.
Fiche technique
- Identifiant du modèle dans l'API
qwen3.8-max- Fournisseur
- Alibaba Cloud (Qwen)
- Contexte
- 1M tokens
- Sortie maximale
- 131K tokens
- Date de sortie
- 3 août 2026
- Batch API
- Aucune réduction Batch indiquée
- Fonctionnalités d'agent documentées
- Appel d'outilsSortie structuréeRecherche web intégréeRaisonnement ajustableEntrée d'images
Coût d'une tâche
Quatre charges de référence, tarifées selon les prix catalogue de ce modèle, avec mise en cache à partir du deuxième appel. Vos chiffres varieront ; le calculateur vous permet de modifier chaque hypothèse.
| Charge de travail | Par tâche | Pour 1 000 tâches |
|---|---|---|
| Bot d’assistance | 0,039 $US | 39 $US |
| Agent de programmation | 1,63 $US | 1 629 $US |
| Agent de navigation | 1,15 $US | 1 153 $US |
| Agent de recherche | 1,04 $US | 1 037 $US |
Autres modèles Alibaba Cloud (Qwen)
Coût comparable chez d'autres fournisseurs
Modèles d'autres fournisseurs dont le coût pour la charge de travail de codage en 30 étapes est le plus proche de celui-ci.