Tarifs et caractéristiques de l'API Qwen3.7-Flash
Le modèle le moins cher de ce tableau, avec des modes avec ou sans raisonnement et la mise en cache du contexte.
Le tarif augmente avec la longueur du prompt : au-delà de 32K tokens, il triple, puis augmente à nouveau au-delà de 256K, pour atteindre $0.165 en entrée et $0.66 en sortie par million.
Les prompts de plus de 32K tokens sont facturés 0,083 $US par million de tokens en entrée, 0,017 $US en entrée mis en cache et 0,33 $US en sortie. Le tarif supérieur s'applique à l'ensemble de la requête.
Fiche technique
- Identifiant du modèle dans l'API
qwen3.7-flash- Fournisseur
- Alibaba Cloud (Qwen)
- Contexte
- 1M tokens
- Sortie maximale
- 131K tokens
- Date de sortie
- 15 juillet 2026
- Batch API
- 50 % de réduction, résultats sous quelques heures
- Fonctionnalités d'agent documentées
- Appel d'outilsRaisonnement ajustable
Coût d'une tâche
Quatre charges de référence, tarifées selon les prix catalogue de ce modèle, avec mise en cache à partir du deuxième appel. Vos chiffres varieront ; le calculateur vous permet de modifier chaque hypothèse.
| Charge de travail | Par tâche | Pour 1 000 tâches |
|---|---|---|
| Bot d’assistance | 0,001 $US | 1 $US |
| Agent de programmation 28 appels au tarif des prompts longs | 0,101 $US | 101 $US |
| Agent de navigation 18 appels au tarif des prompts longs | 0,060 $US | 60 $US |
| Agent de recherche 12 appels au tarif des prompts longs | 0,054 $US | 54 $US |
Autres modèles Alibaba Cloud (Qwen)
Coût comparable chez d'autres fournisseurs
Modèles d'autres fournisseurs dont le coût pour la charge de travail de codage en 30 étapes est le plus proche de celui-ci.