Tarifs et caractéristiques de l'API DeepSeek-V4.1-Flash
Le dernier modèle de DeepSeek, qui, selon l’entreprise, dépasse V4-Pro en qualité, en vitesse et en prix, et accepte les formats de requête OpenAI et Anthropic.
Les anciens noms deepseek-v4-flash et deepseek-v4-flash-vision-exp redirigent désormais vers ce modèle. Les accès au cache coûtent $0.006 par million de tokens aux heures de pointe, et moitié moins en heures creuses.
DeepSeek applique un tarif réduit de moitié en heures creuses. En semaine, les heures de pointe sont de 01:00 à 04:00 et de 06:00 à 10:00 UTC ; toutes les autres heures, week-ends compris, sont des heures creuses. Le tableau indique les tarifs de pointe.
Fiche technique
- Identifiant du modèle dans l'API
deepseek-flash- Fournisseur
- DeepSeek
- Contexte
- 1M tokens
- Sortie maximale
- 384K tokens
- Date de sortie
- 10 septembre 2026
- Batch API
- Aucune réduction Batch indiquée
- Fonctionnalités d'agent documentées
- Appel d'outilsSortie structuréeRaisonnement ajustableEntrée d'images
Coût d'une tâche
Quatre charges de référence, tarifées selon les prix catalogue de ce modèle, avec mise en cache à partir du deuxième appel. Vos chiffres varieront ; le calculateur vous permet de modifier chaque hypothèse.
| Charge de travail | Par tâche | Pour 1 000 tâches |
|---|---|---|
| Bot d’assistance | 0,007 $US | 7 $US |
| Agent de programmation | 0,218 $US | 218 $US |
| Agent de navigation | 0,186 $US | 186 $US |
| Agent de recherche | 0,180 $US | 180 $US |
Autres modèles DeepSeek
Coût comparable chez d'autres fournisseurs
Modèles d'autres fournisseurs dont le coût pour la charge de travail de codage en 30 étapes est le plus proche de celui-ci.