Qwen3.7-Flash: API-Preise und Spezifikationen
Das günstigste Modell in dieser Tabelle, mit Denk- und Nicht-Denkmodus sowie Kontext-Caching.
Der Preis steigt mit der Prompt-Länge: Bei mehr als 32K Tokens verdreifacht sich der Tarif, bei mehr als 256K steigt er erneut auf $0.165 pro Million Eingabe- und $0.66 pro Million Ausgabetokens.
Prompts mit mehr als 32K Tokens werden pro Million mit 0,083 $ für Input, 0,017 $ für gecachte Tokens und 0,33 $ für Output berechnet. Der höhere Preis gilt für die gesamte Anfrage.
Datenblatt
- API-Modellname
qwen3.7-flash- Anbieter
- Alibaba Cloud (Qwen)
- Kontext
- 1M Tokens
- Max. Output
- 131K Tokens
- Veröffentlicht
- 15. Juli 2026
- Batch API
- 50% Rabatt, Ergebnisse innerhalb weniger Stunden
- Dokumentierte Agent-Funktionen
- Tool-AufrufeAnpassbare Schlussfolgerungen
Was eine Aufgabe kostet
Vier typische Workloads, berechnet zu den Listenpreisen dieses Modells; Caching wird ab dem zweiten Aufruf berücksichtigt. Ihre Kosten können abweichen. Im Rechner können Sie alle Annahmen ändern.
| Workload | Pro Aufgabe | Pro 1.000 Aufgaben |
|---|---|---|
| Support-Bot | 0,001 $ | 1 $ |
| Coding-Agent 28 Aufrufe zum Preis für lange Prompts | 0,101 $ | 101 $ |
| Browser-Agent 18 Aufrufe zum Preis für lange Prompts | 0,060 $ | 60 $ |
| Recherche-Agent 12 Aufrufe zum Preis für lange Prompts | 0,054 $ | 54 $ |
Weitere Alibaba Cloud (Qwen)-Modelle
Ähnliche Kosten bei anderen Anbietern
Modelle anderer Anbieter, deren Kosten für den 30-Schritte-Coding-Workload diesem Modell am nächsten kommen.