dotsagent.io
Sprache:Deutsch
Alibaba Cloud (Qwen) · Klein und schnell

Qwen3.7-Flash: API-Preise und Spezifikationen

Das günstigste Modell in dieser Tabelle, mit Denk- und Nicht-Denkmodus sowie Kontext-Caching.

Eingabe
⁨0,028 $⁩
Zwischengespeicherte Eingabe
⁨0,006 $⁩
Ausgabe
⁨0,11 $⁩

US-Dollar pro Million Token, Standardklasse, Preis für kurze Prompts

Der Preis steigt mit der Prompt-Länge: Bei mehr als 32K Tokens verdreifacht sich der Tarif, bei mehr als 256K steigt er erneut auf $0.165 pro Million Eingabe- und $0.66 pro Million Ausgabetokens.

Prompts mit mehr als 32K Tokens werden pro Million mit ⁨0,083 $⁩ für Input, ⁨0,017 $⁩ für gecachte Tokens und ⁨0,33 $⁩ für Output berechnet. Der höhere Preis gilt für die gesamte Anfrage.

Datenblatt

API-Modellname
qwen3.7-flash
Anbieter
Alibaba Cloud (Qwen)
Kontext
1M Tokens
Max. Output
131K Tokens
Veröffentlicht
15. Juli 2026
Batch API
50% Rabatt, Ergebnisse innerhalb weniger Stunden
Dokumentierte Agent-Funktionen
Tool-AufrufeAnpassbare Schlussfolgerungen

Was eine Aufgabe kostet

Vier typische Workloads, berechnet zu den Listenpreisen dieses Modells; Caching wird ab dem zweiten Aufruf berücksichtigt. Ihre Kosten können abweichen. Im Rechner können Sie alle Annahmen ändern.

WorkloadPro AufgabePro 1.000 Aufgaben
Support-Bot
4 Aufrufe, kurze Tool-Abfragen
⁨0,001 $⁩⁨1 $⁩
Coding-Agent
30 Aufrufe, Dateien und Testausgaben
28 Aufrufe zum Preis für lange Prompts
⁨0,101 $⁩⁨101 $⁩
Browser-Agent
25 Aufrufe, Screenshots und Seitentext
18 Aufrufe zum Preis für lange Prompts
⁨0,060 $⁩⁨60 $⁩
Recherche-Agent
15 Aufrufe, lange Suchergebnisse
12 Aufrufe zum Preis für lange Prompts
⁨0,054 $⁩⁨54 $⁩

Annahmen ändern

Weitere Alibaba Cloud (Qwen)-Modelle

Ähnliche Kosten bei anderen Anbietern

Modelle anderer Anbieter, deren Kosten für den 30-Schritte-Coding-Workload diesem Modell am nächsten kommen.

Quellen

  1. alibabacloud.com/help/en/model-studio/qwen3-7-flash
  2. help.aliyun.com/en/model-studio/model-pricing