Alibaba Cloud (Qwen) · Spitzenmodell
Qwen3.8-Max: API-Preise und Spezifikationen
Das erste Open-Weight-Modell der Qwen-Max-Reihe mit Denk- und Nicht-Denkmodus sowie bis zu 262K Tokens für Reasoning.
1,65 $
0,21 $
4,95 $
Explizite Cache-Lesevorgänge kosten $0.137 pro Million Tokens, das Erstellen des Caches $2.063. In der Region Singapur kostet die Eingabe $2 und die Ausgabe $6. Batch-Preise gibt es nur in der Region Peking.
Datenblatt
- API-Modellname
qwen3.8-max- Anbieter
- Alibaba Cloud (Qwen)
- Kontext
- 1M Tokens
- Max. Output
- 131K Tokens
- Veröffentlicht
- 3. August 2026
- Batch API
- Kein Batch-Rabatt angegeben
- Dokumentierte Agent-Funktionen
- Tool-AufrufeStrukturierte AusgabeIntegrierte WebsucheAnpassbare SchlussfolgerungenBildeingabe
Was eine Aufgabe kostet
Vier typische Workloads, berechnet zu den Listenpreisen dieses Modells; Caching wird ab dem zweiten Aufruf berücksichtigt. Ihre Kosten können abweichen. Im Rechner können Sie alle Annahmen ändern.
| Workload | Pro Aufgabe | Pro 1.000 Aufgaben |
|---|---|---|
| Support-Bot | 0,039 $ | 39 $ |
| Coding-Agent | 1,63 $ | 1.629 $ |
| Browser-Agent | 1,15 $ | 1.153 $ |
| Recherche-Agent | 1,04 $ | 1.037 $ |
Weitere Alibaba Cloud (Qwen)-Modelle
Ähnliche Kosten bei anderen Anbietern
Modelle anderer Anbieter, deren Kosten für den 30-Schritte-Coding-Workload diesem Modell am nächsten kommen.