dotsagent.io
Sprache:Deutsch
Alibaba Cloud (Qwen) · Spitzenmodell

Qwen3.8-Max: API-Preise und Spezifikationen

Das erste Open-Weight-Modell der Qwen-Max-Reihe mit Denk- und Nicht-Denkmodus sowie bis zu 262K Tokens für Reasoning.

Eingabe
⁨1,65 $⁩
Zwischengespeicherte Eingabe
⁨0,21 $⁩
Ausgabe
⁨4,95 $⁩

US-Dollar pro Million Token, Standardklasse, Preis für kurze Prompts

Explizite Cache-Lesevorgänge kosten $0.137 pro Million Tokens, das Erstellen des Caches $2.063. In der Region Singapur kostet die Eingabe $2 und die Ausgabe $6. Batch-Preise gibt es nur in der Region Peking.

Datenblatt

API-Modellname
qwen3.8-max
Anbieter
Alibaba Cloud (Qwen)
Kontext
1M Tokens
Max. Output
131K Tokens
Veröffentlicht
3. August 2026
Batch API
Kein Batch-Rabatt angegeben
Dokumentierte Agent-Funktionen
Tool-AufrufeStrukturierte AusgabeIntegrierte WebsucheAnpassbare SchlussfolgerungenBildeingabe

Was eine Aufgabe kostet

Vier typische Workloads, berechnet zu den Listenpreisen dieses Modells; Caching wird ab dem zweiten Aufruf berücksichtigt. Ihre Kosten können abweichen. Im Rechner können Sie alle Annahmen ändern.

WorkloadPro AufgabePro 1.000 Aufgaben
Support-Bot
4 Aufrufe, kurze Tool-Abfragen
⁨0,039 $⁩⁨39 $⁩
Coding-Agent
30 Aufrufe, Dateien und Testausgaben
⁨1,63 $⁩⁨1.629 $⁩
Browser-Agent
25 Aufrufe, Screenshots und Seitentext
⁨1,15 $⁩⁨1.153 $⁩
Recherche-Agent
15 Aufrufe, lange Suchergebnisse
⁨1,04 $⁩⁨1.037 $⁩

Annahmen ändern

Weitere Alibaba Cloud (Qwen)-Modelle

Ähnliche Kosten bei anderen Anbietern

Modelle anderer Anbieter, deren Kosten für den 30-Schritte-Coding-Workload diesem Modell am nächsten kommen.

Quellen

  1. alibabacloud.com/help/en/model-studio/qwen3-8-max
  2. alibabacloud.com/en/press-room/alibaba-unveils-qwen3-8-max
  3. qwen.ai/blog?id=qwen3.8