Qwen3.7-Flash API-prijzen en specificaties
Het goedkoopste model in deze tabel, met denk- en niet-denkmodus en contextcaching.
De prijs stijgt met de promptlengte: boven 32K tokens verdrievoudigt het tarief en boven 256K stijgt het opnieuw, naar $0.165 voor input en $0.66 voor output per miljoen tokens.
Prompts van meer dan 32K tokens kosten per miljoen US$ 0,083 voor invoer, US$ 0,017 voor gecachte tokens en US$ 0,33 voor uitvoer. Het hogere tarief geldt voor het hele verzoek.
Specificaties
- API-modelnaam
qwen3.7-flash- Provider
- Alibaba Cloud (Qwen)
- Context
- 1M tokens
- Maximale uitvoer
- 131K tokens
- Uitgebracht
- 15 juli 2026
- Batch API
- 50% korting, resultaten binnen enkele uren
- Gedocumenteerde agentfuncties
- Tools aanroepenInstelbaar redeneren
Wat kost een taak?
Vier voorbeeldtaken, berekend met de catalogusprijzen van dit model. Caching wordt toegepast vanaf de tweede aanroep. Jouw cijfers kunnen afwijken; met de calculator kun je alle aannames aanpassen.
| Taak | Per taak | Per 1.000 taken |
|---|---|---|
| Supportbot | US$ 0,001 | US$ 1 |
| Codeeragent 28 aanroepen tegen het tarief voor lange prompts | US$ 0,101 | US$ 101 |
| Browseragent 18 aanroepen tegen het tarief voor lange prompts | US$ 0,060 | US$ 60 |
| Onderzoeksagent 12 aanroepen tegen het tarief voor lange prompts | US$ 0,054 | US$ 54 |
Andere modellen van Alibaba Cloud (Qwen)
Vergelijkbare kosten bij andere aanbieders
Modellen van andere aanbieders met de kosten die het dichtst in de buurt komen van die van dit model voor de programmeertaak van 30 stappen.