dotsagent.io
언어:한국어
Alibaba Cloud (Qwen) · 작고 빠른 모델

Qwen3.7-Flash API 가격 및 사양

이 요금표에서 가장 저렴한 모델로, 사고 모드와 비사고 모드 및 컨텍스트 캐싱을 지원합니다.

입력
⁨US$0.028⁩
캐시된 입력
⁨US$0.006⁩
출력
⁨US$0.11⁩

표준 등급, 짧은 프롬프트 기준, 토큰 100만 개당 미국 달러

프롬프트 길이에 따라 요금이 단계적으로 올라갑니다. 32K 토큰을 초과하면 요금이 3배가 되고, 256K를 초과하면 입력 토큰 100만 개당 $0.165, 출력 토큰 100만 개당 $0.66으로 다시 인상됩니다.

32K 토큰을 초과하는 프롬프트에는 입력 토큰 100만 개당 ⁨US$0.083⁩, 캐시된 토큰 100만 개당 ⁨US$0.017⁩, 출력 토큰 100만 개당 ⁨US$0.33⁩이 청구되며, 더 높은 요금이 요청 전체에 적용됩니다.

사양

API 모델 문자열
qwen3.7-flash
제공업체
Alibaba Cloud (Qwen)
컨텍스트
1M 토큰
최대 출력
131K 토큰
출시일
2026년 7월 15일
Batch API
50% 할인, 몇 시간 내 결과 제공
문서에 명시된 에이전트 기능
도구 호출추론 수준 조정

작업 비용

이 모델의 정가를 기준으로 산정한 네 가지 참고 워크로드입니다. 첫 호출 이후에는 캐싱이 적용됩니다. 실제 비용은 다를 수 있습니다. 계산기에서 모든 가정을 변경할 수 있습니다.

워크로드작업당작업 1,000건당
고객 지원 봇
4회 호출, 짧은 도구 조회
⁨US$0.001⁩⁨US$1⁩
코딩 에이전트
30회 호출, 파일 및 테스트 출력
긴 프롬프트 요금이 적용되는 호출 28회
⁨US$0.101⁩⁨US$101⁩
브라우저 에이전트
25회 호출, 스크린샷 및 페이지 텍스트
긴 프롬프트 요금이 적용되는 호출 18회
⁨US$0.060⁩⁨US$60⁩
리서치 에이전트
15회 호출, 긴 검색 결과
긴 프롬프트 요금이 적용되는 호출 12회
⁨US$0.054⁩⁨US$54⁩

가정 변경

다른 Alibaba Cloud (Qwen) 모델

다른 곳의 비슷한 비용

30단계 코딩 워크로드의 비용이 이 모델과 가장 비슷한 다른 제공업체의 모델입니다.

출처

  1. alibabacloud.com/help/en/model-studio/qwen3-7-flash
  2. help.aliyun.com/en/model-studio/model-pricing