dotsagent.io
Ngôn ngữ:Tiếng Việt
Alibaba Cloud (Qwen) · Nhỏ và nhanh

Giá API và thông số của Qwen3.7-Flash

Mô hình có giá thấp nhất trong bảng này, hỗ trợ chế độ suy luận và không suy luận, cùng tính năng cache ngữ cảnh.

Đầu vào
⁨0,028 US$⁩
Đầu vào đã lưu trong cache
⁨0,006 US$⁩
Đầu ra
⁨0,11 US$⁩

Đô la Mỹ trên mỗi triệu token, phân khúc tiêu chuẩn, mức giá cho prompt ngắn

Giá tăng theo độ dài prompt: trên 32K token, mức giá tăng gấp ba; trên 256K, giá tăng tiếp lên $0.165 cho input và $0.66 cho output mỗi triệu token.

Prompt dài hơn 32K token được tính phí mỗi triệu token với mức ⁨0,083 US$⁩ cho đầu vào, ⁨0,017 US$⁩ cho token được cache và ⁨0,33 US$⁩ cho đầu ra; mức giá cao hơn áp dụng cho toàn bộ yêu cầu.

Thông số kỹ thuật

Tên model trong API
qwen3.7-flash
Nhà cung cấp
Alibaba Cloud (Qwen)
Ngữ cảnh
1M token
Đầu ra tối đa
131K token
Ngày phát hành
15 tháng 7, 2026
Batch API
Giảm 50%, có kết quả trong vài giờ
Tính năng agent được tài liệu ghi nhận
Gọi toolĐiều chỉnh khả năng suy luận

Chi phí cho mỗi tác vụ

Bốn khối lượng công việc tham chiếu được tính theo giá niêm yết của model này; áp dụng cache sau lần gọi đầu tiên. Chi phí thực tế của bạn sẽ khác; bạn có thể thay đổi mọi giả định trong máy tính.

Khối lượng công việcMỗi tác vụMỗi 1.000 tác vụ
Bot hỗ trợ
4 lần gọi, tra cứu tool ngắn
⁨0,001 US$⁩⁨1 US$⁩
Agent lập trình
30 lần gọi, tệp và kết quả kiểm thử
28 lần gọi theo mức giá prompt dài
⁨0,101 US$⁩⁨101 US$⁩
Agent trình duyệt
25 lần gọi, ảnh chụp màn hình và văn bản trang
18 lần gọi theo mức giá prompt dài
⁨0,060 US$⁩⁨60 US$⁩
Agent nghiên cứu
15 lần gọi, kết quả tìm kiếm dài
12 lần gọi theo mức giá prompt dài
⁨0,054 US$⁩⁨54 US$⁩

Thay đổi các giả định

Các model Alibaba Cloud (Qwen) khác

Chi phí tương tự ở nhà cung cấp khác

Các model từ nhà cung cấp khác có chi phí gần nhất với model này khi chạy khối lượng công việc lập trình gồm 30 bước.

Nguồn

  1. alibabacloud.com/help/en/model-studio/qwen3-7-flash
  2. help.aliyun.com/en/model-studio/model-pricing