Alibaba Cloud (Qwen) · รุ่นเล็กและเร็ว
ราคาและข้อมูลจำเพาะ API ของ Qwen3.7-Flash
โมเดลราคาต่ำที่สุดในตารางนี้ รองรับโหมดคิดและไม่คิด รวมถึงการทำ context caching
US$0.028
US$0.006
US$0.11
ราคาจะเพิ่มตามความยาวของ prompt: เมื่อเกิน 32K tokens อัตราค่าบริการจะเพิ่มเป็นสามเท่า และเมื่อเกิน 256K จะเพิ่มอีกครั้งเป็นค่า input $0.165 และ output $0.66 ต่อล้าน tokens
Prompt ที่ยาวเกิน 32K tokens จะคิดราคาต่อหนึ่งล้าน tokens ที่ US$0.083 สำหรับ input, US$0.017 สำหรับ cached และ US$0.33 สำหรับ output โดยใช้อัตราที่สูงกว่ากับคำขอทั้งหมด
ข้อมูลจำเพาะ
- ชื่อโมเดลใน API
qwen3.7-flash- ผู้ให้บริการ
- Alibaba Cloud (Qwen)
- บริบท
- 1M tokens
- Output สูงสุด
- 131K tokens
- วันที่เปิดตัว
- 15 กรกฎาคม 2569
- Batch API
- ลด 50% รับผลลัพธ์ภายในไม่กี่ชั่วโมง
- ฟีเจอร์สำหรับ agent ที่มีเอกสารระบุไว้
- การเรียกใช้เครื่องมือปรับการใช้เหตุผลได้
ค่าใช้จ่ายของแต่ละงาน
ตัวอย่างงาน 4 แบบ คำนวณตามราคาปกติของโมเดลนี้ โดยเริ่มใช้แคชหลังการเรียกครั้งแรก ตัวเลขจริงของคุณอาจแตกต่างออกไป เครื่องคำนวณให้คุณเปลี่ยนสมมติฐานได้ทั้งหมด
| งาน | ต่องาน | ต่อ 1,000 งาน |
|---|---|---|
| บอตฝ่ายสนับสนุน | US$0.001 | US$1 |
| Coding agent 28 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว | US$0.101 | US$101 |
| Browser agent 18 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว | US$0.060 | US$60 |
| Research agent 12 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว | US$0.054 | US$54 |
โมเดลอื่นของ Alibaba Cloud (Qwen)
โมเดลอื่นที่มีค่าใช้จ่ายใกล้เคียง
โมเดลจากผู้ให้บริการรายอื่นที่มีค่าใช้จ่ายใกล้เคียงกับโมเดลนี้มากที่สุด เมื่อใช้กับงานเขียนโค้ด 30 ขั้นตอน