dotsagent.io
ภาษา:ไทย
Alibaba Cloud (Qwen) · รุ่นเล็กและเร็ว

ราคาและข้อมูลจำเพาะ API ของ Qwen3.7-Flash

โมเดลราคาต่ำที่สุดในตารางนี้ รองรับโหมดคิดและไม่คิด รวมถึงการทำ context caching

อินพุต
⁨US$0.028⁩
อินพุตจากแคช
⁨US$0.006⁩
เอาต์พุต
⁨US$0.11⁩

ดอลลาร์สหรัฐต่อล้านโทเค็น สำหรับระดับมาตรฐานและอัตราสำหรับ prompt สั้น

ราคาจะเพิ่มตามความยาวของ prompt: เมื่อเกิน 32K tokens อัตราค่าบริการจะเพิ่มเป็นสามเท่า และเมื่อเกิน 256K จะเพิ่มอีกครั้งเป็นค่า input $0.165 และ output $0.66 ต่อล้าน tokens

Prompt ที่ยาวเกิน 32K tokens จะคิดราคาต่อหนึ่งล้าน tokens ที่ ⁨US$0.083⁩ สำหรับ input, ⁨US$0.017⁩ สำหรับ cached และ ⁨US$0.33⁩ สำหรับ output โดยใช้อัตราที่สูงกว่ากับคำขอทั้งหมด

ข้อมูลจำเพาะ

ชื่อโมเดลใน API
qwen3.7-flash
ผู้ให้บริการ
Alibaba Cloud (Qwen)
บริบท
1M tokens
Output สูงสุด
131K tokens
วันที่เปิดตัว
15 กรกฎาคม 2569
Batch API
ลด 50% รับผลลัพธ์ภายในไม่กี่ชั่วโมง
ฟีเจอร์สำหรับ agent ที่มีเอกสารระบุไว้
การเรียกใช้เครื่องมือปรับการใช้เหตุผลได้

ค่าใช้จ่ายของแต่ละงาน

ตัวอย่างงาน 4 แบบ คำนวณตามราคาปกติของโมเดลนี้ โดยเริ่มใช้แคชหลังการเรียกครั้งแรก ตัวเลขจริงของคุณอาจแตกต่างออกไป เครื่องคำนวณให้คุณเปลี่ยนสมมติฐานได้ทั้งหมด

งานต่องานต่อ 1,000 งาน
บอตฝ่ายสนับสนุน
4 calls, ค้นหาข้อมูลจาก tool แบบสั้น
⁨US$0.001⁩⁨US$1⁩
Coding agent
30 calls, ไฟล์และผลลัพธ์การทดสอบ
28 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว
⁨US$0.101⁩⁨US$101⁩
Browser agent
25 calls, ภาพหน้าจอและข้อความบนหน้าเว็บ
18 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว
⁨US$0.060⁩⁨US$60⁩
Research agent
15 calls, ผลการค้นหาที่ยาว
12 ครั้งที่เรียกใช้ในอัตราสำหรับ prompt ยาว
⁨US$0.054⁩⁨US$54⁩

เปลี่ยนสมมติฐาน

โมเดลอื่นของ Alibaba Cloud (Qwen)

โมเดลอื่นที่มีค่าใช้จ่ายใกล้เคียง

โมเดลจากผู้ให้บริการรายอื่นที่มีค่าใช้จ่ายใกล้เคียงกับโมเดลนี้มากที่สุด เมื่อใช้กับงานเขียนโค้ด 30 ขั้นตอน

แหล่งข้อมูล

  1. alibabacloud.com/help/en/model-studio/qwen3-7-flash
  2. help.aliyun.com/en/model-studio/model-pricing