dotsagent.io
ภาษา:ไทย
สร้าง · เครื่องมือ

เครื่องคำนวณค่าใช้จ่าย agent

agent ทำงานเป็นลูป โดยแต่ละ call จะส่งข้อมูลทั้งหมดที่มีจนถึงตอนนั้น พร้อมผลลัพธ์จาก tool ล่าสุดไปอีกครั้ง อธิบายลูปนั้นเพียงครั้งเดียว แล้วดูค่าใช้จ่ายของงานหนึ่งงานและงานตลอดหนึ่งเดือนบนทุกโมเดลในตารางราคาของเรา

เริ่มจากรูปแบบงาน

อ่านไฟล์ แก้ไขโค้ด และรันทดสอบใน repository ใช้ system prompt ขนาดใหญ่พร้อม schema ของ tool และแต่ละขั้นตอนจะเพิ่มไฟล์หรือ log การทดสอบเข้ามา

งานหนึ่งรายการส่งโทเค็นขาเข้า 3,360,000 โทเค็น และได้รับโทเค็นขาออก 36,000 โทเค็น โดย prompt ที่ยาวที่สุดมี 199,000 โทเค็น

ค่าใช้จ่ายโดยประมาณต่องานและต่อเดือนสำหรับแต่ละโมเดล
โมเดลต่องาน30 วัน วันละ 50 งาน
GPT-6 Luna · OpenAI⁨US$0.099⁩⁨US$148⁩
Qwen3.7-Flash · Alibaba Cloud (Qwen)28 ครั้ง คิดอัตราสำหรับ prompt ยาว⁨US$0.101⁩⁨US$152⁩
GLM-5.3-Flash · Z.ai (Zhipu)⁨US$0.182⁩⁨US$273⁩
DeepSeek-V4.1-Flash · DeepSeek⁨US$0.218⁩⁨US$327⁩
Gemini 3.5 Flash-Lite · Google⁨US$0.333⁩⁨US$499⁩
Qwen3.7-Plus · Alibaba Cloud (Qwen)⁨US$0.343⁩⁨US$515⁩
Mistral Small 4 · Mistral AI⁨US$0.526⁩⁨US$788⁩
Gemini 3.8 Flash · Google⁨US$0.742⁩⁨US$1,112⁩
DeepSeek-V4-Pro-0813 · DeepSeek⁨US$0.961⁩⁨US$1,441⁩
Claude Haiku 4.5 · Anthropic⁨US$0.989⁩⁨US$1,483⁩
Amazon Nova 2 Lite · Amazonราคาจากบุคคลที่สาม⁨US$1.10⁩⁨US$1,647⁩
Grok Build 0.1 · xAI⁨US$1.16⁩⁨US$1,746⁩
Muse Spark 1.3 · Meta⁨US$1.23⁩⁨US$1,852⁩
Grok 4.3 · xAI⁨US$1.31⁩⁨US$1,970⁩
Gemini 3.5 Flash · Google⁨US$1.54⁩⁨US$2,306⁩
Qwen3.8-Max · Alibaba Cloud (Qwen)⁨US$1.63⁩⁨US$2,443⁩
GLM-5.3 · Z.ai (Zhipu)⁨US$1.63⁩⁨US$2,446⁩
GPT-6.1 Sol · OpenAI⁨US$1.69⁩⁨US$2,541⁩
Claude Sonnet 5.5 · Anthropic⁨US$1.98⁩⁨US$2,966⁩
Gemini 3.1 Pro Preview · Google⁨US$2.05⁩⁨US$3,074⁩
Grok 4.7 · xAI⁨US$2.68⁩⁨US$4,026⁩
Kimi K3 · Moonshot AI (Kimi)⁨US$2.97⁩⁨US$4,449⁩
Claude Opus 5.5 · Anthropic⁨US$3.39⁩⁨US$5,082⁩
Amazon Nova 2 Pro · Amazonราคาจากบุคคลที่สาม⁨US$4.56⁩⁨US$6,840⁩
Mistral Medium 3.5 · Mistral AI⁨US$5.31⁩⁨US$7,965⁩
Claude Fable 5.1 · Anthropic⁨US$7.76⁩⁨US$11,642⁩
Command A+ · Cohereเกินขนาดหน้าต่างบริบทราคาจากบุคคลที่สาม⁨US$8.76⁩⁨US$13,140⁩
GPT-6 Astra · OpenAI⁨US$9.89⁩⁨US$14,831⁩

ราคาประกาศ แพ็กเกจมาตรฐาน หน่วยเป็นดอลลาร์สหรัฐ ไม่รวมค่าเขียนแคช ภาษี ค่าบริการเครื่องมือ เช่น การค้นหาเว็บ และค่าธรรมเนียมเพิ่มเติมตามภูมิภาค

วิธีคำนวณ

สำหรับแต่ละครั้งที่เรียกในลูป เราใช้ขนาดของ prompt ซึ่งประกอบด้วย prompt แรกบวกกับส่วนที่เพิ่มขึ้นจากทุกขั้นตอนก่อนหน้า แล้วแบ่งเป็นส่วนที่ใช้แคชและส่วนใหม่ ครั้งแรกจะเป็นข้อมูลใหม่ทั้งหมดเสมอ โทเค็นใหม่คิดตามอัตราขาเข้า โทเค็นที่ใช้แคชคิดตามอัตราแคช และโทเค็นขาออกคิดตามอัตราขาออก

หาก prompt ครั้งใดเกินเกณฑ์บริบทยาวของผู้ให้บริการ การเรียกครั้งนั้นทั้งหมดจะคิดตามอัตราสำหรับ prompt ยาว เช่นเดียวกับที่ OpenAI, Google, xAI และ Qwen ทำ หาก prompt ที่ยาวที่สุดเกินหน้าต่างบริบทของโมเดล เราจะแสดงหมายเหตุไว้ เพราะ agent จริงต้องตัดหรือสรุปประวัติก่อน

งานจริงของ agent แตกต่างกันไปในแต่ละครั้ง อาจลองทำขั้นตอนที่ล้มเหลวซ้ำ และบางครั้งก็หยุดก่อน Treat ตัวเลขเหล่านี้เป็นแนวทางสำหรับเปรียบเทียบโมเดลภายใต้ภาระงานเดียวกัน จากนั้นตรวจวัดจำนวนโทเค็นจริงจาก trace ของคุณเองก่อนวางงบประมาณ

คำถามเกี่ยวกับค่าใช้จ่ายของ agent

AI agent ใช้โทเค็นกี่โทเค็นต่องาน?

ส่วนใหญ่ขึ้นอยู่กับจำนวนขั้นตอนและปริมาณที่แต่ละขั้นตอนเพิ่มเข้ามา การสนทนาสั้น ๆ เพื่อขอความช่วยเหลืออาจใช้โทเค็นขาเข้า 30K ส่วนงานเขียนโค้ด 30 ขั้นตอนที่เริ่มด้วย prompt 25K โทเค็นจะส่งข้อมูลมากกว่าสามล้านโทเค็น เพราะมีการส่งประวัติทั้งหมดซ้ำทุกครั้งที่เรียก

จะลดค่าใช้จ่ายของ agent ได้อย่างไร?

ทำให้ส่วนต้นของ prompt เหมือนเดิมในทุกการเรียกเพื่อให้ใช้แคช ตัดผลลัพธ์จากเครื่องมือให้เหลือเฉพาะที่โมเดลต้องใช้ สรุปหรือลบข้อความเก่า ใช้โมเดลขนาดเล็กสำหรับขั้นตอนทั่วไปและใช้โมเดลขนาดใหญ่เฉพาะตอนวางแผน รวมถึงลดระดับการใช้เหตุผลเมื่อคุณภาพยังยอมรับได้

การแคช prompt ทำงานโดยอัตโนมัติหรือไม่?

สำหรับการแคชโดยนัยของ OpenAI, DeepSeek, Kimi และ Gemini จะทำงานโดยอัตโนมัติเมื่อ prompt ใช้คำนำหน้ายาวร่วมกัน ส่วน Anthropic และ endpoint บางแห่งของ Qwen ต้องใช้เครื่องหมายแคชอย่างชัดเจน และ Anthropic คิดค่าบริการเพิ่มสำหรับการเขียนแคชครั้งแรก

ทำไมโมเดลที่มีราคาต่อโทเค็นถูกที่สุดจึงไม่ใช่โมเดลที่ถูกที่สุดต่องาน?

ส่วนลดแคชแตกต่างกันไปตามโมเดล ผู้ให้บริการบางรายคิดอัตราสูงขึ้นสำหรับ prompt ยาว และโมเดลที่ใช้เหตุผลจะใช้โทเค็นขาออกไปกับการคิด โมเดลที่ใช้ขั้นตอนน้อยกว่าหรือต้องลองซ้ำน้อยกว่าอาจมีค่าใช้จ่ายต่ำกว่าได้เช่นกัน ซึ่งเครื่องคำนวณนี้ไม่สามารถประเมินได้