เครื่องคำนวณค่าใช้จ่าย agent
agent ทำงานเป็นลูป โดยแต่ละ call จะส่งข้อมูลทั้งหมดที่มีจนถึงตอนนั้น พร้อมผลลัพธ์จาก tool ล่าสุดไปอีกครั้ง อธิบายลูปนั้นเพียงครั้งเดียว แล้วดูค่าใช้จ่ายของงานหนึ่งงานและงานตลอดหนึ่งเดือนบนทุกโมเดลในตารางราคาของเรา
| โมเดล | ต่องาน | 30 วัน วันละ 50 งาน |
|---|---|---|
| GPT-6 Luna | US$0.099 | US$148 |
| Qwen3.7-Flash28 ครั้ง คิดอัตราสำหรับ prompt ยาว | US$0.101 | US$152 |
| GLM-5.3-Flash | US$0.182 | US$273 |
| DeepSeek-V4.1-Flash | US$0.218 | US$327 |
| Gemini 3.5 Flash-Lite | US$0.333 | US$499 |
| Qwen3.7-Plus | US$0.343 | US$515 |
| Mistral Small 4 | US$0.526 | US$788 |
| Gemini 3.8 Flash | US$0.742 | US$1,112 |
| DeepSeek-V4-Pro-0813 | US$0.961 | US$1,441 |
| Claude Haiku 4.5 | US$0.989 | US$1,483 |
| Amazon Nova 2 Liteราคาจากบุคคลที่สาม | US$1.10 | US$1,647 |
| Grok Build 0.1 | US$1.16 | US$1,746 |
| Muse Spark 1.3 | US$1.23 | US$1,852 |
| Grok 4.3 | US$1.31 | US$1,970 |
| Gemini 3.5 Flash | US$1.54 | US$2,306 |
| Qwen3.8-Max | US$1.63 | US$2,443 |
| GLM-5.3 | US$1.63 | US$2,446 |
| GPT-6.1 Sol | US$1.69 | US$2,541 |
| Claude Sonnet 5.5 | US$1.98 | US$2,966 |
| Gemini 3.1 Pro Preview | US$2.05 | US$3,074 |
| Grok 4.7 | US$2.68 | US$4,026 |
| Kimi K3 | US$2.97 | US$4,449 |
| Claude Opus 5.5 | US$3.39 | US$5,082 |
| Amazon Nova 2 Proราคาจากบุคคลที่สาม | US$4.56 | US$6,840 |
| Mistral Medium 3.5 | US$5.31 | US$7,965 |
| Claude Fable 5.1 | US$7.76 | US$11,642 |
| Command A+เกินขนาดหน้าต่างบริบทราคาจากบุคคลที่สาม | US$8.76 | US$13,140 |
| GPT-6 Astra | US$9.89 | US$14,831 |
วิธีคำนวณ
สำหรับแต่ละครั้งที่เรียกในลูป เราใช้ขนาดของ prompt ซึ่งประกอบด้วย prompt แรกบวกกับส่วนที่เพิ่มขึ้นจากทุกขั้นตอนก่อนหน้า แล้วแบ่งเป็นส่วนที่ใช้แคชและส่วนใหม่ ครั้งแรกจะเป็นข้อมูลใหม่ทั้งหมดเสมอ โทเค็นใหม่คิดตามอัตราขาเข้า โทเค็นที่ใช้แคชคิดตามอัตราแคช และโทเค็นขาออกคิดตามอัตราขาออก
หาก prompt ครั้งใดเกินเกณฑ์บริบทยาวของผู้ให้บริการ การเรียกครั้งนั้นทั้งหมดจะคิดตามอัตราสำหรับ prompt ยาว เช่นเดียวกับที่ OpenAI, Google, xAI และ Qwen ทำ หาก prompt ที่ยาวที่สุดเกินหน้าต่างบริบทของโมเดล เราจะแสดงหมายเหตุไว้ เพราะ agent จริงต้องตัดหรือสรุปประวัติก่อน
งานจริงของ agent แตกต่างกันไปในแต่ละครั้ง อาจลองทำขั้นตอนที่ล้มเหลวซ้ำ และบางครั้งก็หยุดก่อน Treat ตัวเลขเหล่านี้เป็นแนวทางสำหรับเปรียบเทียบโมเดลภายใต้ภาระงานเดียวกัน จากนั้นตรวจวัดจำนวนโทเค็นจริงจาก trace ของคุณเองก่อนวางงบประมาณ
คำถามเกี่ยวกับค่าใช้จ่ายของ agent
AI agent ใช้โทเค็นกี่โทเค็นต่องาน?
ส่วนใหญ่ขึ้นอยู่กับจำนวนขั้นตอนและปริมาณที่แต่ละขั้นตอนเพิ่มเข้ามา การสนทนาสั้น ๆ เพื่อขอความช่วยเหลืออาจใช้โทเค็นขาเข้า 30K ส่วนงานเขียนโค้ด 30 ขั้นตอนที่เริ่มด้วย prompt 25K โทเค็นจะส่งข้อมูลมากกว่าสามล้านโทเค็น เพราะมีการส่งประวัติทั้งหมดซ้ำทุกครั้งที่เรียก
จะลดค่าใช้จ่ายของ agent ได้อย่างไร?
ทำให้ส่วนต้นของ prompt เหมือนเดิมในทุกการเรียกเพื่อให้ใช้แคช ตัดผลลัพธ์จากเครื่องมือให้เหลือเฉพาะที่โมเดลต้องใช้ สรุปหรือลบข้อความเก่า ใช้โมเดลขนาดเล็กสำหรับขั้นตอนทั่วไปและใช้โมเดลขนาดใหญ่เฉพาะตอนวางแผน รวมถึงลดระดับการใช้เหตุผลเมื่อคุณภาพยังยอมรับได้
การแคช prompt ทำงานโดยอัตโนมัติหรือไม่?
สำหรับการแคชโดยนัยของ OpenAI, DeepSeek, Kimi และ Gemini จะทำงานโดยอัตโนมัติเมื่อ prompt ใช้คำนำหน้ายาวร่วมกัน ส่วน Anthropic และ endpoint บางแห่งของ Qwen ต้องใช้เครื่องหมายแคชอย่างชัดเจน และ Anthropic คิดค่าบริการเพิ่มสำหรับการเขียนแคชครั้งแรก
ทำไมโมเดลที่มีราคาต่อโทเค็นถูกที่สุดจึงไม่ใช่โมเดลที่ถูกที่สุดต่องาน?
ส่วนลดแคชแตกต่างกันไปตามโมเดล ผู้ให้บริการบางรายคิดอัตราสูงขึ้นสำหรับ prompt ยาว และโมเดลที่ใช้เหตุผลจะใช้โทเค็นขาออกไปกับการคิด โมเดลที่ใช้ขั้นตอนน้อยกว่าหรือต้องลองซ้ำน้อยกว่าอาจมีค่าใช้จ่ายต่ำกว่าได้เช่นกัน ซึ่งเครื่องคำนวณนี้ไม่สามารถประเมินได้