---
title: "Harga API LLM untuk agen AI: perbandingan 28 model · DotsAgent"
description: "Harga input, input dari cache, dan output per satu juta token untuk 28 model dari OpenAI, Anthropic, Google, xAI, DeepSeek, Qwen, dan lainnya, beserta ukuran konteks dan fitur agen."
url: https://dotsagent.io/id/models
---

Pengembangan · harga diperiksa 1 Oktober 2026

# Model dan harga API untuk pengembang agen

Agen membayar setiap langkah yang diambilnya, dan sebagian besar biaya berasal dari input yang sudah dikirim sebelumnya. Tabel ini menampilkan harga standar, diskon cache, dan batas konteks secara berdampingan agar Anda bisa memilih model berdasarkan biaya keseluruhan suatu tugas, bukan sekadar tarif utama.

- [DeepSeek-V4.1-Flash](https://dotsagent.io/id/models/deepseek-v4-1-flash): US$0,22

- [Qwen3.7-Plus](https://dotsagent.io/id/models/qwen3-7-plus): US$0,34

- [GPT-6 Luna](https://dotsagent.io/id/models/gpt-6-luna): US$0,10

## Semua model dalam satu tabel

| — | Penyedia | — | — | — | — | — |
| --- | --- | --- | --- | --- | --- | --- |
| [GPT-6 Astra](https://dotsagent.io/id/models/gpt-6-astra)gpt-6-astra | [OpenAI](https://dotsagent.io/id/providers/openai) | US$10* | US$1 | US$50 | 1,05M | 2026-09-08 |
| [Claude Fable 5.1](https://dotsagent.io/id/models/claude-fable-5-1)claude-fable-5-1 | [Anthropic](https://dotsagent.io/id/providers/anthropic) | US$10 | US$0,25 | US$50 | 1M | 2026-09-01 |
| [Claude Opus 5.5](https://dotsagent.io/id/models/claude-opus-5-5)claude-opus-5-5 | [Anthropic](https://dotsagent.io/id/providers/anthropic) | US$4 | US$0,20 | US$20 | 1M | 2026-09-22 |
| [Kimi K3](https://dotsagent.io/id/models/kimi-k3)kimi-k3 | [Moonshot AI (Kimi)](https://dotsagent.io/id/providers/moonshot) | US$3 | US$0,30 | US$15 | 1,05M | 2026-07-16 |
| [Command A+](https://dotsagent.io/id/models/command-a-plus)harga pihak ketigacommand-a-plus-05-2026 | [Cohere](https://dotsagent.io/id/providers/cohere) | US$2,50 | — | US$10 | 128K | 2026-05-20 |
| [GPT-6.1 Sol](https://dotsagent.io/id/models/gpt-6-1-sol)gpt-6.1-sol | [OpenAI](https://dotsagent.io/id/providers/openai) | US$2* | US$0,10 | US$10 | 1,05M | 2026-09-29 |
| [Claude Sonnet 5.5](https://dotsagent.io/id/models/claude-sonnet-5-5)claude-sonnet-5-5 | [Anthropic](https://dotsagent.io/id/providers/anthropic) | US$2 | US$0,20 | US$10 | 1M | 2026-09-28 |
| [Gemini 3.1 Pro Preview](https://dotsagent.io/id/models/gemini-3-1-pro-preview)pratinjaugemini-3.1-pro-preview | [Google](https://dotsagent.io/id/providers/google) | US$2* | US$0,20 | US$12 | 1,05M | 2026-02-19 |
| [Grok 4.7](https://dotsagent.io/id/models/grok-4-7)grok-4.7 | [xAI](https://dotsagent.io/id/providers/xai) | US$2* | US$0,50 | US$6 | 500K | 2026-09-21 |
| [Qwen3.8-Max](https://dotsagent.io/id/models/qwen3-8-max)qwen3.8-max | [Alibaba Cloud (Qwen)](https://dotsagent.io/id/providers/qwen) | US$1,65 | US$0,21 | US$4,95 | 1M | 2026-08-03 |
| [Gemini 3.5 Flash](https://dotsagent.io/id/models/gemini-3-5-flash)gemini-3.5-flash | [Google](https://dotsagent.io/id/providers/google) | US$1,50 | US$0,15 | US$9 | 1,05M | 2026-05-19 |
| [Mistral Medium 3.5](https://dotsagent.io/id/models/mistral-medium-3-5)mistral-medium-3-5 | [Mistral AI](https://dotsagent.io/id/providers/mistral) | US$1,50 | — | US$7,50 | 256K | 2026-04-28 |
| [GLM-5.3](https://dotsagent.io/id/models/glm-5-3)glm-5.3 | [Z.ai (Zhipu)](https://dotsagent.io/id/providers/zhipu) | US$1,40 | US$0,26 | US$4,40 | 1M | 2026-08-14 |
| [DeepSeek-V4-Pro-0813](https://dotsagent.io/id/models/deepseek-v4-pro-0813)deepseek-v4-pro | [DeepSeek](https://dotsagent.io/id/providers/deepseek) | US$1,32 | US$0,044 | US$3,96 | 1M | 2026-08-13 |
| [Grok 4.3](https://dotsagent.io/id/models/grok-4-3)grok-4.3 | [xAI](https://dotsagent.io/id/providers/xai) | US$1,25* | US$0,20 | US$2,50 | 1M | — |
| [Muse Spark 1.3](https://dotsagent.io/id/models/muse-spark-1-3)muse-spark-1.3 | [Meta](https://dotsagent.io/id/providers/meta) | US$1,25 | US$0,15 | US$4,25 | 1M | 2026-09-02 |
| [Amazon Nova 2 Pro](https://dotsagent.io/id/models/amazon-nova-2-pro)pratinjauharga pihak ketiga | [Amazon](https://dotsagent.io/id/providers/amazon) | US$1,25 | — | US$10 | — | — |
| [Claude Haiku 4.5](https://dotsagent.io/id/models/claude-haiku-4-5)claude-haiku-4-5-20251001 | [Anthropic](https://dotsagent.io/id/providers/anthropic) | US$1 | US$0,10 | US$5 | 200K | — |
| [Grok Build 0.1](https://dotsagent.io/id/models/grok-build-0-1)grok-build-0.1 | [xAI](https://dotsagent.io/id/providers/xai) | US$1* | US$0,20 | US$2 | 256K | — |
| [Gemini 3.8 Flash](https://dotsagent.io/id/models/gemini-3-8-flash)gemini-3.8-flash | [Google](https://dotsagent.io/id/providers/google) | US$0,75 | US$0,075 | US$3,75 | 1,05M | 2026-09-02 |
| [Gemini 3.5 Flash-Lite](https://dotsagent.io/id/models/gemini-3-5-flash-lite)gemini-3.5-flash-lite | [Google](https://dotsagent.io/id/providers/google) | US$0,30 | US$0,030 | US$2,50 | 1,05M | 2026-07-21 |
| [DeepSeek-V4.1-Flash](https://dotsagent.io/id/models/deepseek-v4-1-flash)deepseek-flash | [DeepSeek](https://dotsagent.io/id/providers/deepseek) | US$0,30 | US$0,006 | US$1,20 | 1M | 2026-09-10 |
| [Amazon Nova 2 Lite](https://dotsagent.io/id/models/amazon-nova-2-lite)harga pihak ketiga | [Amazon](https://dotsagent.io/id/providers/amazon) | US$0,30 | — | US$2,50 | 1M | 2025-12-02 |
| [Qwen3.7-Plus](https://dotsagent.io/id/models/qwen3-7-plus)qwen3.7-plus | [Alibaba Cloud (Qwen)](https://dotsagent.io/id/providers/qwen) | US$0,28* | US$0,056 | US$1,10 | 1M | 2026-05-26 |
| [Mistral Small 4](https://dotsagent.io/id/models/mistral-small-4)mistral-small-2603 | [Mistral AI](https://dotsagent.io/id/providers/mistral) | US$0,15 | — | US$0,60 | 256K | 2026-03-16 |
| [GLM-5.3-Flash](https://dotsagent.io/id/models/glm-5-3-flash)glm-5.3-flash | [Z.ai (Zhipu)](https://dotsagent.io/id/providers/zhipu) | US$0,15 | US$0,030 | US$0,50 | 1M | — |
| [GPT-6 Luna](https://dotsagent.io/id/models/gpt-6-luna)gpt-6-luna | [OpenAI](https://dotsagent.io/id/providers/openai) | US$0,10* | US$0,010 | US$0,50 | 1,05M | 2026-09-22 |
| [Qwen3.7-Flash](https://dotsagent.io/id/models/qwen3-7-flash)qwen3.7-flash | [Alibaba Cloud (Qwen)](https://dotsagent.io/id/providers/qwen) | US$0,028* | US$0,006 | US$0,11 | 1M | 2026-07-15 |

Dolar AS per satu juta token, kelas standar, tarif prompt pendek · * prompt panjang dikenakan biaya lebih tinggi

[Hitung biaya beban kerja Anda](https://dotsagent.io/id/cost)

## Cara membaca harga ini

### Harga input dari cache paling berpengaruh

Dalam loop agen, system prompt, definisi tool, dan giliran percakapan sebelumnya dikirim ulang pada setiap pemanggilan. Provider mengenakan tarif input normal hanya sebagian kecil ketika awalan tersebut diambil dari cache, sering kali sepersepuluh atau bahkan lebih murah. Karena itu, model dengan harga cache rendah bisa lebih murah daripada model dengan harga utama yang lebih rendah.

### Prompt panjang bisa mengubah tarif seluruh pemanggilan

OpenAI, pratinjau Pro Google, xAI, dan Qwen mengenakan tarif lebih tinggi saat satu prompt melewati ambang tertentu, seperti 200K atau 272K token. Tarif yang lebih tinggi berlaku untuk setiap token dalam permintaan tersebut. Saat ini, Anthropic mengenakan tarif standar untuk seluruh jendela satu juta token.

### Token penalaran dihitung sebagai output

Model yang berpikir sebelum menjawab mengenakan tarif output untuk penalaran tersembunyinya. Turunkan tingkat upaya untuk langkah rutin dan gunakan pengaturan tinggi untuk perencanaan atau debugging yang sulit.

### Diskon batch dan di luar jam sibuk jarang cocok untuk agen

Endpoint batch memangkas separuh harga, tetapi hasilnya baru tersedia dalam hitungan jam. Ini cocok untuk evaluasi dan pengisian ulang data, bukan untuk agen aktif. Tarif di luar jam sibuk DeepSeek adalah pengecualian yang bisa digunakan untuk tugas terjadwal.

## Pertanyaan umum dari pengembang

### Model apa yang paling murah untuk agen AI?

Untuk beban kerja coding kami dengan 30 langkah, model termurah adalah model kecil: GPT-6 Luna, Qwen3.7-Flash, dan GLM-5.3-Flash, masing-masing sekitar 10 hingga 20 sen per tugas. Biaya rendah per langkah belum tentu berarti biaya rendah per tugas jika model membutuhkan lebih banyak langkah atau percobaan ulang. Jadi, uji dua atau tiga kandidat dengan trace Anda sendiri.

### Mengapa biaya agen saya jauh lebih tinggi daripada perkiraan berdasarkan harga per token?

Karena setiap langkah mengirim ulang percakapan yang terus bertambah. Tugas dengan 30 langkah dan prompt awal 25K token mengirim total jauh lebih dari tiga juta token input. Caching prompt, mempersingkat output tool, dan merangkum giliran lama lebih efektif untuk mengurangi biaya daripada mengganti model.

### Apakah harga ini sudah final?

Ini adalah harga standar dalam dolar AS dari halaman harga masing-masing provider per 1 Oktober 2026, sebelum pajak, biaya tambahan regional, atau diskon hasil negosiasi. Harga yang ditandai sebagai pihak ketiga tidak dapat diverifikasi dari halaman vendor sendiri.

### Apa perbedaan antara input dari cache dan penulisan ke cache?

Pembacaan cache adalah tarif diskon untuk token yang sudah ada di cache. Beberapa provider, termasuk Anthropic, juga mengenakan biaya tambahan saat awalan pertama kali ditulis ke cache. Tabel ini menampilkan harga baca; harga tulis dicantumkan di halaman masing-masing model jika berlaku.

Referensi independen bagi mereka yang membangun agen AI. Tidak berafiliasi dengan vendor mana pun yang disebutkan di sini.

© 2026 DotsAgent · Fakta diperiksa 1 Oktober 2026
