dotsagent.io
言語:日本語
開発 · 料金確認日:1 October 2026

エージェント開発者向けモデルとAPI料金

エージェントは実行するステップごとに料金がかかり、その大半はすでに送信した入力に対するものです。この表では、公開料金、キャッシュ割引、コンテキスト上限を並べて比較できます。表示上の単価ではなく、タスク全体のコストを基準にモデルを選べます。

全モデルを一覧で比較

エージェント構築に使用するモデルのAPI標準価格
プロバイダー
GPT-6 Astra
gpt-6-astra
OpenAI⁨$10⁩*⁨$1⁩⁨$50⁩1.05M2026-09-08
Claude Fable 5.1
claude-fable-5-1
Anthropic⁨$10⁩⁨$0.25⁩⁨$50⁩1M2026-09-01
Claude Opus 5.5
claude-opus-5-5
Anthropic⁨$4⁩⁨$0.20⁩⁨$20⁩1M2026-09-22
Kimi K3
kimi-k3
Moonshot AI (Kimi)⁨$3⁩⁨$0.30⁩⁨$15⁩1.05M2026-07-16
Command A+サードパーティ価格
command-a-plus-05-2026
Cohere⁨$2.50⁩—⁨$10⁩128K2026-05-20
GPT-6.1 Sol
gpt-6.1-sol
OpenAI⁨$2⁩*⁨$0.10⁩⁨$10⁩1.05M2026-09-29
Claude Sonnet 5.5
claude-sonnet-5-5
Anthropic⁨$2⁩⁨$0.20⁩⁨$10⁩1M2026-09-28
Gemini 3.1 Pro Previewプレビュー
gemini-3.1-pro-preview
Google⁨$2⁩*⁨$0.20⁩⁨$12⁩1.05M2026-02-19
Grok 4.7
grok-4.7
xAI⁨$2⁩*⁨$0.50⁩⁨$6⁩500K2026-09-21
Qwen3.8-Max
qwen3.8-max
Alibaba Cloud (Qwen)⁨$1.65⁩⁨$0.21⁩⁨$4.95⁩1M2026-08-03
Gemini 3.5 Flash
gemini-3.5-flash
Google⁨$1.50⁩⁨$0.15⁩⁨$9⁩1.05M2026-05-19
Mistral Medium 3.5
mistral-medium-3-5
Mistral AI⁨$1.50⁩—⁨$7.50⁩256K2026-04-28
GLM-5.3
glm-5.3
Z.ai (Zhipu)⁨$1.40⁩⁨$0.26⁩⁨$4.40⁩1M2026-08-14
DeepSeek-V4-Pro-0813
deepseek-v4-pro
DeepSeek⁨$1.32⁩⁨$0.044⁩⁨$3.96⁩1M2026-08-13
Grok 4.3
grok-4.3
xAI⁨$1.25⁩*⁨$0.20⁩⁨$2.50⁩1M—
Muse Spark 1.3
muse-spark-1.3
Meta⁨$1.25⁩⁨$0.15⁩⁨$4.25⁩1M2026-09-02
Amazon Nova 2 Proプレビューサードパーティ価格Amazon⁨$1.25⁩—⁨$10⁩——
Claude Haiku 4.5
claude-haiku-4-5-20251001
Anthropic⁨$1⁩⁨$0.10⁩⁨$5⁩200K—
Grok Build 0.1
grok-build-0.1
xAI⁨$1⁩*⁨$0.20⁩⁨$2⁩256K—
Gemini 3.8 Flash
gemini-3.8-flash
Google⁨$0.75⁩⁨$0.075⁩⁨$3.75⁩1.05M2026-09-02
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Google⁨$0.30⁩⁨$0.030⁩⁨$2.50⁩1.05M2026-07-21
DeepSeek-V4.1-Flash
deepseek-flash
DeepSeek⁨$0.30⁩⁨$0.006⁩⁨$1.20⁩1M2026-09-10
Amazon Nova 2 Liteサードパーティ価格Amazon⁨$0.30⁩—⁨$2.50⁩1M2025-12-02
Qwen3.7-Plus
qwen3.7-plus
Alibaba Cloud (Qwen)⁨$0.28⁩*⁨$0.056⁩⁨$1.10⁩1M2026-05-26
Mistral Small 4
mistral-small-2603
Mistral AI⁨$0.15⁩—⁨$0.60⁩256K2026-03-16
GLM-5.3-Flash
glm-5.3-flash
Z.ai (Zhipu)⁨$0.15⁩⁨$0.030⁩⁨$0.50⁩1M—
GPT-6 Luna
gpt-6-luna
OpenAI⁨$0.10⁩*⁨$0.010⁩⁨$0.50⁩1.05M2026-09-22
Qwen3.7-Flash
qwen3.7-flash
Alibaba Cloud (Qwen)⁨$0.028⁩*⁨$0.006⁩⁨$0.11⁩1M2026-07-15

100万トークンあたりの米ドル価格(標準ティア、短いプロンプトの場合) · * 長いプロンプトは割増料金

独自の処理例で料金を試算

料金の見方

重要なのはキャッシュ入力の料金

エージェントのループでは、システムプロンプト、ツール定義、前のターンが毎回再送信されます。プロバイダーは、そのプレフィックスをキャッシュから提供すると通常の入力料金より安く請求します。多くの場合、料金は10分の1以下です。そのため、キャッシュ料金の安いモデルが、表示上の単価が安いモデルよりも低コストになることがあります。

長いプロンプトではリクエスト全体の料金が変わることも

OpenAI、GoogleのProプレビュー、xAI、Qwenでは、1つのプロンプトが200Kや272Kトークンなどのしきい値を超えると、より高い料金が適用されます。そのリクエスト内の全トークンが高い料金の対象です。Anthropicでは現在、100万トークンのコンテキストウィンドウ全体に標準料金が適用されます。

推論トークンは出力として課金される

回答前に思考するモデルでは、非表示の推論処理も出力料金で課金されます。定型的なステップでは推論の強度を下げ、計画や難しいデバッグでは高い設定を使いましょう。

バッチやオフピークの割引はエージェントには使いにくい

バッチエンドポイントは料金が半額になる一方、結果の返却に数時間かかります。リアルタイムのエージェントより、評価や過去データの再処理に向いています。例外はDeepSeekのオフピーク料金で、スケジュール済みジョブに使える場合があります。

開発者からよくある質問

AIエージェントに最も安いモデルは?

当サイトの30ステップのコーディング処理例では、小型モデルが最安です。GPT-6 Luna、Qwen3.7-Flash、GLM-5.3-Flashはいずれも、タスクあたり約10〜20セントです。ただし、1ステップあたりの料金が安くても、必要なステップ数やリトライ回数が多ければ、タスク全体では高くつきます。実際のトレースを使って、候補を2、3モデル試してください。

トークン単価から想定するより、エージェントの料金がずっと高いのはなぜですか?

ステップを重ねるたびに、会話履歴が増えた状態で再送信されるためです。開始時のプロンプトが25Kトークンのタスクでは、30ステップの合計入力トークン数は300万を大きく超えます。モデルを切り替えるより、プロンプトキャッシュの利用、ツール出力の短縮、古いターンの要約のほうが大幅な削減につながります。

この料金は確定料金ですか?

各プロバイダーの料金ページで1 October 2026に確認した、税金、地域別追加料金、個別割引を含まない米ドル建ての公開料金です。「サードパーティ」と記載された料金は、ベンダー自身のページで確認できませんでした。

キャッシュ入力とキャッシュ書き込みの違いは何ですか?

キャッシュ読み取りは、すでにキャッシュにあるトークンに適用される割引料金です。Anthropicなど一部のプロバイダーでは、プレフィックスを初めてキャッシュに書き込む際に追加料金もかかります。この表には読み取り料金を掲載しています。書き込み料金が適用されるモデルでは、各モデルのページに記載しています。