エージェント開発者向けモデルとAPI料金
エージェントは実行するステップごとに料金がかかり、その大半はすでに送信した入力に対するものです。この表では、公開料金、キャッシュ割引、コンテキスト上限を並べて比較できます。表示上の単価ではなく、タスク全体のコストを基準にモデルを選べます。
全モデルを一覧で比較
| プロバイダー | ||||||
|---|---|---|---|---|---|---|
| GPT-6 Astra | OpenAI | $10* | $1 | $50 | 1.05M | 2026-09-08 |
| Claude Fable 5.1 | Anthropic | $10 | $0.25 | $50 | 1M | 2026-09-01 |
| Claude Opus 5.5 | Anthropic | $4 | $0.20 | $20 | 1M | 2026-09-22 |
| Kimi K3 | Moonshot AI (Kimi) | $3 | $0.30 | $15 | 1.05M | 2026-07-16 |
| Command A+サードパーティ価格 | Cohere | $2.50 | — | $10 | 128K | 2026-05-20 |
| GPT-6.1 Sol | OpenAI | $2* | $0.10 | $10 | 1.05M | 2026-09-29 |
| Claude Sonnet 5.5 | Anthropic | $2 | $0.20 | $10 | 1M | 2026-09-28 |
| Gemini 3.1 Pro Previewプレビュー | $2* | $0.20 | $12 | 1.05M | 2026-02-19 | |
| Grok 4.7 | xAI | $2* | $0.50 | $6 | 500K | 2026-09-21 |
| Qwen3.8-Max | Alibaba Cloud (Qwen) | $1.65 | $0.21 | $4.95 | 1M | 2026-08-03 |
| Gemini 3.5 Flash | $1.50 | $0.15 | $9 | 1.05M | 2026-05-19 | |
| Mistral Medium 3.5 | Mistral AI | $1.50 | — | $7.50 | 256K | 2026-04-28 |
| GLM-5.3 | Z.ai (Zhipu) | $1.40 | $0.26 | $4.40 | 1M | 2026-08-14 |
| DeepSeek-V4-Pro-0813 | DeepSeek | $1.32 | $0.044 | $3.96 | 1M | 2026-08-13 |
| Grok 4.3 | xAI | $1.25* | $0.20 | $2.50 | 1M | — |
| Muse Spark 1.3 | Meta | $1.25 | $0.15 | $4.25 | 1M | 2026-09-02 |
| Amazon Nova 2 Proプレビューサードパーティ価格 | Amazon | $1.25 | — | $10 | — | — |
| Claude Haiku 4.5 | Anthropic | $1 | $0.10 | $5 | 200K | — |
| Grok Build 0.1 | xAI | $1* | $0.20 | $2 | 256K | — |
| Gemini 3.8 Flash | $0.75 | $0.075 | $3.75 | 1.05M | 2026-09-02 | |
| Gemini 3.5 Flash-Lite | $0.30 | $0.030 | $2.50 | 1.05M | 2026-07-21 | |
| DeepSeek-V4.1-Flash | DeepSeek | $0.30 | $0.006 | $1.20 | 1M | 2026-09-10 |
| Amazon Nova 2 Liteサードパーティ価格 | Amazon | $0.30 | — | $2.50 | 1M | 2025-12-02 |
| Qwen3.7-Plus | Alibaba Cloud (Qwen) | $0.28* | $0.056 | $1.10 | 1M | 2026-05-26 |
| Mistral Small 4 | Mistral AI | $0.15 | — | $0.60 | 256K | 2026-03-16 |
| GLM-5.3-Flash | Z.ai (Zhipu) | $0.15 | $0.030 | $0.50 | 1M | — |
| GPT-6 Luna | OpenAI | $0.10* | $0.010 | $0.50 | 1.05M | 2026-09-22 |
| Qwen3.7-Flash | Alibaba Cloud (Qwen) | $0.028* | $0.006 | $0.11 | 1M | 2026-07-15 |
料金の見方
重要なのはキャッシュ入力の料金
エージェントのループでは、システムプロンプト、ツール定義、前のターンが毎回再送信されます。プロバイダーは、そのプレフィックスをキャッシュから提供すると通常の入力料金より安く請求します。多くの場合、料金は10分の1以下です。そのため、キャッシュ料金の安いモデルが、表示上の単価が安いモデルよりも低コストになることがあります。
長いプロンプトではリクエスト全体の料金が変わることも
OpenAI、GoogleのProプレビュー、xAI、Qwenでは、1つのプロンプトが200Kや272Kトークンなどのしきい値を超えると、より高い料金が適用されます。そのリクエスト内の全トークンが高い料金の対象です。Anthropicでは現在、100万トークンのコンテキストウィンドウ全体に標準料金が適用されます。
推論トークンは出力として課金される
回答前に思考するモデルでは、非表示の推論処理も出力料金で課金されます。定型的なステップでは推論の強度を下げ、計画や難しいデバッグでは高い設定を使いましょう。
バッチやオフピークの割引はエージェントには使いにくい
バッチエンドポイントは料金が半額になる一方、結果の返却に数時間かかります。リアルタイムのエージェントより、評価や過去データの再処理に向いています。例外はDeepSeekのオフピーク料金で、スケジュール済みジョブに使える場合があります。
開発者からよくある質問
AIエージェントに最も安いモデルは?
当サイトの30ステップのコーディング処理例では、小型モデルが最安です。GPT-6 Luna、Qwen3.7-Flash、GLM-5.3-Flashはいずれも、タスクあたり約10〜20セントです。ただし、1ステップあたりの料金が安くても、必要なステップ数やリトライ回数が多ければ、タスク全体では高くつきます。実際のトレースを使って、候補を2、3モデル試してください。
トークン単価から想定するより、エージェントの料金がずっと高いのはなぜですか?
ステップを重ねるたびに、会話履歴が増えた状態で再送信されるためです。開始時のプロンプトが25Kトークンのタスクでは、30ステップの合計入力トークン数は300万を大きく超えます。モデルを切り替えるより、プロンプトキャッシュの利用、ツール出力の短縮、古いターンの要約のほうが大幅な削減につながります。
この料金は確定料金ですか?
各プロバイダーの料金ページで1 October 2026に確認した、税金、地域別追加料金、個別割引を含まない米ドル建ての公開料金です。「サードパーティ」と記載された料金は、ベンダー自身のページで確認できませんでした。
キャッシュ入力とキャッシュ書き込みの違いは何ですか?
キャッシュ読み取りは、すでにキャッシュにあるトークンに適用される割引料金です。Anthropicなど一部のプロバイダーでは、プレフィックスを初めてキャッシュに書き込む際に追加料金もかかります。この表には読み取り料金を掲載しています。書き込み料金が適用されるモデルでは、各モデルのページに記載しています。