dotsagent.io
言語:日本語
DeepSeek · フラッグシップ

DeepSeek-V4.1-Flash APIの料金と仕様

DeepSeekの最新モデル。DeepSeekによると、品質、速度、価格のすべてでV4-Proを上回り、OpenAIとAnthropicの両方のリクエスト形式に対応します。

入力
⁨$0.30⁩
キャッシュ済み入力
⁨$0.006⁩
出力
⁨$1.20⁩

100万トークンあたりの米ドル価格(標準ティア、短いプロンプトの場合)

従来のdeepseek-v4-flashとdeepseek-v4-flash-vision-expは、現在このモデルにルーティングされます。キャッシュヒットの料金はピーク時で100万トークンあたり$0.006、オフピーク時はその半額です。

DeepSeekでは、オフピーク時の料金が半額になります。平日のUTC 01:00~04:00と06:00~10:00がピーク時間帯です。それ以外の時間帯は、週末を含めすべてオフピークです。表にはピーク時の料金を示しています。

仕様

APIのモデル名
deepseek-flash
プロバイダー
DeepSeek
コンテキスト
1M トークン
最大出力
384K トークン
リリース日
2026年9月10日
Batch API
Batch割引の記載なし
ドキュメントに記載されたエージェント機能
ツール呼び出し構造化出力推論の調整画像入力

タスクあたりのコスト

このモデルの通常料金で算出した4つの代表的なワークロードです。キャッシュは初回の呼び出し後に適用されます。実際の金額は異なります。計算ツールでは、すべての前提条件を変更できます。

ワークロードタスクあたり1,000タスクあたり
サポート bot
4回の呼び出し、短いツール検索
⁨$0.007⁩⁨$7⁩
コーディングエージェント
30回の呼び出し、ファイルとテスト出力
⁨$0.218⁩⁨$218⁩
ブラウザーエージェント
25回の呼び出し、スクリーンショットとページテキスト
⁨$0.186⁩⁨$186⁩
リサーチエージェント
15回の呼び出し、長い検索結果
⁨$0.180⁩⁨$180⁩

前提条件を変更

DeepSeekの他のモデル

他社の同等コストモデル

30ステップのコーディングワークロードで、このモデルとコストが近い他社のモデルです。

情報源

  1. api-docs.deepseek.com/quick_start/pricing
  2. api-docs.deepseek.com/updates
  3. api-docs.deepseek.com/news/news260910