DeepSeek V4 料金概要

DeepSeek V4 シリーズは、現在市場で最もコストパフォーマンスに優れたトップモデルです:

deepseek-v4-flashdeepseek-v4-pro
入力(キャッシュヒット)¥0.02/M tokens¥0.025/M tokens
入力(キャッシュミス)¥1/M tokens¥3/M tokens
出力¥2/M tokens¥6/M tokens
コンテキスト1M tokens
最大出力384K tokens

GPT-5(入力 $5/出力 $20/百万トークン)と比較して、DeepSeek V4 Flash のコストは GPT-5 の 1/25 に過ぎません。

キャッシュメカニズムの詳細

DeepSeek のコンテキストキャッシュは自動的に機能し、手動設定は不要です:

  • API リクエスト内の system prompt + 履歴メッセージ が以前のリクエストと重複する場合に自動的にヒットします
  • ヒットすると、入力価格が ¥1 から ¥0.02 に下がります(98% 節約)
  • キャッシュ保持時間は約 5〜10 分で、高頻度の会話シナリオに適しています

キャッシュヒットを最大化する戦略

# 戦略1:固定 System Prompt - すべてのリクエストで同じ system prompt を使用
# 戦略2:バッチ処理 - 複数の質問で system prompt を共有
# 戦略3:長い会話では、前のメッセージが自動的にキャッシュされる

Flash vs Pro 選択ガイド

シナリオ推奨モデル理由
日常会話、カスタマーサービスFlash低コストで品質は十分
コード生成、複雑な推論Proコーディングと推論の精度が高い
高並行処理、大規模展開Flash2500 並行 vs 500 並行
予算重視Flash価格は Pro の 1/3 のみ
最高品質が必要Pro複雑なタスクでの精度が高い

トークン最適化のヒント

  • System Prompt を簡素化:不要な説明を削除し、コアな指示を保持
  • 出力長を制限:max_tokens パラメータで制御
  • 履歴メッセージを整理:直近の N ターンのみ保持し、それ以外は要約
  • 使用量を監視:DeepSeek プラットフォームでトークン消費レポートを定期的に確認

コスト見積もり

例として、1000 トークン入力 + 500 トークン出力の場合:キャッシュミス約 ¥0.002;キャッシュヒット約 ¥0.00102。1 日 1 万回の呼び出しで、毎回 3000 トークン出力の場合、約 ¥60/日(Flash キャッシュヒット時)。