DeepSeek V4 料金概要
DeepSeek V4 シリーズは、現在市場で最もコストパフォーマンスに優れたトップモデルです:
| deepseek-v4-flash | deepseek-v4-pro | |
|---|---|---|
| 入力(キャッシュヒット) | ¥0.02/M tokens | ¥0.025/M tokens |
| 入力(キャッシュミス) | ¥1/M tokens | ¥3/M tokens |
| 出力 | ¥2/M tokens | ¥6/M tokens |
| コンテキスト | 1M tokens | |
| 最大出力 | 384K tokens | |
GPT-5(入力 $5/出力 $20/百万トークン)と比較して、DeepSeek V4 Flash のコストは GPT-5 の 1/25 に過ぎません。
キャッシュメカニズムの詳細
DeepSeek のコンテキストキャッシュは自動的に機能し、手動設定は不要です:
- API リクエスト内の system prompt + 履歴メッセージ が以前のリクエストと重複する場合に自動的にヒットします
- ヒットすると、入力価格が ¥1 から ¥0.02 に下がります(98% 節約)
- キャッシュ保持時間は約 5〜10 分で、高頻度の会話シナリオに適しています
キャッシュヒットを最大化する戦略
# 戦略1:固定 System Prompt - すべてのリクエストで同じ system prompt を使用
# 戦略2:バッチ処理 - 複数の質問で system prompt を共有
# 戦略3:長い会話では、前のメッセージが自動的にキャッシュされるFlash vs Pro 選択ガイド
| シナリオ | 推奨モデル | 理由 |
|---|---|---|
| 日常会話、カスタマーサービス | Flash | 低コストで品質は十分 |
| コード生成、複雑な推論 | Pro | コーディングと推論の精度が高い |
| 高並行処理、大規模展開 | Flash | 2500 並行 vs 500 並行 |
| 予算重視 | Flash | 価格は Pro の 1/3 のみ |
| 最高品質が必要 | Pro | 複雑なタスクでの精度が高い |
トークン最適化のヒント
- System Prompt を簡素化:不要な説明を削除し、コアな指示を保持
- 出力長を制限:max_tokens パラメータで制御
- 履歴メッセージを整理:直近の N ターンのみ保持し、それ以外は要約
- 使用量を監視:DeepSeek プラットフォームでトークン消費レポートを定期的に確認
コスト見積もり
例として、1000 トークン入力 + 500 トークン出力の場合:キャッシュミス約 ¥0.002;キャッシュヒット約 ¥0.00102。1 日 1 万回の呼び出しで、毎回 3000 トークン出力の場合、約 ¥60/日(Flash キャッシュヒット時)。