DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- 入力 / 出力
- $0.66 / $1.98
- コンテキスト
- 1M
- リリース日
- 2026年4月24日
- 最大出力
- 384K
- モダリティ
- チャット
- 機能
- ツール利用プロンプトキャッシュ推論
DeepSeek V4 Pro について
DeepSeek V4 Proは、DeepSeekのV4世代における大規模モデルであり、総パラメータ数1.6兆、アクティブパラメータ数490億のオープンウェイトな混合エキスパート(MoE)モデルです。DeepSeekは、エージェント型コーディング、数学、STEM推論、広範な世界知識において、クローズドな最先端モデルに対抗することを目指しています。思考モードと非思考モード、3段階の推論負荷レベル、ツール呼び出し、JSON出力を備えており、テキストのみを読み取ります。
得意なこと
- DeepSeekは本モデルをエージェント型コーディングベンチマークにおけるオープンソースの最先端と位置づけており、その世界知識はGemini 3.1 Proに次ぐものとしています。
- 思考モードには低・高・最大(low, high, max)の負荷レベルがあり、難しい数学、STEM、デバッグの問題に対しては、日常的な問題よりもはるかに多くの推論を行わせることができます。
- ツール呼び出し、JSON出力、プロンプトキャッシングがサポートされているため、長いシステムプロンプトを繰り返すエージェントループに適しています。
- ウェイトが公開されているため、セルフホストを行うチームは、導入を決定する前に同じモデルファミリーを評価できます。
他のモデルを検討すべきケース
- テキストのみを読み取ります。スクリーンショットや図の処理には、deepseek-v4.1-flashまたはFlash vision-expバリアントが必要です。
- V4モデルの中でも重量級であるため、追加の推論深度を必要としないタスクではV4 Flashの方が高速に応答します。
- 最大負荷(max effort)では長い推論が行われるため、遅延とトークン消費が増加します。また、ツールとの会話では、ターンごとに推論テキストを渡す必要があります。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストResponses APIPOST/v1/responsesAPI形式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
料金
VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。
料金時間帯 · オフピーク時間帯
100万トークンあたり- 公式価格
- 入力 $0.66 / 出力 $1.98 / キャッシュ読み取り $0.022 / キャッシュ書き込み $0.66
- Official
- 入力 $0.66 / 出力 $1.98 / キャッシュ読み取り $0.022 / キャッシュ書き込み $0.66
- 割引
- —
料金時間帯 · ピーク時間帯
100万トークンあたり- 公式価格
- 入力 $1.32 / 出力 $3.96 / キャッシュ読み取り $0.044 / キャッシュ書き込み $1.32
- Official
- 入力 $1.32 / 出力 $3.96 / キャッシュ読み取り $0.044 / キャッシュ書き込み $1.32
- 割引
- —
キャッシュ読み取り
- 公式価格
- $0.022
- Official
- $0.022
- 割引
- —
キャッシュ書き込み
- 公式価格
- $0.66
- Official
- $0.66
- 割引
- —
| 公式価格100万トークンあたり | Official100万トークンあたり | 割引 | |
|---|---|---|---|
| 料金時間帯 · オフピーク時間帯 | 入力 $0.66 / 出力 $1.98 / キャッシュ読み取り $0.022 / キャッシュ書き込み $0.66 | 入力 $0.66 / 出力 $1.98 / キャッシュ読み取り $0.022 / キャッシュ書き込み $0.66 | — |
| 料金時間帯 · ピーク時間帯 | 入力 $1.32 / 出力 $3.96 / キャッシュ読み取り $0.044 / キャッシュ書き込み $1.32 | 入力 $1.32 / 出力 $3.96 / キャッシュ読み取り $0.044 / キャッシュ書き込み $1.32 | — |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.022 | $0.022 | — |
| キャッシュ書き込み | $0.66 | $0.66 | — |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
- 30日間の成功率
- 99.9%
- 30日間のリクエスト数
- 100+
- 最終利用
- 30 分前
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでDeepSeek V4 Proを開き、プロンプトを編集・送信できます。
deepseek-v4-proと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
向いている用途- 推論
自律型コーディングエージェント
ターミナルやIDEエージェントのプランナーとして実行し、長時間のセッションを通じて多数のファイルの編集、テストの実行、失敗への対応を行わせます。
高度な技術的推論
証明、アルゴリズム設計、科学的導出、あるいは複雑な並行処理のバグなどを与え、最終パスには推論負荷を最大に設定してください。
知識集約型の質問応答
規格の比較や2つの技術がどのように相互作用するかを説明するなど、分野を横断した広範な事実の想起が必要な質問を行ってください。
Flashの背後にあるエスカレーション層
日常的なリクエストはV4 Flashに送信し、検証に失敗したものやより深い分析が必要なものだけをProに渡してください。
プロンプト例
このバックエンドは負荷がかかるとデッドロックします。スレッドダンプと2つのロック取得モジュールを添付しました。順序の問題を特定し、パッチを作成してください。
以下のアルゴリズムが終了することを証明し、最悪のケースの計算量を述べてください。また、その議論を破綻させる入力があれば指摘してください。
RESTハンドラーから新しいゲートウェイへの移行を計画し、影響を受けるモジュールを順にリストアップした上で、シェルツールを使用して各ステップの後にテストを実行してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
DeepSeek V4 Flashの代わりにDeepSeek V4 Proを使うべきなのはいつですか?
エージェント型コーディング、困難な推論、広範な事実知識が必要な質問にはProを使用してください。DeepSeekによると、Flashは推論や単純なエージェント作業でも肉薄するため、Flashがタスクを誤った場合や、ミスが許されない場合にProが重要になります。
DeepSeek V4 Proの思考負荷レベルはどのように機能しますか?
思考を有効にし、低・高・最大(low, high, max)から選択します。デフォルトの「高」は日常的なエージェントタスクに適しており、「低」は単純なタスク、「最大」は最も複雑な問題に適しています。負荷が高いほど推論テキストが増え、回答までの待ち時間が長くなります。
DeepSeek V4 Proはオープンソースですか?
DeepSeekはV4世代をオープンウェイトでリリースしました。Proモデルは総パラメータ数1.6兆、トークンあたり490億のアクティブパラメータを持っています。API経由で呼び出す場合はホスティングは不要ですが、同じファミリーを評価したりセルフホストしたりしたい場合にオープンリリースが重要となります。
DeepSeek V4 Proは画像を受け付けますか?
いいえ。テキストの読み書きのみを行います。DeepSeekは画像理解機能を別のFlashベースのモデルで提供しているため、スクリーンショットと高度な推論の両方が必要なワークフローでは、ステップを2つのモデルに分割する必要があります。
DeepSeek V4 ProはOpenAI SDKやAnthropic SDKと動作しますか?
両方で動作します。DeepSeekはOpenAIおよびAnthropicのAPIフォーマットとの互換性を文書化しているため、既存のクライアントを維持したまま、モデル名とベースURLを変更するだけで利用可能です。
DeepSeek V4 Pro の料金はいくらですか?
TokenLab では DeepSeek V4 Pro は 入力 $0.66 / 出力 $1.98 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
DeepSeek V4 Pro のコンテキストウィンドウと出力制限は?
DeepSeek V4 Pro は最大 1,000,000 トークンのコンテキストに対応し、1回のレスポンスで最大 384,000 トークンまで出力可能です。
DeepSeek V4 Pro はどのエンドポイントを使うべきですか?
DeepSeek V4 Pro のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
DeepSeek V4 Pro はどの操作に対応していますか?
DeepSeek V4 Pro は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
DeepSeek V4 Pro を比較する
DeepSeek V4 Pro を活用するガイド
ソース
2026/10/02 時点での評価