DeepSeek: DeepSeek V4 Flash
deepseek-v4-flash- 入力 / 出力
- $0.15 / $0.60
- コンテキスト
- 1M
- リリース日
- 2026年4月24日
- 最大出力
- 384K
- モダリティ
- ビジョンチャット
- 機能
- ツール利用プロンプトキャッシュ推論
DeepSeek V4 Flash について
DeepSeek V4 Flashは、DeepSeekのV4世代における小型モデルであり、合計284B、アクティブパラメータ13Bのオープンウェイトの混合エキスパート(MoE)言語モデルです。DeepSeekは、V4 Proに近い推論能力を維持しつつ、速度と低い運用コストを重視して位置づけています。思考モードと非思考モードで動作し、ツール呼び出し、プロンプトキャッシング、要求に応じたJSON回答が可能です。これはテキストモデルです。
得意なこと
- DeepSeekは、その推論能力がV4 Proとほぼ一致し、より少ないアクティブパラメータ数で基本的なエージェントタスクをこなせると報告しています。
- 思考モードはリクエストごとに低、高、最大負荷で切り替え可能であり、1つのモデルで迅速な回答から時間をかけた問題解決まで対応できます。
- 非常に長いコンテキストウィンドウにより、アシスタントは会話全体を通じて大規模なコードベースや膨大なドキュメントコレクションを保持できます。
- ツール呼び出し、構造化されたJSON出力、プロンプトキャッシングをサポートしており、同じ指示を再送信する長いエージェントループに役立ちます。
他のモデルを検討すべきケース
- これはテキストモデルであるため、スクリーンショットや図表を扱う作業はDeepSeek V4.1 Flashまたはvision-expバリアントで行う必要があります。
- DeepSeekによると、V4 Proはエージェント的なコーディングベンチマークや世界知識において優れているため、最も困難なコーディングや研究タスクにはProの方が適しています。
- 思考モードでは、推論テキストが別個に返され、後のツールターンでそれを送り返す必要があるため、エージェントコードでその処理を行う必要があります。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストResponses APIPOST/v1/responsesAPI形式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-flash", "input": "Hello!" }'
料金
VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。
料金時間帯 · オフピーク時間帯
100万トークンあたり- 公式価格
- 入力 $0.15 / 出力 $0.60 / キャッシュ読み取り $0.003
- Official
- 入力 $0.15 / 出力 $0.60 / キャッシュ読み取り $0.003
- 割引
- —
料金時間帯 · ピーク時間帯
100万トークンあたり- 公式価格
- 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.006
- Official
- 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.006
- 割引
- —
キャッシュ読み取り
- 公式価格
- $0.003
- Official
- $0.003
- 割引
- —
| 公式価格100万トークンあたり | Official100万トークンあたり | 割引 | |
|---|---|---|---|
| 料金時間帯 · オフピーク時間帯 | 入力 $0.15 / 出力 $0.60 / キャッシュ読み取り $0.003 | 入力 $0.15 / 出力 $0.60 / キャッシュ読み取り $0.003 | — |
| 料金時間帯 · ピーク時間帯 | 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.006 | 入力 $0.30 / 出力 $1.20 / キャッシュ読み取り $0.006 | — |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.003 | $0.003 | — |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
- 30日間の成功率
- 99.5%
- 30日間のリクエスト数
- 100+
- 最終利用
- 16 時間前
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでDeepSeek V4 Flashを開き、プロンプトを編集・送信できます。
deepseek-v4-flashと/v1/responsesでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
向いている用途- 推論
- ビジョン
高頻度のエージェントステップ
ツールの選択、結果の読み取り、次の呼び出しの計画など、エージェントループ内の多くの小さな決定に使用します。ここでは応答時間とコストが重要になります。
リポジトリ全体の質問
大規模なコードベースや大量のドキュメントを長いコンテキストに貼り付け、動作がどこに実装されているか、または変更がどのファイルに影響するかを尋ねます。
構造化された抽出
契約書、チケット、ログをスキーマに従ったJSONに変換します。思考モードをオフにすることで、各レコードを迅速に返します。
古いDeepSeek名称のドロップイン代替
廃止されたchatおよびreasoner名を使用していた既存のクライアントをdeepseek-v4-flashに向け、リクエストごとに思考モードまたは非思考モードを選択してください。
プロンプト例
請求サービスの全ソースコードを以下に示します。どのモジュールが請求ステータスフィールドを読み取っていますか?また、新しいステータスを追加すると何が壊れますか?
これら5つの契約書から、すべての更新日、通知期間、解約手数料を抽出し、このスキーマに一致するJSON配列を1つ返してください。
search_docsとopen_ticketを呼び出すことができます。ユーザーから昨日からWebhookが届かなくなったという報告がありました。ツールを使って調査し、考えられる原因を要約してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
DeepSeek V4 FlashとV4 Proの違いは何ですか?
Flashは小型モデルで、アクティブパラメータは13B(Proは49B)です。DeepSeekによると、FlashはProとほぼ同等の推論能力を持ち、単純なエージェントタスクでは同等ですが、Proはエージェント的なコーディングや世界知識においてより強力です。まずはFlashで開始し、タスクが失敗した場合はProに移行してください。
DeepSeek V4 Flashは思考モードをサポートしていますか?
はい。リクエストで思考モードを有効にし、低、高、最大推論負荷を選択してください(デフォルトは高です)。推論結果は別のフィールドで返され、ツールを使用する会話では、その後の各ターンでそれを送り返す必要があります。レイテンシに敏感な短い回答には、思考モードをオフにしてください。
DeepSeek V4 Flashは画像を読み取れますか?
いいえ。これはテキストモデルであり、テキストを入力してテキストを出力します。DeepSeek V4.1 FlashおよびV4 Flash vision-expバリアントは画像を理解できる別のモデルであるため、プロンプトにスクリーンショットや図表が含まれる場合はそれらを使用してください。
長いコンテキストは何に役立ちますか?
1つのリクエストでリポジトリ全体や大量のドキュメントを扱えるため、モデルは間に検索を挟むことなく、動作の実装箇所や変更が影響するファイルを回答できます。同じ資料を繰り返し送信する場合は、プロンプトキャッシングと組み合わせてください。
古いdeepseek-chatおよびdeepseek-reasonerの名称はどうなりましたか?
DeepSeekは2026年7月24日にこれらを廃止しました。移行期間中、これらは非思考モードおよび思考モードのV4 Flashにマッピングされていました。新しいコードでは、モードごとに異なる名称に依存するのではなく、deepseek-v4-flashを呼び出し、思考オプションを設定するようにしてください。
DeepSeek V4 Flash の料金はいくらですか?
TokenLab では DeepSeek V4 Flash は 入力 $0.15 / 出力 $0.60 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
DeepSeek V4 Flash のコンテキストウィンドウと出力制限は?
DeepSeek V4 Flash は最大 1,000,000 トークンのコンテキストに対応し、1回のレスポンスで最大 384,000 トークンまで出力可能です。
DeepSeek V4 Flash はどのエンドポイントを使うべきですか?
DeepSeek V4 Flash のデフォルトは https://api.tokenlab.sh/v1/responses です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
DeepSeek V4 Flash はどの操作に対応していますか?
DeepSeek V4 Flash は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
DeepSeek V4 Flash を比較する
DeepSeek V4 Flash を活用するガイド
ソース
2026/10/02 時点での評価