DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- 輸入 / 輸出
- $0.66 / $1.98
- 上下文
- 1M
- 發布日期
- 2026年4月24日
- 最大輸出長度
- 384K
- 模態
- 對話
- 能力
- 工具使用提示詞快取推理
關於 DeepSeek V4 Pro
DeepSeek V4 Pro 是 DeepSeek V4 世代中較大的模型,這是一款開放權重的混合專家模型(MoE),總參數為 1.6T,活躍參數為 49B。DeepSeek 將其定位於代理編碼、數學、STEM 推理和廣泛的世界知識,旨在與封閉的頂尖模型競爭。它提供三種努力程度的思考與非思考模式、工具呼叫與 JSON 輸出,且僅讀取文字。
適用場景
- DeepSeek 稱其為代理編碼基準測試中的開源頂尖模型,並表示其世界知識僅次於 Gemini 3.1 Pro。
- 思考模式具有低、高和最大努力程度,因此困難的數學、STEM 和除錯問題可以獲得比常規問題更多的推理資源。
- 支援工具呼叫、JSON 輸出和提示詞快取(prompt caching),因此適合重複長系統提示詞的代理迴圈。
- 權重是開放的,因此同時進行自託管的團隊可以在投入使用前評估同一個模型系列。
其他選擇建議
- 它僅讀取文字;螢幕截圖和圖表工作需要 deepseek-v4.1-flash 或 Flash vision-exp 變體。
- 它是較重的 V4 模型,因此當任務不需要額外的推理深度時,V4 Flash 的回答速度更快。
- 最大努力程度會產生冗長的推理過程,這會增加延遲和 Token 消耗,且工具對話必須在每一輪傳回推理文字。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
定價
Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。
計價時段 · 離峰時段
每 1M Token- Official 定價
- 輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66
- Official
- 輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66
- 折扣
- —
計價時段 · 尖峰時段
每 1M Token- Official 定價
- 輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32
- Official
- 輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32
- 折扣
- —
快取讀取
- Official 定價
- $0.022
- Official
- $0.022
- 折扣
- —
快取寫入
- Official 定價
- $0.66
- Official
- $0.66
- 折扣
- —
| Official 定價每 1M Token | Official每 1M Token | 折扣 | |
|---|---|---|---|
| 計價時段 · 離峰時段 | 輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66 | 輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66 | — |
| 計價時段 · 尖峰時段 | 輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32 | 輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32 | — |
| Prompt 快取價格 | |||
| 快取讀取 | $0.022 | $0.022 | — |
| 快取寫入 | $0.66 | $0.66 | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 99.9%
- 近 30 日請求數
- 100+
- 最後活動時間
- 13 分鐘前
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 DeepSeek V4 Pro,並準備好編輯或發送提示詞。
協助我使用 deepseek-v4-pro 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
自主編碼代理
將其作為終端或 IDE 代理中的規劃器執行,以在長時間的會話中編輯多個檔案、執行測試並對失敗做出反應。
高難度技術推理
提供證明、演算法設計、科學推導或棘手的併發錯誤,並將推理努力程度設定為最大以進行最終處理。
知識密集型問答
詢問需要跨領域廣泛事實回憶的問題,例如比較標準或解釋兩種技術如何互動。
Flash 之後的升級層級
將常規請求發送給 V4 Flash,僅將驗證失敗或需要更深入分析的請求傳遞給 Pro。
提示詞範例
此後端在負載下發生死鎖。已附上執行緒傾印(thread dump)和兩個鎖定獲取模組。請找出排序問題並編寫修補程式。
證明下方的演算法會終止並說明其最壞情況複雜度,然後指出任何會破壞該論點的輸入。
規劃從我們的 REST 處理器遷移到新閘道的過程,按順序列出受影響的模組,並在每個步驟後使用 shell 工具執行測試。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
我應該何時使用 DeepSeek V4 Pro 而非 V4 Flash?
在代理編碼、困難推理和需要廣泛事實知識的問題上使用 Pro。DeepSeek 表示 Flash 在推理和簡單代理工作上表現接近,因此當 Flash 處理任務出錯或錯誤代價高昂時,Pro 就顯得至關重要。
DeepSeek V4 Pro 的思考努力程度是如何運作的?
您可以啟用思考並選擇低、高或最大程度。高是預設值,適合日常代理任務;低適合簡單任務;最大則用於最複雜的問題。努力程度越高,意味著推理文字越多,等待回答的時間也越長。
DeepSeek V4 Pro 是開源的嗎?
DeepSeek 發布了具有開放權重的 V4 世代,Pro 模型總參數為 1.6T,每個 Token 活躍參數為 49B。透過 API 呼叫它不需要託管任何東西;開放發布的意義在於如果您想評估或自託管同一個系列模型。
DeepSeek V4 Pro 接受圖片嗎?
不接受。它僅讀取和寫入文字。DeepSeek 在獨立的 Flash 系列模型中提供圖片理解功能,因此需要同時處理螢幕截圖和深度推理的工作流程必須將步驟拆分到兩個模型中執行。
DeepSeek V4 Pro 是否支援 OpenAI SDK 或 Anthropic SDK?
兩者皆支援。DeepSeek 記錄了與 OpenAI 和 Anthropic API 格式的相容性,因此您可以保留現有的客戶端,僅需更改模型名稱和基礎 URL。
DeepSeek V4 Pro 的費用是多少?
在 TokenLab 上,DeepSeek V4 Pro 價格為 輸入 $0.66 / 輸出 $1.98 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
DeepSeek V4 Pro 的上下文長度與輸出限制為何?
DeepSeek V4 Pro 支援最高 1,000,000 tokens 的上下文,單次回應上限為 384,000 tokens。
DeepSeek V4 Pro 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 DeepSeek V4 Pro 的呼叫。下方的請求範例展示了對應的程式碼格式。
DeepSeek V4 Pro 支援哪些操作?
DeepSeek V4 Pro 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 DeepSeek V4 Pro
使用 DeepSeek V4 Pro 的指南
來源
更新於 2026年10月2日