為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

DeepSeek: DeepSeek V4 Pro

具備百萬級 Token 上下文並支援思考與非思考模式的 DeepSeek V4 Pro 快照版本
比較模型
deepseek-v4-pro
可用DeepSeek對話
輸入 / 輸出
$0.66 / $1.98
上下文
1M
發布日期
2026年4月24日
最大輸出長度
384K
模態
對話
能力
工具使用提示詞快取推理

關於 DeepSeek V4 Pro

DeepSeek V4 Pro 是 DeepSeek V4 世代中較大的模型,這是一款開放權重的混合專家模型(MoE),總參數為 1.6T,活躍參數為 49B。DeepSeek 將其定位於代理編碼、數學、STEM 推理和廣泛的世界知識,旨在與封閉的頂尖模型競爭。它提供三種努力程度的思考與非思考模式、工具呼叫與 JSON 輸出,且僅讀取文字。

適用場景

  • DeepSeek 稱其為代理編碼基準測試中的開源頂尖模型,並表示其世界知識僅次於 Gemini 3.1 Pro。
  • 思考模式具有低、高和最大努力程度,因此困難的數學、STEM 和除錯問題可以獲得比常規問題更多的推理資源。
  • 支援工具呼叫、JSON 輸出和提示詞快取(prompt caching),因此適合重複長系統提示詞的代理迴圈。
  • 權重是開放的,因此同時進行自託管的團隊可以在投入使用前評估同一個模型系列。

其他選擇建議

  • 它僅讀取文字;螢幕截圖和圖表工作需要 deepseek-v4.1-flash 或 Flash vision-exp 變體。
  • 它是較重的 V4 模型,因此當任務不需要額外的推理深度時,V4 Flash 的回答速度更快。
  • 最大努力程度會產生冗長的推理過程,這會增加延遲和 Token 消耗,且工具對話必須在每一輪傳回推理文字。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

定價

Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。

計價時段 · 離峰時段

每 1M Token
Official 定價
輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66
Official
輸入 $0.66 / 輸出 $1.98 / 快取讀取 $0.022 / 快取寫入 $0.66
折扣
—

計價時段 · 尖峰時段

每 1M Token
Official 定價
輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32
Official
輸入 $1.32 / 輸出 $3.96 / 快取讀取 $0.044 / 快取寫入 $1.32
折扣
—
Prompt 快取價格

快取讀取

Official 定價
$0.022
Official
$0.022
折扣
—

快取寫入

Official 定價
$0.66
Official
$0.66
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
99.9%
近 30 日請求數
100+
最後活動時間
13 分鐘前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 DeepSeek V4 Pro,並準備好編輯或發送提示詞。

協助我使用 deepseek-v4-pro 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 自主編碼代理

    將其作為終端或 IDE 代理中的規劃器執行,以在長時間的會話中編輯多個檔案、執行測試並對失敗做出反應。

  • 高難度技術推理

    提供證明、演算法設計、科學推導或棘手的併發錯誤,並將推理努力程度設定為最大以進行最終處理。

  • 知識密集型問答

    詢問需要跨領域廣泛事實回憶的問題,例如比較標準或解釋兩種技術如何互動。

  • Flash 之後的升級層級

    將常規請求發送給 V4 Flash,僅將驗證失敗或需要更深入分析的請求傳遞給 Pro。

提示詞範例

此後端在負載下發生死鎖。已附上執行緒傾印(thread dump)和兩個鎖定獲取模組。請找出排序問題並編寫修補程式。

證明下方的演算法會終止並說明其最壞情況複雜度,然後指出任何會破壞該論點的輸入。

規劃從我們的 REST 處理器遷移到新閘道的過程,按順序列出受影響的模組,並在每個步驟後使用 shell 工具執行測試。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

我應該何時使用 DeepSeek V4 Pro 而非 V4 Flash?

在代理編碼、困難推理和需要廣泛事實知識的問題上使用 Pro。DeepSeek 表示 Flash 在推理和簡單代理工作上表現接近,因此當 Flash 處理任務出錯或錯誤代價高昂時,Pro 就顯得至關重要。

DeepSeek V4 Pro 的思考努力程度是如何運作的?

您可以啟用思考並選擇低、高或最大程度。高是預設值,適合日常代理任務;低適合簡單任務;最大則用於最複雜的問題。努力程度越高,意味著推理文字越多,等待回答的時間也越長。

DeepSeek V4 Pro 是開源的嗎?

DeepSeek 發布了具有開放權重的 V4 世代,Pro 模型總參數為 1.6T,每個 Token 活躍參數為 49B。透過 API 呼叫它不需要託管任何東西;開放發布的意義在於如果您想評估或自託管同一個系列模型。

DeepSeek V4 Pro 接受圖片嗎?

不接受。它僅讀取和寫入文字。DeepSeek 在獨立的 Flash 系列模型中提供圖片理解功能,因此需要同時處理螢幕截圖和深度推理的工作流程必須將步驟拆分到兩個模型中執行。

DeepSeek V4 Pro 是否支援 OpenAI SDK 或 Anthropic SDK?

兩者皆支援。DeepSeek 記錄了與 OpenAI 和 Anthropic API 格式的相容性,因此您可以保留現有的客戶端,僅需更改模型名稱和基礎 URL。

DeepSeek V4 Pro 的費用是多少?

在 TokenLab 上,DeepSeek V4 Pro 價格為 輸入 $0.66 / 輸出 $1.98 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

DeepSeek V4 Pro 的上下文長度與輸出限制為何?

DeepSeek V4 Pro 支援最高 1,000,000 tokens 的上下文,單次回應上限為 384,000 tokens。

DeepSeek V4 Pro 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 DeepSeek V4 Pro 的呼叫。下方的請求範例展示了對應的程式碼格式。

DeepSeek V4 Pro 支援哪些操作?

DeepSeek V4 Pro 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 DeepSeek V4 Pro

使用 DeepSeek V4 Pro 的指南

來源

更新於 2026年10月2日

更多來自 DeepSeek V4 的模型

相關模型