每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

DeepSeek: DeepSeek V4 Pro

DeepSeek V4 Pro 快照版本,支持百万 token 上下文以及思考与非思考模式
对比模型
deepseek-v4-pro
可用DeepSeek聊天
输入 / 输出
$0.66 / $1.98
上下文
1M
发布日期
2026年4月24日
最大输出
384K
模态
聊天
能力
工具调用提示词缓存推理

DeepSeek V4 Pro 简介

DeepSeek V4 Pro 是 DeepSeek V4 这一代中较大的模型,是开放权重的混合专家模型,总参数 1.6T,激活参数 49B。DeepSeek 把它用于智能体编程、数学、STEM 推理和广泛的世界知识,希望与闭源前沿模型一较高下。它提供思考和非思考两种模式,思考有三档强度,支持工具调用和 JSON 输出,只读取文本。

擅长的任务

  • DeepSeek 称它在智能体编程评测上是开源模型中的最先进水平,世界知识只落后于 Gemini 3.1 Pro。
  • 思考模式有 low、high 和 max 三档强度,困难的数学、STEM 和调试问题可以比日常问题给予多得多的推理。
  • 支持工具调用、JSON 输出和提示词缓存,适合反复发送长系统提示词的智能体循环。
  • 权重开放,同时也自行部署的团队可以先评估同一系列模型再做决定。

什么情况换别的模型

  • 只读取文本;截图和图表类工作需要 deepseek-v4.1-flash 或 Flash vision-exp 版本。
  • 它是较重的 V4 模型,任务不需要额外的推理深度时,V4 Flash 回答更快。
  • max 强度会产生很长的推理,增加延迟和 token,使用工具的对话还必须在每个回合传回推理文本。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

价格

TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

计价时段 · 非峰值时段

每 1M token
官方价格
输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66
Official
输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66
折扣
—

计价时段 · 峰值时段

每 1M token
官方价格
输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32
Official
输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32
折扣
—
提示词缓存价格

缓存读取

官方价格
$0.022
Official
$0.022
折扣
—

缓存写入

官方价格
$0.66
Official
$0.66
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
99.9%
30 天请求数
100+
最后活动时间
53秒钟前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

DeepSeek V4 Pro 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 deepseek-v4-pro 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 自主编程智能体

    在终端或 IDE 智能体里当规划者,长时间会话中编辑多个文件、运行测试并应对失败。

  • 高难度技术推理

    交给它证明、算法设计、科学推导或棘手的并发缺陷,最后一遍把推理强度设为 max。

  • 知识密集的问答

    提出需要跨领域广泛事实记忆的问题,比如比较不同标准,或解释两种技术如何相互作用。

  • Flash 之后的升级层

    日常请求交给 V4 Flash,只把没通过校验或需要更深入分析的请求交给 Pro。

提示词示例

这个后端在高负载下死锁。附上了线程转储和两个获取锁的模块。找出加锁顺序的问题并写出补丁。

证明下面的算法会终止,并给出最坏情况下的复杂度,再指出任何会让这个论证失效的输入。

规划把我们的 REST 处理器迁移到新网关,按顺序列出受影响的模块,每一步之后用 shell 工具运行测试。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

什么时候该用 DeepSeek V4 Pro 而不是 V4 Flash?

智能体编程、高难度推理和需要广泛事实知识的问题用 Pro。DeepSeek 称 Flash 在推理和简单智能体工作上接近 Pro,所以在 Flash 做错任务、或出错代价高时,Pro 最有价值。

DeepSeek V4 Pro 的思考强度怎么用?

开启思考,然后选择 low、high 或 max。high 是默认值,适合日常智能体任务,low 适合简单任务,max 留给最复杂的问题。强度越高,推理文本越多,等待答案的时间也越长。

DeepSeek V4 Pro 是开源的吗?

DeepSeek 以开放权重发布了 V4 这一代,Pro 模型总参数 1.6T,每个 token 激活 49B。通过 API 调用不需要自己部署任何东西;如果想评估或自行部署同一系列,开放发布才有意义。

DeepSeek V4 Pro 接受图像吗?

不接受。它只读写文本。DeepSeek 的图像理解由基于 Flash 的独立模型提供,所以既要看截图又要做高难度推理的工作流,需要把步骤分到两个模型上。

DeepSeek V4 Pro 能用 OpenAI SDK 或 Anthropic SDK 调用吗?

两种都可以。DeepSeek 的文档说明兼容 OpenAI 和 Anthropic 两种 API 格式,保留现有客户端,改一下模型名和 base URL 即可。

DeepSeek V4 Pro 的费用是多少?

在 TokenLab 上,DeepSeek V4 Pro 的价格为 输入 $0.66 / 输出 $1.98 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

DeepSeek V4 Pro 的上下文窗口和输出上限是多少?

DeepSeek V4 Pro 最多接收 1,000,000 token 的上下文,单次最多返回 384,000 token。

DeepSeek V4 Pro 应该使用哪个端点?

DeepSeek V4 Pro 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

DeepSeek V4 Pro 支持哪些操作?

DeepSeek V4 Pro 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

DeepSeek V4 Pro 对比

用到 DeepSeek V4 Pro 的指南

资料来源

审阅于 2026年10月2日

更多 DeepSeek V4 模型

相关模型