DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- 输入 / 输出
- $0.66 / $1.98
- 上下文
- 1M
- 发布日期
- 2026年4月24日
- 最大输出
- 384K
- 模态
- 聊天
- 能力
- 工具调用提示词缓存推理
DeepSeek V4 Pro 简介
DeepSeek V4 Pro 是 DeepSeek V4 这一代中较大的模型,是开放权重的混合专家模型,总参数 1.6T,激活参数 49B。DeepSeek 把它用于智能体编程、数学、STEM 推理和广泛的世界知识,希望与闭源前沿模型一较高下。它提供思考和非思考两种模式,思考有三档强度,支持工具调用和 JSON 输出,只读取文本。
擅长的任务
- DeepSeek 称它在智能体编程评测上是开源模型中的最先进水平,世界知识只落后于 Gemini 3.1 Pro。
- 思考模式有 low、high 和 max 三档强度,困难的数学、STEM 和调试问题可以比日常问题给予多得多的推理。
- 支持工具调用、JSON 输出和提示词缓存,适合反复发送长系统提示词的智能体循环。
- 权重开放,同时也自行部署的团队可以先评估同一系列模型再做决定。
什么情况换别的模型
- 只读取文本;截图和图表类工作需要 deepseek-v4.1-flash 或 Flash vision-exp 版本。
- 它是较重的 V4 模型,任务不需要额外的推理深度时,V4 Flash 回答更快。
- max 强度会产生很长的推理,增加延迟和 token,使用工具的对话还必须在每个回合传回推理文本。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
价格
TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
计价时段 · 非峰值时段
每 1M token- 官方价格
- 输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66
- Official
- 输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66
- 折扣
- —
计价时段 · 峰值时段
每 1M token- 官方价格
- 输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32
- Official
- 输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32
- 折扣
- —
缓存读取
- 官方价格
- $0.022
- Official
- $0.022
- 折扣
- —
缓存写入
- 官方价格
- $0.66
- Official
- $0.66
- 折扣
- —
| 官方价格每 1M token | Official每 1M token | 折扣 | |
|---|---|---|---|
| 计价时段 · 非峰值时段 | 输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66 | 输入 $0.66 / 输出 $1.98 / 缓存读取 $0.022 / 缓存写入 $0.66 | — |
| 计价时段 · 峰值时段 | 输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32 | 输入 $1.32 / 输出 $3.96 / 缓存读取 $0.044 / 缓存写入 $1.32 | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.022 | $0.022 | — |
| 缓存写入 | $0.66 | $0.66 | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 99.9%
- 30 天请求数
- 100+
- 最后活动时间
- 53秒钟前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
DeepSeek V4 Pro 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 deepseek-v4-pro 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
自主编程智能体
在终端或 IDE 智能体里当规划者,长时间会话中编辑多个文件、运行测试并应对失败。
高难度技术推理
交给它证明、算法设计、科学推导或棘手的并发缺陷,最后一遍把推理强度设为 max。
知识密集的问答
提出需要跨领域广泛事实记忆的问题,比如比较不同标准,或解释两种技术如何相互作用。
Flash 之后的升级层
日常请求交给 V4 Flash,只把没通过校验或需要更深入分析的请求交给 Pro。
提示词示例
这个后端在高负载下死锁。附上了线程转储和两个获取锁的模块。找出加锁顺序的问题并写出补丁。
证明下面的算法会终止,并给出最坏情况下的复杂度,再指出任何会让这个论证失效的输入。
规划把我们的 REST 处理器迁移到新网关,按顺序列出受影响的模块,每一步之后用 shell 工具运行测试。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
什么时候该用 DeepSeek V4 Pro 而不是 V4 Flash?
智能体编程、高难度推理和需要广泛事实知识的问题用 Pro。DeepSeek 称 Flash 在推理和简单智能体工作上接近 Pro,所以在 Flash 做错任务、或出错代价高时,Pro 最有价值。
DeepSeek V4 Pro 的思考强度怎么用?
开启思考,然后选择 low、high 或 max。high 是默认值,适合日常智能体任务,low 适合简单任务,max 留给最复杂的问题。强度越高,推理文本越多,等待答案的时间也越长。
DeepSeek V4 Pro 是开源的吗?
DeepSeek 以开放权重发布了 V4 这一代,Pro 模型总参数 1.6T,每个 token 激活 49B。通过 API 调用不需要自己部署任何东西;如果想评估或自行部署同一系列,开放发布才有意义。
DeepSeek V4 Pro 接受图像吗?
不接受。它只读写文本。DeepSeek 的图像理解由基于 Flash 的独立模型提供,所以既要看截图又要做高难度推理的工作流,需要把步骤分到两个模型上。
DeepSeek V4 Pro 能用 OpenAI SDK 或 Anthropic SDK 调用吗?
两种都可以。DeepSeek 的文档说明兼容 OpenAI 和 Anthropic 两种 API 格式,保留现有客户端,改一下模型名和 base URL 即可。
DeepSeek V4 Pro 的费用是多少?
在 TokenLab 上,DeepSeek V4 Pro 的价格为 输入 $0.66 / 输出 $1.98 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
DeepSeek V4 Pro 的上下文窗口和输出上限是多少?
DeepSeek V4 Pro 最多接收 1,000,000 token 的上下文,单次最多返回 384,000 token。
DeepSeek V4 Pro 应该使用哪个端点?
DeepSeek V4 Pro 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
DeepSeek V4 Pro 支持哪些操作?
DeepSeek V4 Pro 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
DeepSeek V4 Pro 对比
用到 DeepSeek V4 Pro 的指南
资料来源
审阅于 2026年10月2日