DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- Entrada / Saída
- $0.66 / $1.98
- Contexto
- 1M
- Lançado
- 24 de abr. de 2026
- Saída máxima
- 384K
- Modalidades
- Chat
- Capacidades
- Uso de ferramentasCache de promptsRaciocínio
Sobre o DeepSeek V4 Pro
O DeepSeek V4 Pro é o modelo maior da geração V4 do DeepSeek, um modelo de mistura de especialistas (MoE) de pesos abertos com 1,6T de parâmetros totais e 49B ativos. O DeepSeek o direciona para codificação agentica, matemática, raciocínio STEM e amplo conhecimento de mundo, onde pretende rivalizar com modelos de fronteira fechados. Ele oferece modos de pensamento e não pensamento com três níveis de esforço, chamadas de ferramenta e saída JSON, e lê apenas texto.
Pontos fortes
- O DeepSeek o chama de estado da arte de código aberto em benchmarks de codificação agentica e diz que seu conhecimento de mundo fica atrás apenas do Gemini 3.1 Pro.
- O modo de pensamento tem esforço baixo, alto e máximo, para que problemas difíceis de matemática, STEM e depuração possam receber muito mais raciocínio do que os de rotina.
- Chamadas de ferramenta, saída JSON e cache de prompt são suportados, para que ele se encaixe em loops de agente que repetem um longo prompt de sistema.
- Os pesos são abertos, para que equipes que também hospedam seus próprios modelos possam avaliar a mesma família de modelos antes de se comprometerem.
Quando usar outro modelo
- Ele lê apenas texto; o trabalho com capturas de tela e diagramas precisa do deepseek-v4.1-flash ou da variante Flash vision-exp.
- Ele é o modelo V4 mais pesado, portanto, o V4 Flash responde mais rápido quando uma tarefa não precisa da profundidade de raciocínio extra.
- O esforço máximo produz um raciocínio longo que adiciona atraso e tokens, e as conversas de ferramentas devem passar o texto de raciocínio de volta a cada turno.
Primeiros passos
Criar chave de API
Crie uma chave no Console e use com qualquer modelo da plataforma.
Envie sua primeira requisição
Copie o exemplo para sua linguagem e execute-o no endpoint.
Texto para textoResponses APIPOST/v1/responsesFormato da API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
Preço
O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.
Faixa tarifária · Horário fora de pico
Por 1M Token- Preço oficial
- Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66
- Official
- Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66
- Desconto
- —
Faixa tarifária · Horário de pico
Por 1M Token- Preço oficial
- Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32
- Official
- Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32
- Desconto
- —
Leitura de cache
- Preço oficial
- $0.022
- Official
- $0.022
- Desconto
- —
Escrita de cache
- Preço oficial
- $0.66
- Official
- $0.66
- Desconto
- —
| Preço oficialPor 1M Token | OfficialPor 1M Token | Desconto | |
|---|---|---|---|
| Faixa tarifária · Horário fora de pico | Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66 | Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66 | — |
| Faixa tarifária · Horário de pico | Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32 | Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32 | — |
| Preços de cache de prompt | |||
| Leitura de cache | $0.022 | $0.022 | — |
| Escrita de cache | $0.66 | $0.66 | — |
Uso e atividade
A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.
Uso e disponibilidade
Últimas 24 horas- Requisições
- Taxa de sucesso
- Latência P95
- Total de tokens
- Taxa de sucesso em 30 dias
- 99,9%
- Requisições em 30 dias
- 100+
- Última atividade
- há 3 horas
Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.
Abrir no Console
Abra DeepSeek V4 Pro no Console com um prompt pronto para editar ou enviar.
Ajude-me a testar deepseek-v4-pro com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.
Casos de uso
Indicado para- Raciocínio
Agentes de codificação autônomos
Execute-o como o planejador em um terminal ou agente de IDE que edita muitos arquivos, executa testes e reage a falhas durante uma longa sessão.
Raciocínio técnico difícil
Forneça provas, design de algoritmos, derivações científicas ou bugs de concorrência complicados e defina o esforço de raciocínio para o máximo para a passagem final.
Resposta a perguntas com uso intensivo de conhecimento
Faça perguntas que precisem de ampla recuperação factual entre campos, como comparar padrões ou explicar como duas tecnologias interagem.
Nível de escalonamento atrás do Flash
Envie solicitações de rotina para o V4 Flash e passe apenas aquelas que falham na validação ou precisam de análise mais profunda para o Pro.
Exemplos de prompt
Este backend trava sob carga. O dump da thread e os dois módulos de aquisição de bloqueio estão anexados. Encontre o problema de ordenação e escreva o patch.
Prove que o algoritmo abaixo termina e indique sua complexidade de pior caso, depois aponte qualquer entrada que quebre o argumento.
Planeje uma migração de nossos manipuladores REST para o novo gateway, liste os módulos afetados em ordem e execute os testes após cada etapa usando a ferramenta de shell.
Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.
FAQ
Quando devo usar o DeepSeek V4 Pro em vez do V4 Flash?
Use o Pro para codificação agentica, raciocínio difícil e perguntas que precisam de amplo conhecimento factual. O DeepSeek diz que o Flash chega perto no raciocínio e no trabalho de agente simples, então o Pro é mais importante quando o Flash erra uma tarefa ou quando um erro é caro.
Como funcionam os níveis de esforço de pensamento no DeepSeek V4 Pro?
Você ativa o pensamento e escolhe baixo, alto ou máximo. O alto é o padrão e atende a tarefas de agente do dia a dia, o baixo atende a tarefas simples e o máximo é para os problemas mais complexos. Esforço maior significa mais texto de raciocínio e uma espera mais longa antes da resposta.
O DeepSeek V4 Pro é de código aberto?
O DeepSeek lançou a geração V4 com pesos abertos, e o modelo Pro tem 1,6T de parâmetros totais com 49B ativos por token. Chamá-lo através da API não requer hospedar nada; o lançamento aberto importa se você quiser avaliar ou hospedar a mesma família.
O DeepSeek V4 Pro aceita imagens?
Não. Ele lê e escreve apenas texto. O DeepSeek envia a compreensão de imagens em modelos baseados em Flash separados, portanto, um fluxo de trabalho que precise de capturas de tela e raciocínio difícil precisa dividir as etapas entre dois modelos.
O DeepSeek V4 Pro funciona com o SDK da OpenAI ou o SDK da Anthropic?
Ambos. O DeepSeek documenta a compatibilidade com os formatos de API da OpenAI e da Anthropic, para que você possa manter seu cliente existente e alterar o nome do modelo e a URL base.
Quanto custa o DeepSeek V4 Pro?
No TokenLab, DeepSeek V4 Pro custa Entrada $0.66 / Saída $1.98 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.
Qual a janela de contexto e o limite de saída do DeepSeek V4 Pro?
O DeepSeek V4 Pro aceita até 1.000.000 tokens de contexto e gera até 384.000 tokens por resposta.
Qual endpoint o DeepSeek V4 Pro deve usar?
Use https://api.tokenlab.sh/v1/responses para DeepSeek V4 Pro. O exemplo de requisição abaixo mostra o formato de código correspondente.
Quais operações o DeepSeek V4 Pro suporta?
DeepSeek V4 Pro suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.
Comparar DeepSeek V4 Pro
Guias com DeepSeek V4 Pro
- Alternativa à API da Venice AI: Privacidade, Acesso a Modelos e Adequação para Desenvolvedores
- Alternativa ao Together AI: Quando você precisa da simplicidade de um gateway, não de infraestrutura
- Melhores modelos de IA para programação em 2026: Comparativo entre GPT-5.5, Claude Sonnet 5, Gemini 3.5 Flash e DeepSeek V4
Fontes
Revisado em 2 de out. de 2026