Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

DeepSeek: DeepSeek V4 Pro

Snapshot do DeepSeek V4 Pro com contexto de um milhão de tokens e suporte para modos de pensamento e não-pensamento
Comparar modelos
deepseek-v4-pro
DisponívelDeepSeekChat
Entrada / Saída
$0.66 / $1.98
Contexto
1M
Lançado
24 de abr. de 2026
Saída máxima
384K
Modalidades
Chat
Capacidades
Uso de ferramentasCache de promptsRaciocínio

Sobre o DeepSeek V4 Pro

O DeepSeek V4 Pro é o modelo maior da geração V4 do DeepSeek, um modelo de mistura de especialistas (MoE) de pesos abertos com 1,6T de parâmetros totais e 49B ativos. O DeepSeek o direciona para codificação agentica, matemática, raciocínio STEM e amplo conhecimento de mundo, onde pretende rivalizar com modelos de fronteira fechados. Ele oferece modos de pensamento e não pensamento com três níveis de esforço, chamadas de ferramenta e saída JSON, e lê apenas texto.

Pontos fortes

  • O DeepSeek o chama de estado da arte de código aberto em benchmarks de codificação agentica e diz que seu conhecimento de mundo fica atrás apenas do Gemini 3.1 Pro.
  • O modo de pensamento tem esforço baixo, alto e máximo, para que problemas difíceis de matemática, STEM e depuração possam receber muito mais raciocínio do que os de rotina.
  • Chamadas de ferramenta, saída JSON e cache de prompt são suportados, para que ele se encaixe em loops de agente que repetem um longo prompt de sistema.
  • Os pesos são abertos, para que equipes que também hospedam seus próprios modelos possam avaliar a mesma família de modelos antes de se comprometerem.

Quando usar outro modelo

  • Ele lê apenas texto; o trabalho com capturas de tela e diagramas precisa do deepseek-v4.1-flash ou da variante Flash vision-exp.
  • Ele é o modelo V4 mais pesado, portanto, o V4 Flash responde mais rápido quando uma tarefa não precisa da profundidade de raciocínio extra.
  • O esforço máximo produz um raciocínio longo que adiciona atraso e tokens, e as conversas de ferramentas devem passar o texto de raciocínio de volta a cada turno.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para textoResponses API
    POST/v1/responses
    Formato da API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

Preço

O preço TokenLab aplica-se ao Verified, que é mais barato na maioria dos modelos. O preço oficial segue a tabela do criador e aplica-se à rota Official, que é mais confiável. O modo Auto cobra pela rota que finalizar o seu pedido.

Faixa tarifária · Horário fora de pico

Por 1M Token
Preço oficial
Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66
Official
Entrada $0.66 / Saída $1.98 / Leitura de cache $0.022 / Escrita de cache $0.66
Desconto
—

Faixa tarifária · Horário de pico

Por 1M Token
Preço oficial
Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32
Official
Entrada $1.32 / Saída $3.96 / Leitura de cache $0.044 / Escrita de cache $1.32
Desconto
—
Preços de cache de prompt

Leitura de cache

Preço oficial
$0.022
Official
$0.022
Desconto
—

Escrita de cache

Preço oficial
$0.66
Official
$0.66
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
Taxa de sucesso em 30 dias
99,9%
Requisições em 30 dias
100+
Última atividade
há 3 horas

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra DeepSeek V4 Pro no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar deepseek-v4-pro com uma mensagem em /v1/responses. Exiba a resposta, latência e custo.

Casos de uso

Indicado para
  • Raciocínio
  • Agentes de codificação autônomos

    Execute-o como o planejador em um terminal ou agente de IDE que edita muitos arquivos, executa testes e reage a falhas durante uma longa sessão.

  • Raciocínio técnico difícil

    Forneça provas, design de algoritmos, derivações científicas ou bugs de concorrência complicados e defina o esforço de raciocínio para o máximo para a passagem final.

  • Resposta a perguntas com uso intensivo de conhecimento

    Faça perguntas que precisem de ampla recuperação factual entre campos, como comparar padrões ou explicar como duas tecnologias interagem.

  • Nível de escalonamento atrás do Flash

    Envie solicitações de rotina para o V4 Flash e passe apenas aquelas que falham na validação ou precisam de análise mais profunda para o Pro.

Exemplos de prompt

Este backend trava sob carga. O dump da thread e os dois módulos de aquisição de bloqueio estão anexados. Encontre o problema de ordenação e escreva o patch.

Prove que o algoritmo abaixo termina e indique sua complexidade de pior caso, depois aponte qualquer entrada que quebre o argumento.

Planeje uma migração de nossos manipuladores REST para o novo gateway, liste os módulos afetados em ordem e execute os testes após cada etapa usando a ferramenta de shell.

Este modelo tem preço condicional. Totais mensais de tokens sozinhos não produzem uma estimativa confiável; use o preço detalhado para a especificação da requisição, cache e janela aplicável.

FAQ

Quando devo usar o DeepSeek V4 Pro em vez do V4 Flash?

Use o Pro para codificação agentica, raciocínio difícil e perguntas que precisam de amplo conhecimento factual. O DeepSeek diz que o Flash chega perto no raciocínio e no trabalho de agente simples, então o Pro é mais importante quando o Flash erra uma tarefa ou quando um erro é caro.

Como funcionam os níveis de esforço de pensamento no DeepSeek V4 Pro?

Você ativa o pensamento e escolhe baixo, alto ou máximo. O alto é o padrão e atende a tarefas de agente do dia a dia, o baixo atende a tarefas simples e o máximo é para os problemas mais complexos. Esforço maior significa mais texto de raciocínio e uma espera mais longa antes da resposta.

O DeepSeek V4 Pro é de código aberto?

O DeepSeek lançou a geração V4 com pesos abertos, e o modelo Pro tem 1,6T de parâmetros totais com 49B ativos por token. Chamá-lo através da API não requer hospedar nada; o lançamento aberto importa se você quiser avaliar ou hospedar a mesma família.

O DeepSeek V4 Pro aceita imagens?

Não. Ele lê e escreve apenas texto. O DeepSeek envia a compreensão de imagens em modelos baseados em Flash separados, portanto, um fluxo de trabalho que precise de capturas de tela e raciocínio difícil precisa dividir as etapas entre dois modelos.

O DeepSeek V4 Pro funciona com o SDK da OpenAI ou o SDK da Anthropic?

Ambos. O DeepSeek documenta a compatibilidade com os formatos de API da OpenAI e da Anthropic, para que você possa manter seu cliente existente e alterar o nome do modelo e a URL base.

Quanto custa o DeepSeek V4 Pro?

No TokenLab, DeepSeek V4 Pro custa Entrada $0.66 / Saída $1.98 Por 1M Token. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual a janela de contexto e o limite de saída do DeepSeek V4 Pro?

O DeepSeek V4 Pro aceita até 1.000.000 tokens de contexto e gera até 384.000 tokens por resposta.

Qual endpoint o DeepSeek V4 Pro deve usar?

Use https://api.tokenlab.sh/v1/responses para DeepSeek V4 Pro. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o DeepSeek V4 Pro suporta?

DeepSeek V4 Pro suporta Texto para texto. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar DeepSeek V4 Pro

Guias com DeepSeek V4 Pro

Fontes

Revisado em 2 de out. de 2026

Mais da série DeepSeek V4

Modelos relacionados