Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

DeepSeek: DeepSeek V4 Pro

Instantánea de DeepSeek V4 Pro con contexto de un millón de tokens y soporte para modos de pensamiento y sin pensamiento
Comparar modelos
deepseek-v4-pro
DisponibleDeepSeekChat
Entrada / Salida
$0.66 / $1.98
Contexto
1M
Lanzado
24 abr 2026
Salida máxima
384K
Modalidades
Chat
Capacidades
Uso de herramientasCaché de promptsRazonamiento

Sobre DeepSeek V4 Pro

DeepSeek V4 Pro es el modelo más grande de la generación V4 de DeepSeek, un modelo de mezcla de expertos de pesos abiertos con 1,6 billones de parámetros totales y 49 mil millones activos. DeepSeek lo orienta a la programación agentica, matemáticas, razonamiento STEM y conocimiento general del mundo, donde busca rivalizar con modelos de frontera cerrados. Ofrece modos de pensamiento y sin pensamiento con tres niveles de esfuerzo, llamadas a herramientas y salida JSON, y solo lee texto.

Puntos fuertes

  • DeepSeek lo llama el estado del arte de código abierto en puntos de referencia de programación agentica y dice que su conocimiento del mundo solo está por detrás de Gemini 3.1 Pro.
  • El modo de pensamiento tiene esfuerzo bajo, alto y máximo, por lo que los problemas difíciles de matemáticas, STEM y depuración pueden recibir mucho más razonamiento que los rutinarios.
  • Se admiten llamadas a herramientas, salida JSON y almacenamiento en caché de prompts, por lo que se adapta a bucles de agentes que repiten un prompt del sistema largo.
  • Los pesos son abiertos, por lo que los equipos que también se autoalojan pueden evaluar la misma familia de modelos antes de comprometerse.

Cuándo buscar otra opción

  • Solo lee texto; el trabajo con capturas de pantalla y diagramas requiere deepseek-v4.1-flash o la variante Flash vision-exp.
  • Es el modelo V4 más pesado, por lo que V4 Flash responde más rápido cuando una tarea no necesita la profundidad de razonamiento adicional.
  • El esfuerzo máximo produce un razonamiento largo que añade retraso y tokens, y las conversaciones con herramientas deben devolver el texto de razonamiento en cada turno.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a textoResponses API
    POST/v1/responses
    Formato de API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

Precios

El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.

Franja tarifaria · Horas valle

Por 1M Token
Precio Official
Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66
Official
Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66
Descuento
—

Franja tarifaria · Horas punta

Por 1M Token
Precio Official
Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32
Official
Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32
Descuento
—
Precios de caché de prompt

Lectura de caché

Precio Official
$0.022
Official
$0.022
Descuento
—

Escritura de caché

Precio Official
$0.66
Official
$0.66
Descuento
—

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Tasa de éxito 30 días
99,9%
Solicitudes 30 días
100+
Última actividad
hace 2 minutos

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre DeepSeek V4 Pro en Console con un prompt listo para editar o enviar.

Ayúdame a probar deepseek-v4-pro con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.

Casos de uso

Ideal para
  • Razonamiento
  • Agentes de programación autónomos

    Ejecútelo como planificador en un terminal o agente de IDE que edita muchos archivos, ejecuta pruebas y reacciona a fallos durante una sesión larga.

  • Razonamiento técnico difícil

    Delégueles pruebas, diseño de algoritmos, derivaciones científicas o errores de concurrencia complicados y establezca el esfuerzo de razonamiento al máximo para la pasada final.

  • Respuesta a preguntas con gran carga de conocimiento

    Haga preguntas que necesiten una amplia recuperación de hechos en todos los campos, como comparar estándares o explicar cómo interactúan dos tecnologías.

  • Nivel de escalada detrás de Flash

    Envíe solicitudes rutinarias a V4 Flash y pase a Pro solo aquellas que fallen la validación o necesiten un análisis más profundo.

Ejemplos de prompts

Este backend se bloquea bajo carga. Se adjuntan el volcado de hilos y los dos módulos que adquieren bloqueos. Encuentre el problema de orden y escriba el parche.

Demuestre que el algoritmo a continuación termina y establezca su complejidad en el peor de los casos, luego señale cualquier entrada que rompa el argumento.

Planifique una migración de nuestros manejadores REST a la nueva puerta de enlace, enumere los módulos afectados en orden y ejecute las pruebas después de cada paso usando la herramienta de shell.

Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.

FAQ

¿Cuándo debería usar DeepSeek V4 Pro en lugar de V4 Flash?

Use Pro para programación agentica, razonamiento difícil y preguntas que necesiten un amplio conocimiento fáctico. DeepSeek dice que Flash se acerca en razonamiento y trabajo de agente simple, por lo que Pro es más importante cuando Flash se equivoca en una tarea o cuando un error es costoso.

¿Cómo funcionan los niveles de esfuerzo de pensamiento en DeepSeek V4 Pro?

Usted activa el pensamiento y elige bajo, alto o máximo. Alto es el predeterminado y se adapta a las tareas cotidianas de los agentes, bajo se adapta a las simples y máximo es para los problemas más complejos. Un mayor esfuerzo significa más texto de razonamiento y una espera más larga antes de la respuesta.

¿Es DeepSeek V4 Pro de código abierto?

DeepSeek lanzó la generación V4 con pesos abiertos, y el modelo Pro tiene 1,6 billones de parámetros totales con 49 mil millones activos por token. Llamarlo a través de la API no requiere alojar nada; el lanzamiento abierto importa si desea evaluar o autoalojar la misma familia.

¿DeepSeek V4 Pro acepta imágenes?

No. Solo lee y escribe texto. DeepSeek incluye la comprensión de imágenes en modelos separados basados en Flash, por lo que un flujo de trabajo que necesite tanto capturas de pantalla como razonamiento difícil tiene que dividir los pasos entre dos modelos.

¿DeepSeek V4 Pro funciona con el SDK de OpenAI o el SDK de Anthropic?

Ambos. DeepSeek documenta la compatibilidad con los formatos de API de OpenAI y Anthropic, por lo que puede mantener su cliente existente y cambiar el nombre del modelo y la URL base.

¿Cuánto cuesta DeepSeek V4 Pro?

En TokenLab, DeepSeek V4 Pro cuesta Entrada $0.66 / Salida $1.98 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Cuál es la ventana de contexto y el límite de salida de DeepSeek V4 Pro?

DeepSeek V4 Pro admite hasta 1.000.000 tokens de contexto y genera hasta 384.000 tokens por respuesta.

¿Qué endpoint debe usar DeepSeek V4 Pro?

Utiliza https://api.tokenlab.sh/v1/responses para DeepSeek V4 Pro. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta DeepSeek V4 Pro?

DeepSeek V4 Pro admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar DeepSeek V4 Pro

Guías con DeepSeek V4 Pro

Fuentes

Revisado el 2 oct 2026

Más de DeepSeek V4

Modelos relacionados