DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- Entrada / Salida
- $0.66 / $1.98
- Contexto
- 1M
- Lanzado
- 24 abr 2026
- Salida máxima
- 384K
- Modalidades
- Chat
- Capacidades
- Uso de herramientasCaché de promptsRazonamiento
Sobre DeepSeek V4 Pro
DeepSeek V4 Pro es el modelo más grande de la generación V4 de DeepSeek, un modelo de mezcla de expertos de pesos abiertos con 1,6 billones de parámetros totales y 49 mil millones activos. DeepSeek lo orienta a la programación agentica, matemáticas, razonamiento STEM y conocimiento general del mundo, donde busca rivalizar con modelos de frontera cerrados. Ofrece modos de pensamiento y sin pensamiento con tres niveles de esfuerzo, llamadas a herramientas y salida JSON, y solo lee texto.
Puntos fuertes
- DeepSeek lo llama el estado del arte de código abierto en puntos de referencia de programación agentica y dice que su conocimiento del mundo solo está por detrás de Gemini 3.1 Pro.
- El modo de pensamiento tiene esfuerzo bajo, alto y máximo, por lo que los problemas difíciles de matemáticas, STEM y depuración pueden recibir mucho más razonamiento que los rutinarios.
- Se admiten llamadas a herramientas, salida JSON y almacenamiento en caché de prompts, por lo que se adapta a bucles de agentes que repiten un prompt del sistema largo.
- Los pesos son abiertos, por lo que los equipos que también se autoalojan pueden evaluar la misma familia de modelos antes de comprometerse.
Cuándo buscar otra opción
- Solo lee texto; el trabajo con capturas de pantalla y diagramas requiere deepseek-v4.1-flash o la variante Flash vision-exp.
- Es el modelo V4 más pesado, por lo que V4 Flash responde más rápido cuando una tarea no necesita la profundidad de razonamiento adicional.
- El esfuerzo máximo produce un razonamiento largo que añade retraso y tokens, y las conversaciones con herramientas deben devolver el texto de razonamiento en cada turno.
Primeros pasos
Crear clave API
Genera una clave en Console y úsala con cualquier modelo de la plataforma.
Envía tu primera solicitud
Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.
Texto a textoResponses APIPOST/v1/responsesFormato de API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
Precios
El precio de TokenLab se aplica a Verified, que es más económico en la mayoría de los modelos. El precio oficial corresponde a la tarifa del fabricante y se aplica a la ruta Official, que es más fiable. Auto cobra según la ruta que complete la solicitud.
Franja tarifaria · Horas valle
Por 1M Token- Precio Official
- Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66
- Official
- Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66
- Descuento
- —
Franja tarifaria · Horas punta
Por 1M Token- Precio Official
- Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32
- Official
- Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32
- Descuento
- —
Lectura de caché
- Precio Official
- $0.022
- Official
- $0.022
- Descuento
- —
Escritura de caché
- Precio Official
- $0.66
- Official
- $0.66
- Descuento
- —
| Precio OfficialPor 1M Token | OfficialPor 1M Token | Descuento | |
|---|---|---|---|
| Franja tarifaria · Horas valle | Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66 | Entrada $0.66 / Salida $1.98 / Lectura de caché $0.022 / Escritura de caché $0.66 | — |
| Franja tarifaria · Horas punta | Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32 | Entrada $1.32 / Salida $3.96 / Lectura de caché $0.044 / Escritura de caché $1.32 | — |
| Precios de caché de prompt | |||
| Lectura de caché | $0.022 | $0.022 | — |
| Escritura de caché | $0.66 | $0.66 | — |
Uso y actividad
La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.
Uso y disponibilidad
Últimas 24 horas- Solicitudes
- Tasa de éxito
- Latencia P95
- Total de tokens
- Tasa de éxito 30 días
- 99,9%
- Solicitudes 30 días
- 100+
- Última actividad
- hace 2 minutos
Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.
Abrir en Console
Abre DeepSeek V4 Pro en Console con un prompt listo para editar o enviar.
Ayúdame a probar deepseek-v4-pro con un mensaje breve en /v1/responses. Muestra la respuesta, la latencia y el coste.
Casos de uso
Ideal para- Razonamiento
Agentes de programación autónomos
Ejecútelo como planificador en un terminal o agente de IDE que edita muchos archivos, ejecuta pruebas y reacciona a fallos durante una sesión larga.
Razonamiento técnico difícil
Delégueles pruebas, diseño de algoritmos, derivaciones científicas o errores de concurrencia complicados y establezca el esfuerzo de razonamiento al máximo para la pasada final.
Respuesta a preguntas con gran carga de conocimiento
Haga preguntas que necesiten una amplia recuperación de hechos en todos los campos, como comparar estándares o explicar cómo interactúan dos tecnologías.
Nivel de escalada detrás de Flash
Envíe solicitudes rutinarias a V4 Flash y pase a Pro solo aquellas que fallen la validación o necesiten un análisis más profundo.
Ejemplos de prompts
Este backend se bloquea bajo carga. Se adjuntan el volcado de hilos y los dos módulos que adquieren bloqueos. Encuentre el problema de orden y escriba el parche.
Demuestre que el algoritmo a continuación termina y establezca su complejidad en el peor de los casos, luego señale cualquier entrada que rompa el argumento.
Planifique una migración de nuestros manejadores REST a la nueva puerta de enlace, enumere los módulos afectados en orden y ejecute las pruebas después de cada paso usando la herramienta de shell.
Este modelo tiene precio condicional. Los totales mensuales de tokens por sí solos no producen una estimación fiable; use el precio detallado según la especificación de la solicitud, la caché y la ventana aplicable.
FAQ
¿Cuándo debería usar DeepSeek V4 Pro en lugar de V4 Flash?
Use Pro para programación agentica, razonamiento difícil y preguntas que necesiten un amplio conocimiento fáctico. DeepSeek dice que Flash se acerca en razonamiento y trabajo de agente simple, por lo que Pro es más importante cuando Flash se equivoca en una tarea o cuando un error es costoso.
¿Cómo funcionan los niveles de esfuerzo de pensamiento en DeepSeek V4 Pro?
Usted activa el pensamiento y elige bajo, alto o máximo. Alto es el predeterminado y se adapta a las tareas cotidianas de los agentes, bajo se adapta a las simples y máximo es para los problemas más complejos. Un mayor esfuerzo significa más texto de razonamiento y una espera más larga antes de la respuesta.
¿Es DeepSeek V4 Pro de código abierto?
DeepSeek lanzó la generación V4 con pesos abiertos, y el modelo Pro tiene 1,6 billones de parámetros totales con 49 mil millones activos por token. Llamarlo a través de la API no requiere alojar nada; el lanzamiento abierto importa si desea evaluar o autoalojar la misma familia.
¿DeepSeek V4 Pro acepta imágenes?
No. Solo lee y escribe texto. DeepSeek incluye la comprensión de imágenes en modelos separados basados en Flash, por lo que un flujo de trabajo que necesite tanto capturas de pantalla como razonamiento difícil tiene que dividir los pasos entre dos modelos.
¿DeepSeek V4 Pro funciona con el SDK de OpenAI o el SDK de Anthropic?
Ambos. DeepSeek documenta la compatibilidad con los formatos de API de OpenAI y Anthropic, por lo que puede mantener su cliente existente y cambiar el nombre del modelo y la URL base.
¿Cuánto cuesta DeepSeek V4 Pro?
En TokenLab, DeepSeek V4 Pro cuesta Entrada $0.66 / Salida $1.98 Por 1M Token. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.
¿Cuál es la ventana de contexto y el límite de salida de DeepSeek V4 Pro?
DeepSeek V4 Pro admite hasta 1.000.000 tokens de contexto y genera hasta 384.000 tokens por respuesta.
¿Qué endpoint debe usar DeepSeek V4 Pro?
Utiliza https://api.tokenlab.sh/v1/responses para DeepSeek V4 Pro. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.
¿Qué operaciones soporta DeepSeek V4 Pro?
DeepSeek V4 Pro admite Texto a texto. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.
Comparar DeepSeek V4 Pro
Guías con DeepSeek V4 Pro
- Alternativa a la API de Venice AI: privacidad, acceso a modelos y adecuación para desarrolladores
- Alternativa a Together AI: cuando necesitas la simplicidad de una pasarela, no infraestructura
- Los mejores modelos de IA para programación en 2026: comparativa de GPT-5.5, Claude Sonnet 5, Gemini 3.5 Flash y DeepSeek V4
Fuentes
Revisado el 2 oct 2026