Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

DeepSeek: DeepSeek V4 Pro

Instantané DeepSeek V4 Pro avec contexte d'un million de jetons et prise en charge des modes de réflexion et sans réflexion
Comparer les modèles
deepseek-v4-pro
DisponibleDeepSeekDiscussion
Entrée / Sortie
$0.66 / $1.98
Contexte
1M
Date de sortie
24 avr. 2026
Sortie maximale
384K
Modalités
Discussion
Capacités
Utilisation d'outilsCache de promptsRaisonnement

À propos de DeepSeek V4 Pro

DeepSeek V4 Pro est le modèle le plus large de la génération V4 de DeepSeek, un modèle de mélange d'experts à poids ouverts avec 1,6 T de paramètres au total et 49 B de paramètres actifs. DeepSeek le destine au codage agentique, aux mathématiques, au raisonnement STEM et à une vaste connaissance du monde, où il cherche à rivaliser avec les modèles fermés de pointe. Il propose des modes avec et sans réflexion avec trois niveaux d'effort, des appels d'outils et une sortie JSON, et ne lit que le texte.

Points forts

  • DeepSeek le qualifie d'état de l'art open-source sur les benchmarks de codage agentique et affirme que ses connaissances générales ne sont devancées que par Gemini 3.1 Pro.
  • Le mode réflexion dispose d'un effort faible, élevé et maximal, de sorte que les problèmes difficiles de mathématiques, de STEM et de débogage peuvent bénéficier d'un raisonnement bien plus approfondi que les problèmes courants.
  • Les appels d'outils, la sortie JSON et la mise en cache des invites sont pris en charge, ce qui lui permet de s'intégrer dans des boucles d'agents qui répètent une longue invite système.
  • Les poids sont ouverts, de sorte que les équipes qui s'auto-hébergent peuvent également évaluer la même famille de modèles avant de s'engager.

Quand préférer un autre modèle

  • Il ne lit que le texte ; le travail sur les captures d'écran et les diagrammes nécessite deepseek-v4.1-flash ou la variante Flash vision-exp.
  • C'est le modèle V4 le plus lourd, donc V4 Flash répond plus rapidement lorsqu'une tâche ne nécessite pas la profondeur de raisonnement supplémentaire.
  • L'effort maximal produit un raisonnement long qui ajoute du délai et des jetons, et les conversations avec outils doivent renvoyer le texte de raisonnement à chaque tour.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers texteResponses API
    POST/v1/responses
    Format d'API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

Tarification

Le tarif TokenLab s'applique à Verified pour réduire vos coûts. Le tarif officiel s'applique à la route Official pour une fiabilité optimale. Auto sélectionne la route qui garantit le succès de votre requête.

Période tarifaire · Heures creuses

Par 1M Token
Tarif Official
Entrée $0.66 / Sortie $1.98 / Lecture cache $0.022 / Jetons d'écriture cache $0.66
Official
Entrée $0.66 / Sortie $1.98 / Lecture cache $0.022 / Jetons d'écriture cache $0.66
Remise
—

Période tarifaire · Heures pleines

Par 1M Token
Tarif Official
Entrée $1.32 / Sortie $3.96 / Lecture cache $0.044 / Jetons d'écriture cache $1.32
Official
Entrée $1.32 / Sortie $3.96 / Lecture cache $0.044 / Jetons d'écriture cache $1.32
Remise
—
Tarification du cache de prompt

Lecture cache

Tarif Official
$0.022
Official
$0.022
Remise
—

Jetons d'écriture cache

Tarif Official
$0.66
Official
$0.66
Remise
—

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Taux de réussite sur 30 jours
99,9%
Requêtes sur 30 jours
100+
Dernière activité
il y a 3 heures

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez DeepSeek V4 Pro dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester deepseek-v4-pro avec un message sur /v1/responses. Affiche la réponse, la latence et le coût.

Cas d'usage

Idéal pour
  • Raisonnement
  • Agents de codage autonomes

    Exécutez-le en tant que planificateur dans un terminal ou un agent IDE qui modifie de nombreux fichiers, exécute des tests et réagit aux échecs sur une longue session.

  • Raisonnement technique difficile

    Donnez-lui des preuves, une conception d'algorithme, des dérivations scientifiques ou des bugs de concurrence complexes et réglez l'effort de raisonnement au maximum pour la passe finale.

  • Réponse aux questions à forte intensité de connaissances

    Posez des questions qui nécessitent un rappel factuel large dans divers domaines, comme la comparaison de normes ou l'explication de l'interaction entre deux technologies.

  • Niveau d'escalade derrière Flash

    Envoyez les demandes de routine à V4 Flash et ne transmettez à Pro que celles qui échouent à la validation ou nécessitent une analyse plus approfondie.

Exemples de prompts

Ce backend se bloque sous la charge. Le vidage de thread et les deux modules d'acquisition de verrou sont joints. Trouvez le problème d'ordonnancement et écrivez le correctif.

Prouvez que l'algorithme ci-dessous se termine et indiquez sa complexité dans le pire des cas, puis signalez toute entrée qui invalide l'argument.

Planifiez une migration de nos gestionnaires REST vers la nouvelle passerelle, listez les modules affectés dans l'ordre et exécutez les tests après chaque étape à l'aide de l'outil shell.

Ce modèle a une tarification conditionnelle. Les totaux mensuels de tokens ne suffisent pas pour une estimation fiable ; utilisez la tarification détaillée selon la spécification de la requête, le cache et la fenêtre applicable.

FAQ

Quand dois-je utiliser DeepSeek V4 Pro au lieu de V4 Flash ?

Utilisez Pro pour le codage agentique, le raisonnement difficile et les questions nécessitant une large connaissance factuelle. DeepSeek affirme que Flash s'en rapproche en matière de raisonnement et de travail d'agent simple, donc Pro est surtout utile lorsque Flash échoue à une tâche ou lorsqu'une erreur est coûteuse.

Comment fonctionnent les niveaux d'effort de réflexion sur DeepSeek V4 Pro ?

Vous activez la réflexion et choisissez faible, élevé ou maximal. Élevé est la valeur par défaut et convient aux tâches d'agent quotidiennes, faible convient aux tâches simples, et maximal est destiné aux problèmes les plus complexes. Un effort plus élevé signifie plus de texte de raisonnement et une attente plus longue avant la réponse.

DeepSeek V4 Pro est-il open source ?

DeepSeek a publié la génération V4 avec des poids ouverts, et le modèle Pro possède 1,6 T de paramètres au total avec 49 B actifs par jeton. L'appeler via l'API ne nécessite rien héberger ; la version ouverte est importante si vous souhaitez évaluer ou auto-héberger la même famille.

DeepSeek V4 Pro accepte-t-il les images ?

Non. Il ne lit et n'écrit que du texte. DeepSeek propose la compréhension d'images dans des modèles basés sur Flash distincts, donc un flux de travail nécessitant à la fois des captures d'écran et un raisonnement complexe doit diviser les étapes entre deux modèles.

DeepSeek V4 Pro fonctionne-t-il avec le SDK OpenAI ou le SDK Anthropic ?

Les deux. DeepSeek documente la compatibilité avec les formats d'API OpenAI et Anthropic, vous pouvez donc conserver votre client existant et modifier le nom du modèle et l'URL de base.

Combien coûte DeepSeek V4 Pro ?

Sur TokenLab, DeepSeek V4 Pro coûte Entrée $0.66 / Sortie $1.98 Par 1M Token. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quelles sont les limites de contexte et de sortie de DeepSeek V4 Pro ?

DeepSeek V4 Pro accepte jusqu'à 1 000 000 jetons de contexte et génère jusqu'à 384 000 jetons par réponse.

Quel endpoint DeepSeek V4 Pro doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/responses pour DeepSeek V4 Pro. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations DeepSeek V4 Pro prend-il en charge ?

DeepSeek V4 Pro prend en charge Texte vers texte. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer DeepSeek V4 Pro

Guides utilisant DeepSeek V4 Pro

Sources

Mis à jour le 2 oct. 2026

Plus de la série DeepSeek V4

Modèles associés