Wählen Sie Auto, TokenLab Verified oder Official für jede Anfrage, wobei die Preise vorab angezeigt werden.Neuigkeiten ansehen

DeepSeek: DeepSeek V4 Pro

DeepSeek V4 Pro Snapshot mit einer Million Token Kontext und Unterstützung für Thinking- und Non-Thinking-Modi
Modelle vergleichen
deepseek-v4-pro
VerfügbarDeepSeekUnterhaltung
Eingabe / Ausgabe
$0.66 / $1.98
Kontext
1M
Veröffentlicht
24. Apr. 2026
Maximale Ausgabe
384K
Modalitäten
Unterhaltung
Funktionen
Tool-NutzungPrompt-CacheReasoning

Über DeepSeek V4 Pro

DeepSeek V4 Pro ist das größere Modell der V4-Generation von DeepSeek, ein Mixture-of-Experts-Modell mit offenen Gewichten, 1,6 Billionen Gesamtparametern und 49 Milliarden aktiven Parametern. DeepSeek zielt damit auf agentische Programmierung, Mathematik, STEM-Schlussfolgerungen und breites Weltwissen ab, wo es mit geschlossenen Frontier-Modellen konkurrieren will. Es bietet Denk- und Nicht-Denk-Modi mit drei Aufwandsebenen, Tool-Aufrufe sowie JSON-Ausgabe und liest nur Text.

Stärken

  • DeepSeek bezeichnet es als Open-Source-State-of-the-Art bei Benchmarks für agentische Programmierung und gibt an, dass sein Weltwissen nur hinter Gemini 3.1 Pro zurückbleibt.
  • Der Denkmodus verfügt über niedrigen, hohen und maximalen Aufwand, sodass schwierige Mathe-, STEM- und Debugging-Probleme weit mehr logisches Schlussfolgern erhalten können als Routineaufgaben.
  • Tool-Aufrufe, JSON-Ausgabe und Prompt-Caching werden unterstützt, sodass es in Agenten-Schleifen passt, die einen langen System-Prompt wiederholen.
  • Die Gewichte sind offen, sodass Teams, die auch selbst hosten, dieselbe Modellfamilie evaluieren können, bevor sie sich festlegen.

Alternativen

  • Es liest nur Text; für Screenshots und Diagramme werden deepseek-v4.1-flash oder die Flash-Vision-exp-Variante benötigt.
  • Es ist das schwerere V4-Modell, daher antwortet V4 Flash schneller, wenn eine Aufgabe nicht die zusätzliche logische Tiefe erfordert.
  • Maximaler Aufwand erzeugt langes logisches Schlussfolgern, das Verzögerungen und Token hinzufügt, und Tool-Konversationen müssen den Denktext bei jedem Schritt zurückgeben.

Erste Schritte

  1. API-Schlüssel erstellen

    Erstelle einen Schlüssel in Console und nutze ihn mit jedem Modell auf der Plattform.

  2. Senden Sie Ihre erste Anfrage

    Kopieren Sie das Beispiel für Ihre Sprache und führen Sie es gegen den Endpunkt aus.

    Text-zu-TextResponses API
    POST/v1/responses
    API-Format:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-pro",
        "input": "Hello!"
      }'

Preise

Der TokenLab-Preis gilt für Verified und ist bei den meisten Modellen günstiger. Der Official-Preis entspricht dem Standardpreis des Herstellers für die zuverlässigere Route. Auto berechnet jeweils die Route, die deine Anfrage erfolgreich verarbeitet.

Preiszeitraum · Nebenzeit

Pro 1M Token
Offizieller Preis
Eingabe $0.66 / Ausgabe $1.98 / Cache-Lesevorgang $0.022 / Cache-Schreibvorgang $0.66
Official
Eingabe $0.66 / Ausgabe $1.98 / Cache-Lesevorgang $0.022 / Cache-Schreibvorgang $0.66
Rabatt
—

Preiszeitraum · Spitzenzeit

Pro 1M Token
Offizieller Preis
Eingabe $1.32 / Ausgabe $3.96 / Cache-Lesevorgang $0.044 / Cache-Schreibvorgang $1.32
Official
Eingabe $1.32 / Ausgabe $3.96 / Cache-Lesevorgang $0.044 / Cache-Schreibvorgang $1.32
Rabatt
—
Prompt-Cache-Preise

Cache-Lesevorgang

Offizieller Preis
$0.022
Official
$0.022
Rabatt
—

Cache-Schreibvorgang

Offizieller Preis
$0.66
Official
$0.66
Rabatt
—

Nutzung & Aktivität

Die Erfolgsquote ist der Anteil abgeschlossener Anfragen. Die Latenz ist die Dauer einer vollständigen Antwort; P95 bedeutet, dass 95 % der Anfragen innerhalb dieser Zeit abgeschlossen wurden.

Nutzung & Verfügbarkeit

Letzte 24 Stunden
Anfragen
Erfolgsrate
P95-Latenz
Token gesamt
Modellleistung
Erfolgsquote (30 Tage)
99,9%
Anfragen (30 Tage)
100+
Zuletzt aktiv
vor 30 Minuten

Die Daten basieren auf aggregierten Benutzeranfragen, Statusprüfungen sind ausgeschlossen.

In Console öffnen

Öffne DeepSeek V4 Pro in Console mit einer bearbeitbaren oder versandbereiten Eingabeaufforderung.

Teste deepseek-v4-pro mit einer kurzen Nachricht an /v1/responses. Zeige Antwort, Latenz und Kosten.

Anwendungsfälle

Geeignet für
  • Reasoning
  • Autonome Programmier-Agenten

    Führen Sie es als Planer in einem Terminal- oder IDE-Agenten aus, der viele Dateien bearbeitet, Tests ausführt und über eine lange Sitzung auf Fehler reagiert.

  • Schwieriges technisches Schlussfolgern

    Geben Sie ihm Beweise, Algorithmen-Design, wissenschaftliche Ableitungen oder knifflige Nebenläufigkeitsfehler und stellen Sie den Denkaufwand für den letzten Durchgang auf Maximum.

  • Wissensintensive Beantwortung von Fragen

    Stellen Sie Fragen, die einen breiten faktischen Abruf über Fachgebiete hinweg erfordern, wie etwa den Vergleich von Standards oder die Erklärung, wie zwei Technologien interagieren.

  • Eskalationsstufe hinter Flash

    Senden Sie Routineanfragen an V4 Flash und leiten Sie nur diejenigen an Pro weiter, die die Validierung nicht bestehen oder eine tiefere Analyse erfordern.

Prompt-Beispiele

Dieses Backend blockiert unter Last. Der Thread-Dump und die beiden Module, die Sperren erwerben, sind angehängt. Finden Sie das Reihenfolgeproblem und schreiben Sie den Patch.

Beweisen Sie, dass der unten stehende Algorithmus terminiert, geben Sie seine Worst-Case-Komplexität an und zeigen Sie dann jede Eingabe auf, die das Argument entkräftet.

Planen Sie eine Migration von unseren REST-Handlern zum neuen Gateway, listen Sie die betroffenen Module in der richtigen Reihenfolge auf und führen Sie die Tests nach jedem Schritt mit dem Shell-Tool aus.

Dieses Modell hat konditionale Preise. Monatliche Token-Summen allein liefern keine verlässliche Schätzung; nutzen Sie die detaillierten Preise für Anfragespezifikation, Cache und Zeitfenster.

FAQ

Wann sollte ich DeepSeek V4 Pro anstelle von V4 Flash verwenden?

Verwenden Sie Pro für agentische Programmierung, schwieriges Schlussfolgern und Fragen, die breites Faktenwissen erfordern. DeepSeek gibt an, dass Flash bei Schlussfolgerungen und einfacher Agentenarbeit nahe herankommt, daher ist Pro am wichtigsten, wenn Flash eine Aufgabe falsch löst oder wenn ein Fehler teuer ist.

Wie funktionieren die Denkaufwandsebenen bei DeepSeek V4 Pro?

Sie aktivieren das Denken und wählen niedrig, hoch oder maximal. Hoch ist der Standard und eignet sich für alltägliche Agentenaufgaben, niedrig für einfache Aufgaben und maximal für die komplexesten Probleme. Höherer Aufwand bedeutet mehr Denktext und eine längere Wartezeit bis zur Antwort.

Ist DeepSeek V4 Pro Open Source?

DeepSeek hat die V4-Generation mit offenen Gewichten veröffentlicht, und das Pro-Modell hat 1,6 Billionen Gesamtparameter mit 49 Milliarden aktiven Parametern pro Token. Der Aufruf über die API erfordert kein Hosting; die offene Veröffentlichung ist wichtig, wenn Sie dieselbe Familie evaluieren oder selbst hosten möchten.

Akzeptiert DeepSeek V4 Pro Bilder?

Nein. Es liest und schreibt nur Text. DeepSeek liefert Bildverständnis in separaten Flash-basierten Modellen, daher muss ein Workflow, der sowohl Screenshots als auch schwieriges Schlussfolgern erfordert, die Schritte auf zwei Modelle aufteilen.

Funktioniert DeepSeek V4 Pro mit dem OpenAI SDK oder dem Anthropic SDK?

Beides. DeepSeek dokumentiert die Kompatibilität mit den OpenAI- und Anthropic-API-Formaten, sodass Sie Ihren bestehenden Client behalten und nur den Modellnamen sowie die Basis-URL ändern können.

Was kostet DeepSeek V4 Pro?

Auf TokenLab kostet DeepSeek V4 Pro Eingabe $0.66 / Ausgabe $1.98 Pro 1M Token. Die vollständige Aufschlüsselung steht in der Preistabelle oben. Die Preise hängen von Abrechnungseinheit, Spezifikation und Nutzung ab. Vergleichen Sie gleiche Bedingungen in der detaillierten Preisliste des Modells; eine einzelne Rate bestimmt nicht die Gesamtkosten.

Welche Kontext- und Ausgabelimits hat DeepSeek V4 Pro?

DeepSeek V4 Pro verarbeitet bis zu 1.000.000 Token Kontext und gibt pro Antwort bis zu 384.000 Token aus.

Welchen Endpunkt soll DeepSeek V4 Pro verwenden?

Verwenden Sie https://api.tokenlab.sh/v1/responses für DeepSeek V4 Pro. Das folgende Anforderungsbeispiel zeigt die passende Code-Struktur.

Welche Operationen unterstützt DeepSeek V4 Pro?

DeepSeek V4 Pro unterstützt Text-zu-Text. Wählen Sie oben einen Vorgang aus, um dessen Endpunkt und Anforderungsbeispiel anzuzeigen.

DeepSeek V4 Pro vergleichen

Anleitungen für DeepSeek V4 Pro

Quellen

Geprüft am 02.10.2026

Mehr aus der DeepSeek V4-Serie

Ähnliche Modelle