DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- Masukan / Keluaran
- $0.66 / $1.98
- Konteks
- 1M
- Dirilis
- 24 Apr 2026
- Output maksimal
- 384K
- Modalitas
- Obrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang DeepSeek V4 Pro
DeepSeek V4 Pro adalah model yang lebih besar dari generasi V4 DeepSeek, model mixture-of-experts dengan bobot terbuka yang memiliki total 1,6T parameter dan 49B parameter aktif. DeepSeek menargetkannya untuk pengodean agen, matematika, penalaran STEM, dan pengetahuan dunia yang luas, di mana model ini ingin menyaingi model perbatasan tertutup. Model ini menawarkan mode berpikir dan non-berpikir dengan tiga tingkat upaya, panggilan alat, dan keluaran JSON, serta hanya membaca teks.
Kelebihan
- DeepSeek menyebutnya sebagai yang tercanggih (state of the art) sumber terbuka pada tolok ukur pengodean agen dan mengatakan pengetahuan dunianya hanya tertinggal dari Gemini 3.1 Pro.
- Mode berpikir memiliki upaya rendah, tinggi, dan maksimal, sehingga masalah matematika, STEM, dan debugging yang sulit dapat diberikan penalaran yang jauh lebih banyak daripada masalah rutin.
- Panggilan alat, keluaran JSON, dan caching perintah didukung, sehingga model ini cocok dengan loop agen yang mengulangi perintah sistem yang panjang.
- Bobotnya terbuka, sehingga tim yang juga melakukan hosting mandiri dapat mengevaluasi keluarga model yang sama sebelum berkomitmen.
Kapan harus beralih
- Model ini hanya membaca teks; pekerjaan tangkapan layar dan diagram memerlukan deepseek-v4.1-flash atau varian Flash vision-exp.
- Ini adalah model V4 yang lebih berat, jadi V4 Flash menjawab lebih cepat ketika suatu tugas tidak memerlukan kedalaman penalaran ekstra.
- Upaya maksimal menghasilkan penalaran panjang yang menambah penundaan dan token, dan percakapan alat harus meneruskan teks penalaran kembali setiap giliran.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
Penetapan Harga
Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.
Periode harga · Di luar jam sibuk
per 1M token- Harga Official
- Masukan $0.66 / Keluaran $1.98 / Pembacaan cache $0.022 / Penulisan cache $0.66
- Official
- Masukan $0.66 / Keluaran $1.98 / Pembacaan cache $0.022 / Penulisan cache $0.66
- Diskon
- —
Periode harga · Jam sibuk
per 1M token- Harga Official
- Masukan $1.32 / Keluaran $3.96 / Pembacaan cache $0.044 / Penulisan cache $1.32
- Official
- Masukan $1.32 / Keluaran $3.96 / Pembacaan cache $0.044 / Penulisan cache $1.32
- Diskon
- —
Pembacaan cache
- Harga Official
- $0.022
- Official
- $0.022
- Diskon
- —
Penulisan cache
- Harga Official
- $0.66
- Official
- $0.66
- Diskon
- —
| Harga Officialper 1M token | Officialper 1M token | Diskon | |
|---|---|---|---|
| Periode harga · Di luar jam sibuk | Masukan $0.66 / Keluaran $1.98 / Pembacaan cache $0.022 / Penulisan cache $0.66 | Masukan $0.66 / Keluaran $1.98 / Pembacaan cache $0.022 / Penulisan cache $0.66 | — |
| Periode harga · Jam sibuk | Masukan $1.32 / Keluaran $3.96 / Pembacaan cache $0.044 / Penulisan cache $1.32 | Masukan $1.32 / Keluaran $3.96 / Pembacaan cache $0.044 / Penulisan cache $1.32 | — |
| Harga cache prompt | |||
| Pembacaan cache | $0.022 | $0.022 | — |
| Penulisan cache | $0.66 | $0.66 | — |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
- Tingkat keberhasilan 30 hari
- 99,9%
- Permintaan 30 hari
- 100+
- Aktivitas terakhir
- 3 jam yang lalu
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka DeepSeek V4 Pro di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba deepseek-v4-pro dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
Agen pengodean otonom
Jalankan sebagai perencana di terminal atau agen IDE yang mengedit banyak file, menjalankan tes, dan bereaksi terhadap kegagalan selama sesi yang panjang.
Penalaran teknis yang sulit
Berikan bukti, desain algoritma, derivasi ilmiah, atau bug konkurensi yang rumit dan atur upaya penalaran ke maksimal untuk tahap akhir.
Menjawab pertanyaan yang sarat pengetahuan
Ajukan pertanyaan yang memerlukan ingatan faktual luas di berbagai bidang, seperti membandingkan standar atau menjelaskan bagaimana dua teknologi berinteraksi.
Tingkat eskalasi di belakang Flash
Kirim permintaan rutin ke V4 Flash dan teruskan hanya permintaan yang gagal validasi atau memerlukan analisis lebih dalam ke Pro.
Contoh prompt
Backend ini mengalami kebuntuan (deadlock) di bawah beban. Thread dump dan dua modul pengambil kunci terlampir. Temukan masalah pengurutan dan tulis patch-nya.
Buktikan bahwa algoritma di bawah ini berakhir dan nyatakan kompleksitas kasus terburuknya, lalu tunjukkan input apa pun yang merusak argumen tersebut.
Rencanakan migrasi dari penangan REST kami ke gateway baru, daftar modul yang terpengaruh secara berurutan, dan jalankan tes setelah setiap langkah menggunakan alat shell.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Kapan saya harus menggunakan DeepSeek V4 Pro alih-alih V4 Flash?
Gunakan Pro untuk pengodean agen, penalaran sulit, dan pertanyaan yang memerlukan pengetahuan faktual yang luas. DeepSeek mengatakan Flash mendekati dalam hal penalaran dan pekerjaan agen sederhana, jadi Pro paling penting ketika Flash melakukan kesalahan pada tugas atau ketika kesalahan tersebut mahal.
Bagaimana cara kerja tingkat upaya berpikir pada DeepSeek V4 Pro?
Anda mengaktifkan pemikiran dan memilih rendah, tinggi, atau maksimal. Tinggi adalah default dan cocok untuk tugas agen sehari-hari, rendah cocok untuk tugas sederhana, dan maksimal untuk masalah yang paling kompleks. Upaya yang lebih tinggi berarti lebih banyak teks penalaran dan waktu tunggu yang lebih lama sebelum jawaban muncul.
Apakah DeepSeek V4 Pro sumber terbuka?
DeepSeek merilis generasi V4 dengan bobot terbuka, dan model Pro memiliki total 1,6T parameter dengan 49B aktif per token. Memanggilnya melalui API tidak memerlukan hosting apa pun; rilis terbuka penting jika Anda ingin mengevaluasi atau melakukan hosting mandiri pada keluarga yang sama.
Apakah DeepSeek V4 Pro menerima gambar?
Tidak. Model ini hanya membaca dan menulis teks. DeepSeek mengirimkan pemahaman gambar dalam model berbasis Flash yang terpisah, jadi alur kerja yang memerlukan tangkapan layar dan penalaran sulit harus membagi langkah-langkah tersebut di dua model.
Apakah DeepSeek V4 Pro bekerja dengan OpenAI SDK atau Anthropic SDK?
Keduanya. DeepSeek mendokumentasikan kompatibilitas dengan format API OpenAI dan Anthropic, sehingga Anda dapat mempertahankan klien Anda yang sudah ada dan mengubah nama model serta URL dasar.
Berapa biaya DeepSeek V4 Pro?
Di TokenLab, DeepSeek V4 Pro dikenakan Masukan $0.66 / Keluaran $1.98 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output DeepSeek V4 Pro?
DeepSeek V4 Pro mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 384.000 token per respons.
Endpoint mana yang harus digunakan DeepSeek V4 Pro?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk DeepSeek V4 Pro. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung DeepSeek V4 Pro?
DeepSeek V4 Pro mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan DeepSeek V4 Pro
Panduan menggunakan DeepSeek V4 Pro
Sumber
Ditinjau 2 Okt 2026