Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

DeepSeek: DeepSeek V4 Flash

DeepSeek V4 Flash menangani percakapan teks panjang dan pekerjaan yang dibantu alat. Konteks satu juta token miliknya berguna ketika asisten perlu menalar kumpulan dokumen yang substansial atau memantau basis kode yang besar.
Bandingkan model
deepseek-v4-flash
TersediaDeepSeekObrolan
Masukan / Keluaran
$0.15 / $0.60
Konteks
1M
Dirilis
24 Apr 2026
Output maksimal
384K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache PromptPenalaran

Tentang DeepSeek V4 Flash

DeepSeek V4 Flash adalah model yang lebih kecil dari generasi V4 DeepSeek, sebuah model bahasa campuran pakar (mixture-of-experts) berbobot terbuka dengan total 284B dan 13B parameter aktif. DeepSeek memosisikannya untuk kecepatan dan biaya penyajian yang rendah dengan tetap menjaga penalaran yang mendekati V4 Pro. Model ini berjalan dalam mode berpikir dan non-berpikir, memanggil alat, menyimpan prompt dalam cache, dan menjawab dalam JSON atas permintaan. Ini adalah model teks.

Kelebihan

  • DeepSeek melaporkan bahwa pembelajarannya sangat mirip dengan V4 Pro dan bertahan dengan baik pada tugas-tugas agen dasar, dengan jumlah parameter aktif yang jauh lebih kecil.
  • Pemikiran dapat diaktifkan per permintaan dengan tingkat upaya rendah, tinggi, atau maksimum, sehingga satu model mencakup balasan cepat dan pemecahan masalah yang lebih lambat.
  • Jendela konteks yang sangat panjang memungkinkan asisten mempertahankan basis kode yang besar atau kumpulan dokumen yang substansial dalam tampilan di sepanjang percakapan.
  • Model ini mendukung pemanggilan alat, keluaran JSON terstruktur, dan singgahan prompt, yang membantu lingkaran agen panjang yang mengirimkan ulang instruksi yang sama.

Kapan harus beralih

  • Model ini adalah model teks, sehingga pekerjaan yang melibatkan tangkapan layar atau diagram sebaiknya menggunakan DeepSeek V4.1 Flash atau varian vision-exp.
  • DeepSeek menyatakan bahwa V4 Pro unggul dalam tolok ukur pengodingan agen dan pengetahuan dunia, sehingga tugas pengodingan dan riset yang paling sulit lebih cocok untuk Pro.
  • Dalam mode berpikir, teks penalaran dikembalikan secara terpisah dan harus dikembalikan pada giliran alat berikutnya, yang harus ditangani oleh kode agen.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksResponses API
    POST/v1/responses
    Format API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "deepseek-v4-flash",
        "input": "Hello!"
      }'

Penetapan Harga

Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.

Periode harga · Di luar jam sibuk

per 1M token
Harga Official
Masukan $0.15 / Keluaran $0.60 / Pembacaan cache $0.003
Official
Masukan $0.15 / Keluaran $0.60 / Pembacaan cache $0.003
Diskon
—

Periode harga · Jam sibuk

per 1M token
Harga Official
Masukan $0.30 / Keluaran $1.20 / Pembacaan cache $0.006
Official
Masukan $0.30 / Keluaran $1.20 / Pembacaan cache $0.006
Diskon
—
Harga cache prompt

Pembacaan cache

Harga Official
$0.003
Official
$0.003
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Tingkat keberhasilan 30 hari
99,5%
Permintaan 30 hari
100+
Aktivitas terakhir
10 jam yang lalu

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka DeepSeek V4 Flash di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba deepseek-v4-flash dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Penalaran
  • Visi
  • Langkah agen bervolume tinggi

    Gunakan untuk banyak keputusan kecil di dalam lingkaran agen, seperti memilih alat, membaca hasilnya, dan merencanakan panggilan berikutnya, di mana waktu tanggapan dan biaya terakumulasi.

  • Pertanyaan seluruh repositori

    Tempel basis kode yang besar atau tumpukan dokumen ke dalam konteks panjang dan tanyakan di mana suatu perilaku diterapkan atau file mana yang akan terpengaruh oleh suatu perubahan.

  • Ekstraksi terstruktur

    Ubah kontrak, tiket, atau log menjadi JSON yang mengikuti skema, dengan mode berpikir dimatikan agar setiap catatan merespons dengan cepat.

  • Pengganti langsung untuk nama-nama lama DeepSeek

    Arahkan klien lama yang menggunakan nama obrolan dan penalaran yang sudah pensiun ke deepseek-v4-flash, lalu pilih mode berpikir atau non-berpikir per permintaan.

Contoh prompt

Sumber lengkap dari layanan penagihan kami ada di bawah ini. Modul mana yang membaca kolom status faktual, dan apa yang rusak jika saya menambahkan status baru?

Ekstrak setiap tanggal perpanjangan, periode pemberitahuan, dan biaya pembatalan dari kelima kontrak ini dan kembalikan satu larik (array) JSON yang cocok dengan skema ini.

Anda dapat memanggil search_docs dan open_ticket. Seorang pengguna melaporkan bahwa webhook berhenti masuk kemarin. Selidiki dengan alat tersebut, lalu rangkum kemungkinan penyebabnya.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa perbedaan antara DeepSeek V4 Flash dan V4 Pro?

Flash adalah model yang lebih kecil, dengan 13B parameter aktif berbanding 49B untuk Pro. DeepSeek menyatakan Flash bernalar hampir sebaik Pro dan menyamainya pada tugas agen sederhana, sementara Pro lebih kuat dalam pengodingan agen dan pengetahuan dunia. Mulailah dengan Flash dan pindahkan tugas ke Pro ketika gagal.

Apakah DeepSeek V4 Flash mendukung mode berpikir?

Ya. Aktifkan berpikir dalam permintaan dan pilih upaya penalaran rendah, tinggi, atau maksimum; tinggi adalah bawaannya. Penalaran tersebut tiba di bidang terpisah, dan percakapan yang menggunakan alat harus mengirimkannya kembali pada setiap giliran berikutnya. Biarkan berpikir nonaktif untuk jawaban pendek yang sensitif terhadap latensi.

Apakah DeepSeek V4 Flash dapat membaca gambar?

Tidak. Ini adalah model teks: teks masuk dan teks keluar. DeepSeek V4.1 Flash dan varian vision-exp V4 Flash adalah model terpisah yang memahami gambar, jadi gunakan salah satunya saat prompt menyertakan tangkapan layar atau diagram.

Untuk apa konteks yang panjang berguna?

Konteks ini memungkinkan satu permintaan membawa seluruh repositori atau tumpukan dokumen, sehingga model dapat menjawab di mana suatu perilaku diterapkan atau file mana yang disentuh oleh suatu perubahan tanpa pengambilan data di antaranya. Pasangkan dengan singgahan prompt saat materi yang sama dikirimkan berulang kali.

Apa yang terjadi pada nama lama deepseek-chat dan deepseek-reasoner?

DeepSeek menghentikannya pada 24 Juli 2026. Selama masa transisi, keduanya dipetakan ke V4 Flash dalam mode non-berpikir dan berpikir. Kode baru harus memanggil deepseek-v4-flash dan mengatur opsi berpikir, alih-alih mengandalkan nama terpisah untuk setiap mode.

Berapa biaya DeepSeek V4 Flash?

Di TokenLab, DeepSeek V4 Flash dikenakan Masukan $0.15 / Keluaran $0.60 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output DeepSeek V4 Flash?

DeepSeek V4 Flash mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 384.000 token per respons.

Endpoint mana yang harus digunakan DeepSeek V4 Flash?

Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk DeepSeek V4 Flash. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung DeepSeek V4 Flash?

DeepSeek V4 Flash mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan DeepSeek V4 Flash

Panduan menggunakan DeepSeek V4 Flash

Sumber

Ditinjau 2 Okt 2026

Lainnya dari DeepSeek V4

Model terkait