Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Kembali ke Model

Gemini 3.8 Flash vs Gemini 3.1 Flash-Lite

Gemini 3.8 Flash dan Gemini 3.1 Flash-Lite dibandingkan: harga, jendela konteks, output maksimum, dan kemampuan secara berdampingan di TokenLab.

Pilih yang mana

Pilih Gemini 3.8 Flash untuk pengodean jangka panjang, agen otonom, dan alur kerja kompleks, di mana model perlu berpikir dan menjaga rencana melalui banyak langkah. Pilih Gemini 3.1 Flash-Lite untuk fitur interaktif dan pekerjaan multimodal bervolume tinggi, di mana setiap panggilan harus kembali dengan cepat dan tugasnya sederhana. Faktor penentunya adalah tingkat kecepatan: Flash-Lite berada di bawah tingkat Flash dalam hal kemampuan dan menukar kedalaman dengan waktu respons.

Perbandingan harga

Gemini 3.8 FlashGemini 3.1 Flash-Lite
Penyedia modelGoogleGoogle
Ketersediaan pengirimanTersediaTersedia
Jendela konteks1M1M
Output maksimal64K64K
Harga Official
Masukan$0.75per 1M tokenKeluaran$3.75per 1M token
Masukan$0.25per 1M tokenKeluaran$1.50per 1M token
Harga TokenLab
Masukan$0.375per 1M tokenKeluaran$1.88per 1M token
Masukan$0.125per 1M tokenKeluaran$0.75per 1M token
Performa model
Tingkat keberhasilan 30 hari
93,4%
Latensi median 7 hari
9,8 sn=931
Tingkat keberhasilan 30 hari
97,8%
Kapabilitas
Mode JSONCache PromptPenggunaan toolVisi
Mode JSONCache PromptPenggunaan toolVisi

Pilih Gemini 3.8 Flash jika

  • Anda menjalankan agen atau tugas pengodean yang mencakup banyak pemanggilan alat
  • Anda memerlukan pemikiran untuk perencanaan dan debugging
  • Tugasnya cukup kompleks sehingga model Lite memberikan jawaban yang salah

Pilih Gemini 3.1 Flash-Lite jika

  • Setiap panggilan harus kembali dengan cepat di dalam fitur interaktif
  • Anda memproses tanda terima, formulir, dan tangkapan layar dalam volume besar
  • Tugasnya cukup sederhana sehingga penalaran mendalam tidak memberikan nilai tambah

Perbedaannya

AspekGemini 3.8 FlashGemini 3.1 Flash-Lite
TingkatModel Flash paling cerdas dari Google.Model latensi rendah dan biaya rendah yang berada di bawah tingkat Flash.
PenalaranMendukung pemikiran sebelum bertindak.Bukan model yang mengutamakan penalaran; matematika sulit atau perencanaan mendalam lebih cocok untuk model yang lebih kuat.
Proses agen yang panjangDirancang untuk menjaga alur melalui banyak langkah.Kurang mampu bertahan pada agen pengodean multi-langkah yang panjang.
Waktu responsModel yang lebih berat, dengan waktu respons yang ditukar dengan kemampuan.Waktu respons yang singkat cocok untuk fitur interaktif.
Permukaan bersamaTeks dan gambar, pemanggilan alat, JSON terikat skema, dan penembolokan.Input dan output yang sama, sehingga berpindah di antara keduanya tidak mengubah format permintaan.

Ringkasan

  • Gemini 3.8 Flash: Masukan $0.375 / Keluaran $1.88 per 1M token; Gemini 3.1 Flash-Lite: Masukan $0.125 / Keluaran $0.75 per 1M token. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Gemini 3.8 Flash
Gemini 3
Lihat detail
Gemini 3.1 Flash-Lite
Gemini 3
Lihat detail

FAQ

Apakah Gemini 3.8 Flash lebih baik daripada Gemini 3.1 Flash-Lite?

Untuk pengodean kompleks dan pekerjaan agen, ya: model ini berpikir sebelum bertindak dan menjaga rencana melalui banyak langkah. Untuk panggilan sederhana, bervolume tinggi, atau yang sensitif terhadap latensi, Flash-Lite adalah pilihan yang lebih baik karena dibuat untuk kembali dengan cepat.

Bisakah Flash-Lite menggantikan Gemini 3.8 Flash tanpa perubahan prompt?

Format permintaannya sama, tetapi prompt yang mengandalkan pemikiran atau perencanaan multi-langkah akan memberikan hasil yang lebih lemah pada Flash-Lite. Uji prompt tersebut terlebih dahulu, dan tetap gunakan 3.8 Flash untuk prompt tersebut jika kualitasnya menurun.

Mana yang lebih baik untuk mengekstrak data dari gambar?

Flash-Lite menangani ekstraksi tanda terima, formulir, dan tangkapan layar rutin dalam volume besar serta mengembalikan JSON terikat skema. Gunakan 3.8 Flash ketika dokumen berantakan, tata letaknya sangat bervariasi, atau ekstraksi memerlukan penilaian.

Bisakah saya menggunakan keduanya secara bersamaan?

Ya. Kirim panggilan sederhana bervolume tinggi ke Flash-Lite agar pengguna mendapatkan balasan cepat, dan eskalasikan permintaan yang gagal validasi atau memerlukan perencanaan ke Gemini 3.8 Flash.

Mana yang lebih murah, Gemini 3.8 Flash atau Gemini 3.1 Flash-Lite?

Gemini 3.8 Flash: Masukan $0.375 / Keluaran $1.88 per 1M token; Gemini 3.1 Flash-Lite: Masukan $0.125 / Keluaran $0.75 per 1M token. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Apa perbedaan utama antara Gemini 3.8 Flash dan Gemini 3.1 Flash-Lite?

Kedua model memiliki kapabilitas yang serupa.

Sumber

Ditinjau 2 Okt 2026