Google: Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite- Masukan / Keluaran-50%
- $0.30 / $2.50$0.15 / $1.25
- Konteks
- 1M
- Dirilis
- 21 Jul 2026
- Output maksimal
- 64K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache Prompt
Tentang Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite adalah model tercepat dan paling hemat biaya dari Google untuk generasi 3.5, dirilis pada Juli 2026. Model ini menargetkan pekerjaan bervolume tinggi di mana waktu respons singkat sangat penting: pemrosesan dokumen, ekstraksi, dan tugas agen berulang yang kecil. Model ini membaca teks dan gambar, memanggil alat, mengembalikan JSON yang terikat skema, dan melakukan caching konteks, dan Google kini mengarahkan proyek baru untuk menggunakannya.
Kelebihan
- Dirancang untuk waktu respons singkat pada pekerjaan yang diulang ribuan kali.
- Menangani teks dan gambar secara bersamaan untuk pemrosesan dokumen dan tangkapan layar.
- JSON yang terikat skema menjaga output ekstraksi tetap konsisten.
- Pemanggilan fungsi memungkinkannya menjalankan langkah-langkah agen kecil seperti pencarian atau perutean.
Kapan harus beralih
- Sesi coding yang panjang dan alur kerja perusahaan yang kompleks lebih cocok untuk 3.8 Flash atau 3.1 Pro.
- Model ini akan melewatkan detail yang ditangkap oleh model Flash yang lebih lengkap pada dokumen yang padat atau ambigu.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksGemini APIPOST/v1beta/models/gemini-3.5-flash-lite:generateContentFormat API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Penetapan Harga
Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.
Spesifikasi default
per 1M token- Harga Official
- Masukan $0.30 / Keluaran $2.50 / Pembacaan cache $0.03
- Harga TokenLab
- Masukan $0.15 / Keluaran $1.25 / Pembacaan cache $0.015
- Diskon
- -50%
Pembacaan cache
- Harga Official
- $0.03
- Harga TokenLab
- $0.015
- Diskon
- -50%
| Harga Officialper 1M token | Harga TokenLabper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $0.30 / Keluaran $2.50 / Pembacaan cache $0.03 | Masukan $0.15 / Keluaran $1.25 / Pembacaan cache $0.015 | -50% |
| Harga cache prompt | |||
| Pembacaan cache | $0.03 | $0.015 | -50% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
- Tingkat keberhasilan 30 hari
- 99,7%
- Latensi median 7 hari
- 1,9 sn=346
- Latensi P95 7 hari
- 7 sn=346
- Permintaan 30 hari
- 100+
- Aktivitas terakhir
- 23 jam yang lalu
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Gemini 3.5 Flash-Lite di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba gemini-3.5-flash-lite dengan pesan singkat di /v1beta/models/gemini-3.5-flash-lite:generateContent. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Visi
Alur kerja dokumen
Konversikan kontrak, faktur, dan laporan menjadi bidang terstruktur dalam skala besar, dengan menulis satu catatan JSON tervalidasi untuk setiap file yang masuk.
Triage antrean
Urutkan tiket atau pesan yang masuk berdasarkan topik dan urgensi sebelum dilihat oleh manusia atau model yang lebih besar.
Agen kecil
Jalankan pekerjaan alat-dalam-siklus yang sempit seperti pencarian pesanan atau perubahan kalender, di mana setiap langkahnya kecil dan siklusnya sering berulang.
Pemeriksaan visual
Konfirmasikan bahwa foto yang diunggah memenuhi aturan sederhana, seperti label yang terlihat atau orientasi yang benar.
Contoh prompt
Ekstrak setiap item baris dari faktur ini sebagai JSON dengan deskripsi, kuantitas, dan jumlah unit.
Nilai urgensi tiket ini sebagai rendah, sedang, atau tinggi dan berikan satu kalimat yang membenarkannya.
Periksa apakah foto produk ini menunjukkan label kemasan dengan jelas; jawab ya atau tidak dan jelaskan alasannya.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Untuk apa Gemini 3.5 Flash-Lite digunakan?
Pekerjaan cepat, berulang, dan sederhana: ekstraksi, klasifikasi, perutean, dan pemeriksaan multimodal ringan. Ini adalah pilihan ekonomis dari keluarga 3.5, yang dibangun untuk kecepatan respons daripada kedalaman.
Apakah ini lebih baru daripada Gemini 3.1 Flash-Lite?
Ya. Ini adalah generasi yang lebih baru, dan Google mencantumkannya sebagai pilihan ringan yang direkomendasikan untuk proyek baru. 3.1 Flash-Lite yang lama tetap tersedia untuk integrasi yang sudah ada.
Bisakah model ini membaca gambar?
Ya, gambar dapat menyertai teks dalam permintaan, dan jawabannya kembali sebagai teks biasa atau sebagai JSON terstruktur, yang cocok untuk pemeriksaan foto dan ekstraksi dokumen yang dipindai.
Kapan model ini dianggap terlalu kecil?
Ketika tugas memerlukan penalaran berkelanjutan, analisis dokumen panjang yang cermat, atau pekerjaan coding selama berjam-jam. Gunakan Gemini 3.8 Flash atau 3.1 Pro untuk kasus tersebut.
Berapa biaya Gemini 3.5 Flash-Lite?
Di TokenLab, Gemini 3.5 Flash-Lite dikenakan Masukan $0.15 / Keluaran $1.25 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 65.536 token per respons.
Endpoint mana yang harus digunakan Gemini 3.5 Flash-Lite?
Pakai https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent sebagai default untuk Gemini 3.5 Flash-Lite. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Gemini 3.5 Flash-Lite
Sumber
Ditinjau 2 Okt 2026