Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite menargetkan pekerjaan bervolume tinggi dengan waktu respons singkat. Pertimbangkan model ini untuk pemrosesan dokumen, ekstraksi, dan tugas agen yang lebih kecil yang dijalankan berulang kali serta memerlukan penanganan input teks dan visual yang efisien.
Bandingkan model
gemini-3.5-flash-lite
TersediaGoogleObrolanInput cache 90% lebih hemat
Masukan / Keluaran-50%
$0.30 / $2.50$0.15 / $1.25
Konteks
1M
Dirilis
21 Jul 2026
Output maksimal
64K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache Prompt

Tentang Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite adalah model tercepat dan paling hemat biaya dari Google untuk generasi 3.5, dirilis pada Juli 2026. Model ini menargetkan pekerjaan bervolume tinggi di mana waktu respons singkat sangat penting: pemrosesan dokumen, ekstraksi, dan tugas agen berulang yang kecil. Model ini membaca teks dan gambar, memanggil alat, mengembalikan JSON yang terikat skema, dan melakukan caching konteks, dan Google kini mengarahkan proyek baru untuk menggunakannya.

Kelebihan

  • Dirancang untuk waktu respons singkat pada pekerjaan yang diulang ribuan kali.
  • Menangani teks dan gambar secara bersamaan untuk pemrosesan dokumen dan tangkapan layar.
  • JSON yang terikat skema menjaga output ekstraksi tetap konsisten.
  • Pemanggilan fungsi memungkinkannya menjalankan langkah-langkah agen kecil seperti pencarian atau perutean.

Kapan harus beralih

  • Sesi coding yang panjang dan alur kerja perusahaan yang kompleks lebih cocok untuk 3.8 Flash atau 3.1 Pro.
  • Model ini akan melewatkan detail yang ditangkap oleh model Flash yang lebih lengkap pada dokumen yang padat atau ambigu.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksGemini API
    POST/v1beta/models/gemini-3.5-flash-lite:generateContent
    Format API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Penetapan Harga

Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.

Spesifikasi default

per 1M token
Harga Official
Masukan $0.30 / Keluaran $2.50 / Pembacaan cache $0.03
Harga TokenLab
Masukan $0.15 / Keluaran $1.25 / Pembacaan cache $0.015
Diskon
-50%
Harga cache prompt

Pembacaan cache

Harga Official
$0.03
Harga TokenLab
$0.015
Diskon
-50%

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Tingkat keberhasilan 30 hari
99,7%
Latensi median 7 hari
1,9 sn=346
Latensi P95 7 hari
7 sn=346
Permintaan 30 hari
100+
Aktivitas terakhir
23 jam yang lalu

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Gemini 3.5 Flash-Lite di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba gemini-3.5-flash-lite dengan pesan singkat di /v1beta/models/gemini-3.5-flash-lite:generateContent. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Visi
  • Alur kerja dokumen

    Konversikan kontrak, faktur, dan laporan menjadi bidang terstruktur dalam skala besar, dengan menulis satu catatan JSON tervalidasi untuk setiap file yang masuk.

  • Triage antrean

    Urutkan tiket atau pesan yang masuk berdasarkan topik dan urgensi sebelum dilihat oleh manusia atau model yang lebih besar.

  • Agen kecil

    Jalankan pekerjaan alat-dalam-siklus yang sempit seperti pencarian pesanan atau perubahan kalender, di mana setiap langkahnya kecil dan siklusnya sering berulang.

  • Pemeriksaan visual

    Konfirmasikan bahwa foto yang diunggah memenuhi aturan sederhana, seperti label yang terlihat atau orientasi yang benar.

Contoh prompt

Ekstrak setiap item baris dari faktur ini sebagai JSON dengan deskripsi, kuantitas, dan jumlah unit.

Nilai urgensi tiket ini sebagai rendah, sedang, atau tinggi dan berikan satu kalimat yang membenarkannya.

Periksa apakah foto produk ini menunjukkan label kemasan dengan jelas; jawab ya atau tidak dan jelaskan alasannya.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Untuk apa Gemini 3.5 Flash-Lite digunakan?

Pekerjaan cepat, berulang, dan sederhana: ekstraksi, klasifikasi, perutean, dan pemeriksaan multimodal ringan. Ini adalah pilihan ekonomis dari keluarga 3.5, yang dibangun untuk kecepatan respons daripada kedalaman.

Apakah ini lebih baru daripada Gemini 3.1 Flash-Lite?

Ya. Ini adalah generasi yang lebih baru, dan Google mencantumkannya sebagai pilihan ringan yang direkomendasikan untuk proyek baru. 3.1 Flash-Lite yang lama tetap tersedia untuk integrasi yang sudah ada.

Bisakah model ini membaca gambar?

Ya, gambar dapat menyertai teks dalam permintaan, dan jawabannya kembali sebagai teks biasa atau sebagai JSON terstruktur, yang cocok untuk pemeriksaan foto dan ekstraksi dokumen yang dipindai.

Kapan model ini dianggap terlalu kecil?

Ketika tugas memerlukan penalaran berkelanjutan, analisis dokumen panjang yang cermat, atau pekerjaan coding selama berjam-jam. Gunakan Gemini 3.8 Flash atau 3.1 Pro untuk kasus tersebut.

Berapa biaya Gemini 3.5 Flash-Lite?

Di TokenLab, Gemini 3.5 Flash-Lite dikenakan Masukan $0.15 / Keluaran $1.25 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 65.536 token per respons.

Endpoint mana yang harus digunakan Gemini 3.5 Flash-Lite?

Pakai https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent sebagai default untuk Gemini 3.5 Flash-Lite. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Gemini 3.5 Flash-Lite

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Gemini 3

Model terkait