Google: Gemini 3.5 Flash
gemini-3.5-flash- Masukan / Keluaran-50%
- $1.50 / $9.00$0.75 / $4.50
- Konteks
- 1M
- Dirilis
- 19 Mei 2026
- Output maksimal
- 64K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang Gemini 3.5 Flash
Gemini 3.5 Flash adalah model tingkat Flash yang stabil dari Google yang dideskripsikan oleh Google sebagai tolok ukur kecepatan dan performa dasar pada beban kerja rutin dengan volume tinggi. Model ini membaca teks dan gambar, memanggil alat (tools), mengembalikan JSON yang terikat skema (schema-bound), dan mendukung penelusuran dalam cache (caching). Model ini berada di antara Flash-Lite 3.5 dan rilis Flash 3.6, 3.7, serta 3.8 berikutnya.
Kelebihan
- Model Flash serbaguna yang stabil untuk obrolan rutin, ekstraksi, dan peringkasan dalam volume besar.
- Pemanggilan alat mendukung asisten yang menjalankan tugas melalui beberapa langkah.
- Input gambar memungkinkannya menangani tangkapan layar, hasil pemindaian, dan grafik tanpa memerlukan model visi terpisah.
- JSON yang terikat skema dan penelusuran konteks sesuai untuk panggilan alur berulang.
Kapan harus beralih
- Model Flash 3.6, 3.7, dan 3.8 berikutnya lebih unggul dalam tugas pengkodean dan agen.
- Model ini tidak memiliki mode penalaran khusus (thinking mode), sehingga penalaran multi-langkah yang rumit lebih baik dikirimkan ke tempat lain.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksGemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentFormat API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Penetapan Harga
Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.
Spesifikasi default
per 1M token- Harga Official
- Masukan $1.50 / Keluaran $9.00 / Pembacaan cache $0.15
- Harga Verified
- Masukan $0.75 / Keluaran $4.50 / Pembacaan cache $0.075
- Diskon
- -50%
Pembacaan cache
- Harga Official
- $0.15
- Harga Verified
- $0.075
- Diskon
- -50%
Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.
Pencarian web
- Harga Official
- $0.014/pencarian
- Harga Verified
- $0.007/pencarian
- Diskon
- -50%
| Harga Officialper 1M token | Harga Verifiedper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $1.50 / Keluaran $9.00 / Pembacaan cache $0.15 | Masukan $0.75 / Keluaran $4.50 / Pembacaan cache $0.075 | -50% |
| Harga cache prompt | |||
| Pembacaan cache | $0.15 | $0.075 | -50% |
| Biaya alatBiaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut. | |||
| Pencarian web | $0.014/pencarian | $0.007/pencarian | -50% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
- Tingkat keberhasilan 30 hari
- 95,0%
- Permintaan 30 hari
- 1K+
- Aktivitas terakhir
- 58 menit yang lalu
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Gemini 3.5 Flash di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba gemini-3.5-flash dengan pesan singkat di /v1beta/models/gemini-3.5-flash:generateContent. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
- Visi
Obrolan yang berorientasi pada pelanggan
Menjawab pertanyaan produk dengan basis pengetahuan yang di-cache di awalan prompt.
Peringkasan massal
Meringkas transkrip panggilan atau tiket dan menghasilkan ringkasan JSON tetap per item.
Pembacaan formulir dan dokumen
Menarik kolom dari formulir yang dipindai dan catatan pengiriman ke dalam catatan terstruktur yang dapat dimuat langsung oleh sistem hilir.
Bantuan pengkodean tingkat pemula
Menjelaskan kode, menulis fungsi kecil, dan membuat draf unit uji di mana kedalaman bukanlah hal yang krusial.
Contoh prompt
Ringkas transkrip dukungan ini dalam tiga poin dan tetapkan 'resolved' menjadi true atau false.
Baca catatan pengiriman yang dipindai ini dan kembalikan nomor pesanan, item, serta status tanda tangan sebagai JSON.
Tulis fungsi Python yang mengurai tanggal ISO dari string yang berantakan, ditambah lima kasus uji.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa itu Gemini 3.5 Flash?
Model Gemini tingkat Flash yang stabil yang ditujukan untuk tugas rutin bervolume tinggi. Model ini menerima teks dan gambar, menggunakan alat, dan menghasilkan output terstruktur, dengan fokus pada kecepatan yang stabil alih-alih kedalaman maksimum.
Bagaimana perbandingannya dengan Gemini 3.5 Flash-Lite?
Flash-Lite adalah model 3.5 tercepat dan paling hemat dari Google; Flash adalah model yang lebih lengkap untuk tugas yang memerlukan ketelitian lebih. Pilih Lite untuk penandaan dan ekstraksi, serta Flash untuk percakapan dan output yang lebih panjang.
Apakah model ini bagus untuk agen pengkodean?
Model ini dapat menangani tugas pengkodean kecil, tetapi model Flash 3.7 dan 3.8 terbaru dari Google adalah model yang dikhususkan untuk pengkodean kompleks dan agen berdurasi panjang. Gunakan 3.5 Flash saat pekerjaannya sederhana dan volumenya tinggi.
Apakah model ini mendukung gambar dan caching?
Ya untuk keduanya. Gambar dapat disertakan di sebelah teks dalam satu permintaan, dan penelusuran konteks menggunakan kembali awalan bersama yang panjang di banyak permintaan, seperti kumpulan instruksi tetap.
Berapa biaya Gemini 3.5 Flash?
Di TokenLab, Gemini 3.5 Flash dikenakan Masukan $0.75 / Keluaran $4.50 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Gemini 3.5 Flash?
Gemini 3.5 Flash mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 65.536 token per respons.
Endpoint mana yang harus digunakan Gemini 3.5 Flash?
Pakai https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent sebagai default untuk Gemini 3.5 Flash. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Gemini 3.5 Flash?
Gemini 3.5 Flash mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Gemini 3.5 Flash
Panduan menggunakan Gemini 3.5 Flash
Sumber
Ditinjau 2 Okt 2026