Google: Gemini 3.6 Flash
gemini-3.6-flash- Masukan / Keluaran
- $0.75 / $3.75
- Konteks
- 1M
- Dirilis
- 21 Jul 2026
- Output maksimal
- 64K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache Prompt
Tentang Gemini 3.6 Flash
Gemini 3.6 Flash adalah model Gemini tingkat Flash yang stabil yang dideskripsikan oleh Google menyeimbangkan kecepatan dan kemampuan multimodal. Dirilis pada Juli 2026, di antara 3.5 Flash dan 3.7 Flash. Google memposisikannya untuk siklus pengkodean yang efisien, orkestrasi alat, and penalaran visual, sehingga cocok untuk agen yang memeriksa hasil, merevisi, dan memutuskan tindakan selanjutnya.
Kelebihan
- Cocok untuk siklus di mana agen menjalankan kode, membaca output, dan merevisi.
- Orkestrasi alat di beberapa panggilan adalah fokus yang dinyatakan.
- Penalaran visual atas tangkapan layar dan diagram bekerja dalam permintaan yang sama dengan teks.
- JSON yang terikat skema dan caching mendukung penggunaan produksi yang dapat diulang.
Kapan harus beralih
- Flash 3.7 dan 3.8 lebih baru dan ditujukan untuk pengkodean yang lebih kompleks serta proses otonom yang lebih panjang.
- Model ini tidak memiliki mode penalaran khusus, sehingga pertimbangan mendalam lebih baik dilakukan pada model Pro.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksGemini APIPOST/v1beta/models/gemini-3.6-flash:generateContentFormat API:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
Penetapan Harga
Harga TokenLab berlaku untuk Verified yang lebih terjangkau. Harga Official mengikuti standar penyedia model untuk keandalan lebih tinggi. Auto akan menagih berdasarkan jalur yang berhasil menyelesaikan permintaan.
Spesifikasi default
per 1M token- Harga Official
- Masukan $0.75 / Keluaran $3.75 / Pembacaan cache $0.075
- Harga TokenLab
- Masukan $0.75 / Keluaran $3.75 / Pembacaan cache $0.075
- Diskon
- —
Pembacaan cache
- Harga Official
- $0.075
- Harga TokenLab
- $0.075
- Diskon
- —
Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.
Pencarian web
- Harga Official
- $0.014/pencarian
- Harga TokenLab
- $0.007/pencarian
- Diskon
- -50%
| Harga Officialper 1M token | Harga TokenLabper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $0.75 / Keluaran $3.75 / Pembacaan cache $0.075 | Masukan $0.75 / Keluaran $3.75 / Pembacaan cache $0.075 | — |
| Harga cache prompt | |||
| Pembacaan cache | $0.075 | $0.075 | — |
| Biaya alatBiaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut. | |||
| Pencarian web | $0.014/pencarian | $0.007/pencarian | -50% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
- Tingkat keberhasilan 30 hari
- 99,7%
- Permintaan 30 hari
- 100+
- Aktivitas terakhir
- 13 jam yang lalu
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Gemini 3.6 Flash di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba gemini-3.6-flash dengan pesan singkat di /v1beta/models/gemini-3.6-flash:generateContent. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Visi
Siklus perbaikan kode
Biarkan agen menjalankan pengujian, membaca kegagalan, menambal file, dan mengulanginya hingga berhasil.
Inspeksi UI
Bandingkan tangkapan layar dengan spesifikasi tertulis dan daftarkan setiap ketidaksesuaian spasi, warna, atau tata letak yang harus diperbaiki oleh reviewer.
Asisten yang mengandalkan banyak alat
Koordinasikan panggilan pencarian, kalender, dan CRM dalam satu percakapan, dengan meneruskan hasil dari setiap alat ke keputusan berikutnya.
Tanya Jawab Multimodal
Menjawab pertanyaan yang memerlukan gambar grafik dan teks laporan di sekitarnya.
Contoh prompt
Jalankan pengujian, baca output kegagalan, dan ubah hanya fungsi yang merusak pengujian kedua.
Bandingkan tangkapan layar ini dengan spesifikasi desain dan daftarkan setiap ketidaksesuaian spasi atau warna.
Periksa kalender dan CRM saya, lalu draf balasan yang mengusulkan dua waktu pertemuan.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa keunggulan terbaik Gemini 3.6 Flash?
Pekerjaan agen iteratif: siklus pengkodean, orkestrasi alat, dan penalaran atas gambar. Model ini menyeimbangkan kecepatan terhadap kemampuan multimodal, menjadikannya pilihan default yang wajar untuk agen yang tidak memerlukan Flash terbaru.
Apa perbedaannya dengan 3.5 Flash?
3.6 adalah rilis yang lebih baru dan dideskripsikan seputar siklus pengkodean dan penggunaan alat, sementara 3.5 Flash adalah dasar untuk pekerjaan rutin bervolume tinggi. Harapkan perilaku agen yang lebih baik dari 3.6.
Haruskah saya beralih ke 3.8 Flash?
Jika Anda menjalankan tugas perangkat lunak yang panjang atau alur perusahaan yang kompleks, 3.8 Flash adalah model yang diposisikan Google untuk hal tersebut. Untuk agen yang lebih sederhana, 3.6 mungkin sudah cukup; jalankan keduanya pada trace Anda sendiri.
Apakah model ini menerima gambar?
Ya. Gambar dan teks dapat digabungkan dalam satu permintaan, dan model menjawab dalam bentuk teks atau JSON yang mengikuti skema yang Anda sediakan. Model ini tidak menghasilkan gambar sendiri.
Berapa biaya Gemini 3.6 Flash?
Di TokenLab, Gemini 3.6 Flash dikenakan Masukan $0.75 / Keluaran $3.75 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Gemini 3.6 Flash?
Gemini 3.6 Flash mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 65.536 token per respons.
Endpoint mana yang harus digunakan Gemini 3.6 Flash?
Pakai https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent sebagai default untuk Gemini 3.6 Flash. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Gemini 3.6 Flash?
Gemini 3.6 Flash mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Gemini 3.6 Flash
Sumber
Ditinjau 2 Okt 2026