Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Google: Gemini 3.7 Flash

Model Gemini berefisiensi tinggi untuk alur kerja agen, pengodean, dan penalaran multimodal
Bandingkan model
gemini-3.7-flash
TersediaGoogleObrolanInput cache 90% lebih hemat
Masukan / Keluaran-50%
$0.75 / $3.75$0.375 / $1.88
Konteks
1M
Dirilis
13 Agu 2026
Output maksimal
64K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache Prompt

Tentang Gemini 3.7 Flash

Gemini 3.7 Flash adalah model tier Flash stabil dari Google, yang dirilis pada Agustus 2026, yang dideskripsikan oleh Google dibuat untuk pengodingan kompleks, alur kerja agen (agentic workflows), dan eksekusi multi-langkah yang andal. Model ini membaca teks dan gambar, mendukunq proses berpikir (thinking), memanggil alat (tools), mengembalikan JSON yang terikat skema (schema-bound), dan menyimpan cache konteks. Model ini satu tingkat di atas 3.6 Flash dan satu tingkat di bawah 3.8 Flash.

Kelebihan

  • Penalaran dapat berjalan sebelum jawaban diberikan, yang membantu pada tugas pengodingan dan multi-langkah.
  • Eksekusi multi-langkah yang andal adalah tujuan desain yang dinyatakan, berguna ketika sebuah agen tidak boleh kehilangan posisinya.
  • Pemanggilan alat dan JSON yang terikat skema membuat hasil lebih mudah dimasukkan ke dalam sistem lain.
  • Masukan gambar menangani tangkapan layar, diagram, dan dokumen yang dipindai.

Kapan harus beralih

  • Gemini 3.8 Flash adalah model yang lebih baru yang dipresentasikan oleh Google sebagai tier Flash yang paling mumpuni.
  • Proses berpikir menambah latensi, sehingga pencarian sederhana lebih baik dilayani oleh Flash-Lite.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    Format API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Penetapan Harga

Harga Verified berlaku untuk Verified yang lebih murah di sebagian besar model. Harga Official adalah harga resmi dari pembuat model dan berlaku untuk rute Official yang lebih andal. Auto menagihkan biaya berdasarkan rute yang menyelesaikan permintaan.

Promotional Standard

per 1M token
Harga Official
Masukan $0.75 / Keluaran $3.75 / Pembacaan cache $0.075
Harga Verified
Masukan $0.375 / Keluaran $1.88 / Pembacaan cache $0.0375
Diskon
-50%
Harga cache prompt

Pembacaan cache

Harga Official
$0.075
Harga Verified
$0.0375
Diskon
-50%
Biaya alat

Biaya dikenakan per panggilan, hanya saat model menggunakan alat tersebut.

Pencarian web

Harga Official
$0.014/pencarian
Harga Verified
$0.007/pencarian
Diskon
-50%

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Tingkat keberhasilan 30 hari
99,8%
Latensi median 7 hari
13,6 sn=271
Latensi P95 7 hari
53 sn=271
Permintaan 30 hari
1K+
Aktivitas terakhir
19 jam yang lalu

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Gemini 3.7 Flash di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba gemini-3.7-flash dengan pesan singkat di /v1beta/models/gemini-3.7-flash:generateContent. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Visi
  • Implementasi fitur

    Minta agen membaca tiket, mengedit beberapa file, dan menjalankan pengujian.

  • Otomatisasi alur kerja

    Merangkai persetujuan, pencarian, dan pemberitahuan di mana setiap langkah bergantung pada langkah sebelumnya.

  • Tinjauan kode

    M membaca diff, menandai perubahan berisiko, dan menjelaskan setiap temuan sehingga peninjau manusia dapat memutuskan dengan cepat apa yang harus diterima.

  • Pembersihan data

    Menalar catatan yang tidak konsisten dan mengusulkan aturan normalisasi sebelum menerapkannya, sehingga pembersihan dapat diaudit terlebih dahulu.

Contoh prompt

Baca tiket ini dan file yang tertaut, implementasikan perubahan, dan buat daftar pengujian yang Anda jalankan.

Tinjau diff ini untuk mencari bug konkurensi dan peringkatkan temuan berdasarkan tingkat keparahannya.

Kedua catatan pelanggan ini tampak seperti duplikat. Jelaskan bidang mana yang berkonflik dan aturan apa yang akan menggabungkannya dengan aman.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Untuk apa Gemini 3.7 Flash dirancang?

Pengodingan kompleks, alur kerja agen, dan eksekusi multi-langkah yang harus tetap andal dari langkah pertama hingga terakhir. Ini adalah model Flash yang mampu berpikir dengan dukungan alat dan gambar.

Apakah model ini mendukung proses berpikir?

Ya. Model ini dapat menalar sebelum membalas, yang meningkatkan hasil pada kode dan perencanaan. Biarkan upaya tersebut tetap rendah untuk giliran interaktif pendek agar respons tetap cepat.

Apa perbedaannya dengan 3.6 Flash?

3.7 Flash adalah model yang lebih baru dan menambahkan penalaran, dengan penekanan yang lebih kuat pada eksekusi multi-langkah yang dapat diandalkan. 3.6 Flash dirancang di sekitar perulangan pengodingan dan penalaran visual tanpa proses berpikir.

Apakah 3.8 Flash merupakan pilihan yang lebih baik?

Seringkali, untuk rekayasa perangkat lunak jangka panjang (long-horizon). 3.7 Flash tetap menjadi pilihan yang masuk akal ketika Anda telah menyetel prompt untuk model tersebut dan hasilnya memenuhi standar Anda.

Berapa biaya Gemini 3.7 Flash?

Di TokenLab, Gemini 3.7 Flash dikenakan Masukan $0.375 / Keluaran $1.88 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output Gemini 3.7 Flash?

Gemini 3.7 Flash mendukung hingga 1.048.576 token konteks dan menghasilkan hingga 65.536 token per respons.

Endpoint mana yang harus digunakan Gemini 3.7 Flash?

Pakai https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent sebagai default untuk Gemini 3.7 Flash. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Gemini 3.7 Flash?

Gemini 3.7 Flash mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Gemini 3.7 Flash

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Gemini 3

Model terkait