Google: Gemma 4 31B
gemma-4-31b- Masukan / Keluaran
- $0.102 / $0.297
- Modalitas
- Obrolan
Tentang Gemma 4 31B
Gemma 4 31B adalah model dense terbesar dalam keluarga Gemma 4 open-weight Google, yang diluncurkan pada Maret 2026 dalam ukuran mulai dari E2B hingga 31B. Google mendeskripsikan keluarga model ini dibangun untuk penalaran, alur kerja agen, pengodean, dan pemahaman multimodal. Berbeda dengan model Gemini yang bersifat proprietary, bobotnya dipublikasikan, sehingga model yang sama juga dapat dijalankan di perangkat keras Anda sendiri.
Kelebihan
- Bobot terbuka (open weights) memungkinkan Anda memindahkan model yang sama antara pengaturan yang di-host dan yang dijalankan sendiri.
- Ukuran Dense 31B menargetkan kualitas penalaran dan pengodean yang tidak dimiliki oleh ukuran Gemma 4 yang lebih kecil.
- Kartu model Google melaporkan hasil yang kuat pada tolok ukur penalaran dan pengodean seperti MMLU Pro dan LiveCodeBench v6.
- Cakupan multibahasa di lebih dari 140 bahasa.
Kapan harus beralih
- Model ini hanya bekerja dengan teks dan tidak memiliki pemanggilan alat (tool calling), sehingga alur kerja agen lebih baik dilayani oleh model Gemini.
- Model ini kurang mampu dibandingkan model Gemini 3.x Pro dan Flash pada tugas otonom yang panjang.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksChat Completions APIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gemma-4-31b", "messages": [ {"role": "user", "content": "Hello!"} ] }'
Penetapan Harga
Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.
Spesifikasi default
per 1M token- Harga Official
- Masukan $0.102 / Keluaran $0.297 / Pembacaan cache $0.012
- Official
- Masukan $0.102 / Keluaran $0.297 / Pembacaan cache $0.012
- Diskon
- —
Pembacaan cache
- Harga Official
- $0.012
- Official
- $0.012
- Diskon
- —
| Harga Officialper 1M token | Officialper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $0.102 / Keluaran $0.297 / Pembacaan cache $0.012 | Masukan $0.102 / Keluaran $0.297 / Pembacaan cache $0.012 | — |
| Harga cache prompt | |||
| Pembacaan cache | $0.012 | $0.012 | — |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Gemma 4 31B di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba gemma-4-31b dengan pesan singkat di /v1/chat/completions. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Asisten yang dapat di-host sendiri
Buat prototipe menggunakan model yang di-host, lalu pindahkan ke GPU Anda sendiri jika aturan data mengharuskannya.
Obrolan multibahasa
Menjawab pengguna dalam banyak bahasa dari satu model, yang menjaga alat pendukung tetap lebih sederhana daripada menjalankan penerjemah terpisah.
Penjelasan kode
Meninjau cuplikan dan menulis fungsi dalam pengaturan di mana model open-weight menjadi persyaratan karena alasan kebijakan atau hosting.
Basis fine-tuning
Bandingkan baseline yang di-host sebelum mengadaptasi bobot terbuka ke domain Anda.
Contoh prompt
Terjemahkan paragraf ini ke dalam bahasa Spanyol, Jerman, dan Jepang, serta catat idiom apa pun yang harus Anda susun ulang.
Jelaskan apa yang dilakukan kueri SQL ini, lalu tulis ulang agar menghindari subkueri berkorelasi.
Tulis balasan singkat dan sopan untuk menolak permintaan rapat ini dan mengusulkan waktu di minggu depan.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apakah Gemma 4 31B bersifat open source?
Google memublikasikan bobotnya di bawah ketentuan Gemma, yang menjadikannya open-weight. Baca lisensi pada kartu model sebelum penggunaan komersial, karena ini adalah lisensi milik Gemma sendiri.
Apa perbedaan Gemma dengan Gemini?
Model Gemini adalah lini proprietary Google yang di-host. Model Gemma adalah model open-weight yang lebih kecil yang dibangun dari penelitian terkait, yang dapat Anda unduh, fine-tune, dan jalankan sendiri.
Apakah model ini mendukung pemanggilan alat (tool calling)?
Tidak. Model yang di-host hanya menangani obrolan teks, dengan input dan output teks serta tanpa pemanggilan alat. Untuk agen yang memanggil fungsi, gunakan model Gemini sebagai gantinya.
Berapa ukuran model ini?
Sekitar 31 miliar parameter, dense, yang terbesar dari lima ukuran Gemma 4: E2B, E4B, 12B, 26B A4B, dan 31B. Ukuran yang lebih kecil menargetkan ponsel dan laptop.
Berapa biaya Gemma 4 31B?
Di TokenLab, Gemma 4 31B dikenakan Masukan $0.102 / Keluaran $0.297 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Endpoint mana yang harus digunakan Gemma 4 31B?
Pakai https://api.tokenlab.sh/v1/chat/completions sebagai default untuk Gemma 4 31B. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Gemma 4 31B?
Gemma 4 31B mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Gemma 4 31B
Sumber
Ditinjau 2 Okt 2026