xAI: Grok 4.20
grok-4.20- Masukan / Keluaran-50%
- $1.25 / $2.50$0.625 / $1.25
- Konteks
- 1M
- Output maksimal
- 128K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache PromptPenalaran
Tentang Grok 4.20
Grok 4.20 adalah model berkemampuan penalaran dari xAI dalam keluarga 4.20, yang dibuat untuk alur kerja pemanggilan alat (tool-calling) melalui input yang sangat panjang. Model ini membaca teks dan gambar serta menulis teks, dan ia berpikir sebelum menjawab, yang membedakannya dari varian non-penalaran dan multi-agen yang berbagi nama keluarga yang sama. Pilih model ini jika jawaban bergantung pada penggabungan banyak dokumen, tangkapan layar, dan hasil alat perantara.
Kelebihan
- Melakukan penalaran terhadap suatu masalah sebelum membalas, sehingga pertanyaan multi-langkah mendapatkan jawaban yang diproses, bukan sekadar tebakan awal.
- Menerima gambar bersama teks, yang memungkinkan satu percakapan mencampur tangkapan layar, bagan, dan materi tertulis.
- Memanggil alat dan mengembalikan JSON terstruktur, sehingga dapat ditempatkan di dalam loop agen atau alur ekstraksi.
- Menangani riwayat percakapan yang sangat panjang, berguna untuk investigasi yang mengumpulkan bukti selama banyak putaran.
- Prompt caching menurunkan biaya pengiriman ulang awalan (prefix) besar yang sama di berbagai permintaan.
Kapan harus beralih
- Langkah berpikir menambah jeda waktu; varian 4.20 non-penalaran menjawab lebih cepat jika tugasnya berupa draf atau ekstraksi sederhana.
- Rilis Grok yang lebih baru seperti 4.7 menargetkan pekerjaan pengodean dan agen secara lebih langsung dan mungkin bekerja lebih baik pada tugas perangkat lunak yang sulit.
- Output hanya berupa teks, sehingga tidak dapat menghasilkan gambar, audio, atau video.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20", "input": "Hello!" }'
Penetapan Harga
Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.
Masukan token <= 200K
per 1M token- Harga Official
- Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20
- Harga TokenLab
- Masukan $0.625 / Keluaran $1.25 / Pembacaan cache $0.10
- Diskon
- -50%
Masukan token > 200K
per 1M token- Harga Official
- Masukan $2.50 / Keluaran $5.00 / Pembacaan cache $0.40
- Harga TokenLab
- Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20
- Diskon
- -50%
Pembacaan cache
- Harga Official
- $0.20
- Harga TokenLab
- $0.10
- Diskon
- -50%
| Harga Officialper 1M token | Harga TokenLabper 1M token | Diskon | |
|---|---|---|---|
| Masukan token <= 200K | Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20 | Masukan $0.625 / Keluaran $1.25 / Pembacaan cache $0.10 | -50% |
| Masukan token > 200K | Masukan $2.50 / Keluaran $5.00 / Pembacaan cache $0.40 | Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20 | -50% |
| Harga cache prompt | |||
| Pembacaan cache | $0.20 | $0.10 | -50% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Grok 4.20 di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba grok-4.20 dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Penalaran
- Visi
Investigasi berbasis bukti
Berikan laporan, ekspor, dan tangkapan layar yang dikumpulkan selama insiden atau audit, lalu minta linimasa yang beralasan beserta pertanyaan terbuka yang tersisa.
Loop agen dengan alat
Berikan fungsi pencarian, basis data, atau tiket dan biarkan model memutuskan mana yang akan dipanggil, membaca hasilnya, dan melanjutkan hingga pertanyaan terjawab.
Ekstraksi terstruktur dari input yang berantakan
Ubah formulir, faktur, atau log obrolan yang dipindai menjadi skema JSON tetap, dengan langkah penalaran yang membantu pada entri yang ambigu.
Contoh prompt
Tiga ekspor log dan tangkapan layar dasbor disertakan. Buat linimasa pemadaman dan tandai apa pun yang bertentangan dengan log.
Ekstrak vendor, tanggal, item baris, dan pajak dari gambar faktur ini sebagai JSON yang sesuai dengan skema di bawah. Tandai bidang apa pun yang tidak Anda yakini.
Anda dapat memanggil search_orders dan get_customer. Seorang pelanggan mengatakan dua item hilang dari pesanan 8812. Tentukan apa yang harus diperiksa dan dalam urutan apa.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa itu Grok 4.20?
Grok 4.20 adalah model obrolan dari xAI yang menerima teks dan gambar serta menjawab dalam bentuk teks. Ini adalah versi penalaran dari keluarga tersebut: model ini mengerjakan masalah sebelum membalas. xAI menawarkan generasi yang sama dalam bentuk non-penalaran dan multi-agen.
Apa perbedaan grok-4.20 dengan grok-4.20-non-reasoning?
ID dasar menghabiskan waktu untuk bernalar sebelum menjawab, sementara ID non-penalaran membalas secara langsung. Gunakan ID dasar untuk pertanyaan yang memerlukan beberapa langkah analisis, dan gunakan yang non-penalaran untuk draf, ekstraksi, dan obrolan di mana kecepatan lebih penting daripada kedalaman.
Bisakah Grok 4.20 membaca gambar?
Ya. Anda dapat mengirim gambar bersama teks Anda, misalnya tangkapan layar, bagan, atau dokumen yang difoto, dan mengajukan pertanyaan tentangnya dalam percakapan yang sama. Balasannya berupa teks; model tidak menghasilkan atau mengedit gambar.
Apakah Grok 4.20 mendukung pemanggilan alat dan output JSON?
Ya. Model ini mendukung pemanggilan fungsi dan respons JSON terstruktur, sehingga Anda dapat menghubungkannya ke fungsi Anda sendiri atau memaksa jawaban ke dalam skema. Hal itu membuatnya dapat digunakan untuk pekerjaan ekstraksi dan untuk agen yang bertindak pada sistem eksternal.
Bisakah saya menggunakan klien bergaya OpenAI saya yang sudah ada dengan Grok 4.20?
Ya. Kode klien bergaya OpenAI yang ada berfungsi dengan mengubah nama model, dan definisi alat serta skema JSON menggunakan bidang yang sama dengan yang sudah Anda kirim saat ini.
Berapa biaya Grok 4.20?
Di TokenLab, Grok 4.20 dikenakan Masukan $0.625 / Keluaran $1.25 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Grok 4.20?
Grok 4.20 mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 131.072 token per respons.
Endpoint mana yang harus digunakan Grok 4.20?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk Grok 4.20. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Grok 4.20?
Grok 4.20 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Grok 4.20
Sumber
Ditinjau 2 Okt 2026