Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

xAI: Grok 4.20

Grok 4.20 menggabungkan penalaran, input visual, dan penggunaan alat dalam percakapan konteks panjang. Model ini berguna untuk investigasi yang menyatukan teks ekstensif, gambar, dan hasil antara sebelum mencapai jawaban.
Bandingkan model
grok-4.20
TersediaxAIObrolanInput cache 84% lebih hemat
Masukan / Keluaran-50%
$1.25 / $2.50$0.625 / $1.25
Konteks
1M
Output maksimal
128K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache PromptPenalaran

Tentang Grok 4.20

Grok 4.20 adalah model berkemampuan penalaran dari xAI dalam keluarga 4.20, yang dibuat untuk alur kerja pemanggilan alat (tool-calling) melalui input yang sangat panjang. Model ini membaca teks dan gambar serta menulis teks, dan ia berpikir sebelum menjawab, yang membedakannya dari varian non-penalaran dan multi-agen yang berbagi nama keluarga yang sama. Pilih model ini jika jawaban bergantung pada penggabungan banyak dokumen, tangkapan layar, dan hasil alat perantara.

Kelebihan

  • Melakukan penalaran terhadap suatu masalah sebelum membalas, sehingga pertanyaan multi-langkah mendapatkan jawaban yang diproses, bukan sekadar tebakan awal.
  • Menerima gambar bersama teks, yang memungkinkan satu percakapan mencampur tangkapan layar, bagan, dan materi tertulis.
  • Memanggil alat dan mengembalikan JSON terstruktur, sehingga dapat ditempatkan di dalam loop agen atau alur ekstraksi.
  • Menangani riwayat percakapan yang sangat panjang, berguna untuk investigasi yang mengumpulkan bukti selama banyak putaran.
  • Prompt caching menurunkan biaya pengiriman ulang awalan (prefix) besar yang sama di berbagai permintaan.

Kapan harus beralih

  • Langkah berpikir menambah jeda waktu; varian 4.20 non-penalaran menjawab lebih cepat jika tugasnya berupa draf atau ekstraksi sederhana.
  • Rilis Grok yang lebih baru seperti 4.7 menargetkan pekerjaan pengodean dan agen secara lebih langsung dan mungkin bekerja lebih baik pada tugas perangkat lunak yang sulit.
  • Output hanya berupa teks, sehingga tidak dapat menghasilkan gambar, audio, atau video.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke teksResponses API
    POST/v1/responses
    Format API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20",
        "input": "Hello!"
      }'

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Masukan token <= 200K

per 1M token
Harga Official
Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20
Harga TokenLab
Masukan $0.625 / Keluaran $1.25 / Pembacaan cache $0.10
Diskon
-50%

Masukan token > 200K

per 1M token
Harga Official
Masukan $2.50 / Keluaran $5.00 / Pembacaan cache $0.40
Harga TokenLab
Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20
Diskon
-50%
Harga cache prompt

Pembacaan cache

Harga Official
$0.20
Harga TokenLab
$0.10
Diskon
-50%

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Grok 4.20 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba grok-4.20 dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk
  • Penalaran
  • Visi
  • Investigasi berbasis bukti

    Berikan laporan, ekspor, dan tangkapan layar yang dikumpulkan selama insiden atau audit, lalu minta linimasa yang beralasan beserta pertanyaan terbuka yang tersisa.

  • Loop agen dengan alat

    Berikan fungsi pencarian, basis data, atau tiket dan biarkan model memutuskan mana yang akan dipanggil, membaca hasilnya, dan melanjutkan hingga pertanyaan terjawab.

  • Ekstraksi terstruktur dari input yang berantakan

    Ubah formulir, faktur, atau log obrolan yang dipindai menjadi skema JSON tetap, dengan langkah penalaran yang membantu pada entri yang ambigu.

Contoh prompt

Tiga ekspor log dan tangkapan layar dasbor disertakan. Buat linimasa pemadaman dan tandai apa pun yang bertentangan dengan log.

Ekstrak vendor, tanggal, item baris, dan pajak dari gambar faktur ini sebagai JSON yang sesuai dengan skema di bawah. Tandai bidang apa pun yang tidak Anda yakini.

Anda dapat memanggil search_orders dan get_customer. Seorang pelanggan mengatakan dua item hilang dari pesanan 8812. Tentukan apa yang harus diperiksa dan dalam urutan apa.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Apa itu Grok 4.20?

Grok 4.20 adalah model obrolan dari xAI yang menerima teks dan gambar serta menjawab dalam bentuk teks. Ini adalah versi penalaran dari keluarga tersebut: model ini mengerjakan masalah sebelum membalas. xAI menawarkan generasi yang sama dalam bentuk non-penalaran dan multi-agen.

Apa perbedaan grok-4.20 dengan grok-4.20-non-reasoning?

ID dasar menghabiskan waktu untuk bernalar sebelum menjawab, sementara ID non-penalaran membalas secara langsung. Gunakan ID dasar untuk pertanyaan yang memerlukan beberapa langkah analisis, dan gunakan yang non-penalaran untuk draf, ekstraksi, dan obrolan di mana kecepatan lebih penting daripada kedalaman.

Bisakah Grok 4.20 membaca gambar?

Ya. Anda dapat mengirim gambar bersama teks Anda, misalnya tangkapan layar, bagan, atau dokumen yang difoto, dan mengajukan pertanyaan tentangnya dalam percakapan yang sama. Balasannya berupa teks; model tidak menghasilkan atau mengedit gambar.

Apakah Grok 4.20 mendukung pemanggilan alat dan output JSON?

Ya. Model ini mendukung pemanggilan fungsi dan respons JSON terstruktur, sehingga Anda dapat menghubungkannya ke fungsi Anda sendiri atau memaksa jawaban ke dalam skema. Hal itu membuatnya dapat digunakan untuk pekerjaan ekstraksi dan untuk agen yang bertindak pada sistem eksternal.

Bisakah saya menggunakan klien bergaya OpenAI saya yang sudah ada dengan Grok 4.20?

Ya. Kode klien bergaya OpenAI yang ada berfungsi dengan mengubah nama model, dan definisi alat serta skema JSON menggunakan bidang yang sama dengan yang sudah Anda kirim saat ini.

Berapa biaya Grok 4.20?

Di TokenLab, Grok 4.20 dikenakan Masukan $0.625 / Keluaran $1.25 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Berapa batas konteks dan output Grok 4.20?

Grok 4.20 mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 131.072 token per respons.

Endpoint mana yang harus digunakan Grok 4.20?

Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk Grok 4.20. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Grok 4.20?

Grok 4.20 mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Grok 4.20

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Grok 4

Model terkait