xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- Masukan / Keluaran-50%
- $1.25 / $2.50$0.625 / $1.25
- Konteks
- 1M
- Output maksimal
- 128K
- Modalitas
- VisiObrolan
- Kapabilitas
- Penggunaan toolCache Prompt
Tentang Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning adalah versi jawaban langsung dari model 4.20 xAI. Model ini melewati fase berpikir yang diperpanjang, sehingga membalas dengan cepat terhadap prompt teks dan gambar serta cocok untuk penyusunan draf, ekstraksi, dan obrolan berbantuan alat. xAI menggambarkannya sebagai kombinasi kepatuhan prompt yang ketat dengan tingkat halusinasi yang rendah. Pilih varian penalaran atau multi-agen saat masalah memerlukan analisis yang disengaja.
Kelebihan
- Membalas tanpa fase berpikir terpisah, yang menjaga latensi tetap rendah untuk obrolan interaktif dan pekerjaan bervolume tinggi.
- xAI menyoroti kepatuhan prompt yang ketat dan tingkat halusinasi yang rendah untuk model ini, berguna saat output harus mengikuti templat.
- Mendukung pemanggilan fungsi dan output JSON terstruktur untuk alur kerja ekstraksi dan asisten berbasis alat.
- Menerima gambar dengan teks, sehingga dapat membaca tanda terima atau tangkapan layar dan menjawab dalam satu langkah.
- Penembolokan prompt membantu saat banyak permintaan menggunakan kembali instruksi panjang atau teks referensi yang sama.
Kapan harus beralih
- Tanpa langkah penalaran, model ini lebih lemah dalam logika multi-tahap atau matematika dibandingkan grok-4.20 atau grok-4.7.
- Model ini tidak membagi pekerjaan ke berbagai agen; riset terbuka lebih baik dilayani oleh varian multi-agen.
- Output hanya berupa teks, tanpa pembuatan gambar, audio, atau video.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Teks ke teksResponses APIPOST/v1/responsesFormat API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
Penetapan Harga
Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.
Spesifikasi default
per 1M token- Harga Official
- Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20
- Harga TokenLab
- Masukan $0.625 / Keluaran $1.25 / Pembacaan cache $0.10
- Diskon
- -50%
Pembacaan cache
- Harga Official
- $0.20
- Harga TokenLab
- $0.10
- Diskon
- -50%
| Harga Officialper 1M token | Harga TokenLabper 1M token | Diskon | |
|---|---|---|---|
| Spesifikasi default | Masukan $1.25 / Keluaran $2.50 / Pembacaan cache $0.20 | Masukan $0.625 / Keluaran $1.25 / Pembacaan cache $0.10 | -50% |
| Harga cache prompt | |||
| Pembacaan cache | $0.20 | $0.10 | -50% |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Grok 4.20 Non-Reasoning di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba grok-4.20-non-reasoning dengan pesan singkat di /v1/responses. Tampilkan balasan, latensi, dan biayanya.
Skenario penggunaan
Cocok untuk- Visi
Obrolan yang berhadapan dengan pelanggan
Jawab pertanyaan produk dan akun dengan nada yang konsisten, panggil fungsi pencarian jika diperlukan, tanpa membuat pelanggan menunggu fase berpikir yang lama.
Ekstraksi dokumen massal
Jalankan ribuan kontrak, formulir, atau email melalui skema JSON tetap, dengan mengandalkan kepatuhan instruksi yang ketat agar bidang tetap konsisten.
Penyusunan draf dan penulisan ulang
Buat draf pertama email, ringkasan, dan catatan rilis dalam format yang diminta, lalu sempurnakan dengan instruksi tindak lanjut singkat.
Contoh prompt
Ringkas utas dukungan ini dalam tiga poin dan satu saran balasan. Jaga balasan di bawah 80 kata dan jangan menjanjikan pengembalian dana.
Tarik nama pihak, tanggal efektif, dan periode pemberitahuan pengakhiran dari kontrak ini ke dalam skema JSON di bawah. Kembalikan null untuk apa pun yang hilang.
Tulis ulang log perubahan ini untuk pelanggan non-teknis. Pertahankan judul, hapus nomor tiket internal, dan gunakan kalimat sederhana.
Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.
FAQ
Apa itu Grok 4.20 Non-Reasoning?
Ini adalah versi Grok 4.20 xAI yang menjawab secara langsung alih-alih berpikir terlebih dahulu. Model ini membaca teks dan gambar, menulis teks, serta mendukung pemanggilan fungsi dan output terstruktur. Model ini ditujukan untuk pekerjaan cepat yang padat instruksi seperti ekstraksi, penyusunan draf, dan obrolan berbantuan alat.
Kapan saya harus menggunakan non-reasoning alih-alih grok-4.20?
Gunakan saat tugasnya jelas dan jawabannya sebagian besar berupa penarikan informasi, penulisan ulang, atau pemformatan. Model ini merespons lebih cepat daripada ID penalaran. Beralihlah ke grok-4.20 saat jawaban memerlukan beberapa langkah analisis, seperti debugging atau perencanaan.
Apakah Grok 4.20 Non-Reasoning mengikuti skema JSON?
Ya. Model ini mendukung output terstruktur, sehingga Anda dapat memberikan skema dan menerima respons yang sesuai. Dikombinasikan dengan penekanan xAI pada kepatuhan prompt yang ketat, ini menjadikannya default yang masuk akal untuk pekerjaan ekstraksi dan klasifikasi.
Bisakah model ini menerima input gambar?
Ya, gambar dapat dikirim bersama teks, misalnya formulir yang difoto atau tangkapan layar UI. Balasannya berupa teks. Model tidak dapat membuat atau mengedit gambar.
Apakah model ini bekerja dengan klien bergaya OpenAI yang ada?
Ya. Kode klien bergaya OpenAI yang ada berfungsi hanya dengan mengubah nama model, dengan definisi alat dan skema JSON dikirim di bidang yang biasa seperti sebelumnya.
Berapa biaya Grok 4.20 Non-Reasoning?
Di TokenLab, Grok 4.20 Non-Reasoning dikenakan Masukan $0.625 / Keluaran $1.25 per 1M token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Berapa batas konteks dan output Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning mendukung hingga 1.000.000 token konteks dan menghasilkan hingga 131.072 token per respons.
Endpoint mana yang harus digunakan Grok 4.20 Non-Reasoning?
Pakai https://api.tokenlab.sh/v1/responses sebagai default untuk Grok 4.20 Non-Reasoning. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Grok 4.20 Non-Reasoning?
Grok 4.20 Non-Reasoning mendukung Teks ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Grok 4.20 Non-Reasoning
Sumber
Ditinjau 2 Okt 2026