Zhipu AI: glm-5v-turbo

Harga, performa, kapabilitas, dan permintaan siap pakai untuk glm-5v-turbo.
Bandingkan model
glm-5v-turbo
TersediaZhipu AIObrolanInput cache 80% lebih hemat
Masukan / Keluaran
$1.20 / $4.00
Konteks
205K
Output maksimal
128K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache Prompt

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    chat_completionKompatibel OpenAI
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "glm-5v-turbo",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Display Base Rates

Per 1M Token
Harga Official
Masukan $1.20 / Keluaran $4.00 / Pembacaan cache $0.24
Harga TokenLab
Masukan $1.20 / Keluaran $4.00 / Pembacaan cache $0.24
Diskon
-
Harga cache prompt

Pembacaan cache

Harga Official
$0.24
Harga TokenLab
$0.24
Diskon
-

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir

Belum ada data

Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka glm-5v-turbo di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba glm-5v-turbo dengan pesan singkat di /v1/chat/completions. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk

Visi

Membaca gambar, parsing dokumen, dan menjawab pertanyaan visual

01

Agent dan tools

Selesaikan penalaran, triase dukungan, panggilan alat, dan tugas bertahap.

02

Pemrograman

Buat, tinjau, atau perbaiki kode langsung di alat kerja Anda.

03

Asisten pengetahuan

Bangun fitur chat, pencarian, dan pengambilan data dengan harga serta kapabilitas yang transparan.

04

Perbandingan langsung

Bandingkan kualitas respons, latensi, dan harga secara berdampingan.

Contoh prompt

Tulis balasan support yang ringkas dan sebutkan asumsi di baliknya.

Review desain API ini dan sebutkan tiga risiko integrasi terbesar.

Ubah changelog panjang menjadi release notes yang bisa dibaca non-developer.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Berapa biaya glm-5v-turbo?

Di TokenLab, glm-5v-turbo dikenakan Masukan $1.20 / Keluaran $4.00 Per 1M Token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

glm-5v-turbo paling cocok untuk apa?

glm-5v-turbo mendukung Mode JSON, Cache Prompt, Penggunaan tool. Anda dapat membukanya langsung di Create.

Bagaimana memanggil API glm-5v-turbo?

Buka glm-5v-turbo di Create untuk mencoba contoh yang siap digunakan untuk /v1/chat/completions.

Endpoint mana yang harus digunakan glm-5v-turbo?

Pakai https://api.tokenlab.sh/v1/chat/completions sebagai default untuk glm-5v-turbo. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Bisakah saya menguji glm-5v-turbo sebelum mengintegrasikannya?

Ya. Buka Console, draft glm-5v-turbo siap pakai. Prompt tersimpan setelah masuk, konteks tetap.

Operasi apa saja yang didukung glm-5v-turbo?

glm-5v-turbo mendukung chat_completion. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Lainnya dari GLM

Model terkait