Alibaba Cloud: qwen-doc-turbo

Harga, performa, kapabilitas, dan permintaan siap pakai untuk qwen-doc-turbo.
Bandingkan model
qwen-doc-turbo
TersediaAlibaba CloudObrolanInput cache 80% lebih hemat
Masukan / Keluaran
$0.0882 / $0.1471
Konteks
254K
Output maksimal
8K
Modalitas
Obrolan
Kapabilitas
Cache Prompt

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    chat_completionKompatibel OpenAI
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "qwen-doc-turbo",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Default

Per 1M Token
Harga Official
Masukan $0.0882 / Keluaran $0.1471 / Pembacaan cache $0.0176 / Penulisan cache $0.1103 / Teks Masukan $0.0882 / Teks Keluaran $0.1471
Harga TokenLab
Masukan $0.0882 / Keluaran $0.1471 / Pembacaan cache $0.0176 / Penulisan cache $0.1103 / Teks Masukan $0.0882 / Teks Keluaran $0.1471
Diskon
-
Harga cache prompt

Pembacaan cache

Harga Official
$0.0176
Harga TokenLab
$0.0176
Diskon
-

Penulisan cache

Harga Official
$0.1103
Harga TokenLab
$0.1103
Diskon
-

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir

Belum ada data

Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka qwen-doc-turbo di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba qwen-doc-turbo dengan pesan singkat di /v1/chat/completions. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

01

Agent dan tools

Selesaikan penalaran, triase dukungan, panggilan alat, dan tugas bertahap.

02

Pemrograman

Buat, tinjau, atau perbaiki kode langsung di alat kerja Anda.

03

Asisten pengetahuan

Bangun fitur chat, pencarian, dan pengambilan data dengan harga serta kapabilitas yang transparan.

04

Perbandingan langsung

Bandingkan kualitas respons, latensi, dan harga secara berdampingan.

Contoh prompt

Tulis balasan support yang ringkas dan sebutkan asumsi di baliknya.

Review desain API ini dan sebutkan tiga risiko integrasi terbesar.

Ubah changelog panjang menjadi release notes yang bisa dibaca non-developer.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Berapa biaya qwen-doc-turbo?

Di TokenLab, qwen-doc-turbo dikenakan Masukan $0.0882 / Keluaran $0.1471 Per 1M Token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

qwen-doc-turbo paling cocok untuk apa?

qwen-doc-turbo mendukung Cache Prompt. Anda dapat membukanya langsung di Create.

Bagaimana memanggil API qwen-doc-turbo?

Buka qwen-doc-turbo di Create untuk mencoba contoh yang siap digunakan untuk /v1/chat/completions.

Endpoint mana yang harus digunakan qwen-doc-turbo?

Pakai https://api.tokenlab.sh/v1/chat/completions sebagai default untuk qwen-doc-turbo. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Bisakah saya menguji qwen-doc-turbo sebelum mengintegrasikannya?

Ya. Buka Console, draft qwen-doc-turbo siap pakai. Prompt tersimpan setelah masuk, konteks tetap.

Operasi apa saja yang didukung qwen-doc-turbo?

qwen-doc-turbo mendukung chat_completion. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Lainnya dari Qwen

Model terkait