Alibaba Cloud: qwen3.8-max

Harga, performa, kapabilitas, dan permintaan siap pakai untuk qwen3.8-max.
Bandingkan model
qwen3.8-max
TersediaAlibaba CloudObrolanInput cache 88% lebih hemat
Masukan / Keluaran
$1.76 / $5.29
Konteks
992K
Output maksimal
128K
Modalitas
VisiObrolan
Kapabilitas
Penggunaan toolCache Prompt

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    messagesAsli (Messages API)
    POST/v1/messages
    Format API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "qwen3.8-max",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Default

Per 1M Token
Harga Official
Masukan $1.76 / Keluaran $5.29 / Pembacaan cache $0.2206 / Penulisan cache $2.21
Harga TokenLab
Masukan $1.76 / Keluaran $5.29 / Pembacaan cache $0.2206 / Penulisan cache $2.21
Diskon
-
Harga cache prompt

Pembacaan cache

Harga Official
$0.2206
Harga TokenLab
$0.2206
Diskon
-

Penulisan cache

Harga Official
$2.21
Harga TokenLab
$2.21
Diskon
-

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir

Belum ada data

Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka qwen3.8-max di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba qwen3.8-max dengan pesan singkat di /v1/messages. Tampilkan balasan, latensi, dan biayanya.

Skenario penggunaan

Cocok untuk

Visi

Membaca gambar, parsing dokumen, dan menjawab pertanyaan visual

01

Agent dan tools

Selesaikan penalaran, triase dukungan, panggilan alat, dan tugas bertahap.

02

Pemrograman

Buat, tinjau, atau perbaiki kode langsung di alat kerja Anda.

03

Asisten pengetahuan

Bangun fitur chat, pencarian, dan pengambilan data dengan harga serta kapabilitas yang transparan.

04

Perbandingan langsung

Bandingkan kualitas respons, latensi, dan harga secara berdampingan.

Contoh prompt

Tulis balasan support yang ringkas dan sebutkan asumsi di baliknya.

Review desain API ini dan sebutkan tiga risiko integrasi terbesar.

Ubah changelog panjang menjadi release notes yang bisa dibaca non-developer.

Model ini memiliki harga kondisional. Total token bulanan saja tidak dapat menghasilkan estimasi yang andal; gunakan harga detail untuk spesifikasi permintaan, cache, dan jendela waktu yang berlaku.

FAQ

Berapa biaya qwen3.8-max?

Di TokenLab, qwen3.8-max dikenakan Masukan $1.76 / Keluaran $5.29 Per 1M Token. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

qwen3.8-max paling cocok untuk apa?

qwen3.8-max mendukung Mode JSON, Cache Prompt, Penggunaan tool. Anda dapat membukanya langsung di Create.

Bagaimana memanggil API qwen3.8-max?

Buka qwen3.8-max di Create untuk mencoba contoh yang siap digunakan untuk /v1/messages.

Endpoint mana yang harus digunakan qwen3.8-max?

Pakai https://api.tokenlab.sh/v1/messages sebagai default untuk qwen3.8-max. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Bisakah saya menguji qwen3.8-max sebelum mengintegrasikannya?

Ya. Buka Console, draft qwen3.8-max siap pakai. Prompt tersimpan setelah masuk, konteks tetap.

Operasi apa saja yang didukung qwen3.8-max?

qwen3.8-max mendukung messages. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Lainnya dari Qwen 3 / QwQ

Model terkait