Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Alibaba: Qwen3-TTS 1.7B CustomVoice

Qwen3-TTS 1.7B CustomVoice adalah model text-to-speech dari Alibaba yang menawarkan sembilan timbre preset premium di berbagai kombinasi gender, usia, bahasa, dan dialek. Model ini memberikan kontrol gaya yang presisi atas suara target melalui instruksi pengguna, mendukung kloning suara dari sampel 3 detik, dan menghasilkan ucapan dalam 10+ bahasa dengan latensi serendah 97ms.
Bandingkan model
qwen3-tts-1-7b-customvoice
TersediaAlibabaTeks ke suaraSinkronkan
Harga
Mulai dari $0.000015
Modalitas
Audio

Tentang Qwen3-TTS 1.7B CustomVoice

Qwen3-TTS 1.7B CustomVoice adalah model text-to-speech dari Alibaba yang dibangun dengan sembilan suara prasetel tetap. Anda memilih penutur berdasarkan nama dan dapat menambahkan instruksi bahasa alami mengenai nada, emosi, atau gaya bicara. Model ini berbicara dalam sepuluh bahasa, termasuk bahasa Mandarin, Inggris, Jepang, Korea, dan beberapa bahasa Eropa, dengan latensi sintesis end-to-end yang diklaim Alibaba serendah 97 ms untuk penggunaan interaktif.

Kelebihan

  • Sembilan penutur premium yang diberi nama mencakup berbagai gender, usia, bahasa, dan dialek, sehingga suara dapat tetap konsisten di seluruh produk.
  • Instruksi tertulis dapat mengarahkan emosi dan cara bicara tanpa mengubah penutur yang dipilih.
  • Sepuluh bahasa didukung: Mandarin, Inggris, Jepang, Korea, Jerman, Prancis, Rusia, Portugis, Spanyol, dan Italia.
  • Alibaba melaporkan latensi end-to-end serendah 97 ms, yang cocok untuk asisten suara dan narasi langsung.

Kapan harus beralih

  • Daftar suara bersifat tetap; untuk menciptakan suara baru dari deskripsi, varian VoiceDesign adalah pilihan yang lebih tepat.
  • Hasil terbaik diperoleh saat penutur membaca dalam bahasa aslinya, sehingga prasetel bahasa Inggris yang membaca bahasa Jepang mungkin terdengar beraksen.
  • Teks input yang bising atau tidak biasa, seperti markup yang berat atau simbol campuran, dapat mengurangi kualitas output.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Teks ke suaraEndpoint TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "model": "qwen3-tts-1-7b-customvoice",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Teks ke suara

Per 1 juta karakter
Harga Official
$0.000015
Official
$0.000015
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Qwen3-TTS 1.7B CustomVoice di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba qwen3-tts-1-7b-customvoice dengan permintaan audio singkat di /v1/audio/speech. Tampilkan hasil dan biayanya.

Skenario penggunaan

  • Asisten suara

    Berikan asisten dalam aplikasi satu suara bernama yang stabil dan penundaan respons yang rendah agar balasan mulai diputar dengan cepat setelah teks siap.

  • Narasi buku audio dan artikel

    Baca teks panjang dengan penutur pilihan dan tambahkan instruksi seperti tenang dan hangat untuk menjaga penyampaian tetap konsisten di seluruh bab.

  • Video produk yang dilokalisasi

    Gunakan prasetel bahasa Jepang, Korea, atau Inggris untuk menyuarakan naskah yang sama per pasar sementara merek tetap memiliki suara yang dapat dikenali.

  • Dialog game dan karakter

    Pilih prasetel yang berbeda untuk karakter yang berbeda dan tambahkan instruksi emosi untuk dialog yang marah, lelah, atau bersemangat.

Contoh prompt

Penutur: Ryan. Instruksi: tenang, ramah, sedikit lambat. Teks: Welcome back. Your order has shipped and should arrive on Thursday.

Penutur: Ono_Anna. Instruksi: penyiar ceria. Teks: 本日はご来店いただき、ありがとうございます。

Penutur: Vivian. Instruksi: berbisik, seolah menceritakan rahasia. Teks: 你听说了吗?明天会有一个大消息。

FAQ

Suara apa saja yang ditawarkan Qwen3-TTS CustomVoice?

Sembilan prasetel: Vivian, Serena, Uncle_Fu, Dylan, dan Eric untuk varian bahasa Mandarin, Ryan dan Aiden untuk bahasa Inggris, Ono_Anna untuk bahasa Jepang, dan Sohee untuk bahasa Korea. Anda memilih satu berdasarkan nama untuk setiap permintaan.

Bisakah saya mengontrol emosi dan gaya bicara?

Ya. Anda dapat menambahkan instruksi bahasa alami, misalnya marah, lembut, atau cepat dan bersemangat, dan model akan menyesuaikan nada dan cara bicara sambil tetap mempertahankan timbre penutur yang dipilih.

Apa perbedaan CustomVoice dengan VoiceDesign?

CustomVoice menggunakan sembilan penutur tetap yang Anda pilih. VoiceDesign tidak memiliki daftar prasetel; Anda mendeskripsikan suara yang diinginkan dengan kata-kata, seperti usia, suasana hati, dan prosodi, lalu model akan menciptakannya. Pilih CustomVoice untuk konsistensi dan VoiceDesign untuk suara baru.

Bahasa apa saja yang bisa diucapkan?

Sepuluh: Mandarin, Inggris, Jepang, Korea, Jerman, Prancis, Rusia, Portugis, Spanyol, dan Italia. Kartu model menyarankan penggunaan setiap penutur dalam bahasa aslinya untuk kualitas terbaik.

Apakah cukup cepat untuk percakapan langsung?

Alibaba menyatakan latensi sintesis end-to-end serendah 97 ms, yang ditujukan untuk penggunaan real-time. Penundaan aktual dalam aplikasi Anda juga bergantung pada jarak jaringan dan panjang teks, jadi ukurlah dengan trafik Anda sendiri.

Berapa biaya Qwen3-TTS 1.7B CustomVoice?

Di TokenLab, Qwen3-TTS 1.7B CustomVoice dikenakan - . Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Endpoint mana yang harus digunakan Qwen3-TTS 1.7B CustomVoice?

Pakai https://api.tokenlab.sh/v1/audio/speech sebagai default untuk Qwen3-TTS 1.7B CustomVoice. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Qwen3-TTS 1.7B CustomVoice?

Qwen3-TTS 1.7B CustomVoice mendukung Teks ke suara. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Qwen3-TTS 1.7B CustomVoice

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Qwen TTS

Model terkait