Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Alibaba: Paraformer v2

Paraformer v2 mentranskripsikan audio yang direkam untuk pemrosesan offline. Model ini berguna untuk arsip rapat dan rekaman percakapan yang lebih panjang yang memerlukan transkrip tertulis yang dapat digunakan kembali setelah sesi berakhir.
Bandingkan model
paraformer-v2
TersediaAlibabaUcapan ke TeksSinkron / Asinkron
Harga
Mulai dari $0.000012
Modalitas
Audio

Tentang Paraformer v2

Paraformer v2 adalah model pengenalan ucapan berbasis file dari Alibaba untuk transkrip offline rapat dan percakapan panjang. Model ini dipanggil secara asinkron untuk rekaman hingga 2 GB dan 12 jam. Dibandingkan dengan Paraformer 8K v2, model ini ditujukan untuk audio wideband umum, dan dibandingkan dengan model real-time, model ini mengorbankan kecepatan demi transkrip lengkap dengan diarisasi dan kata kunci (hotwords).

Kelebihan

  • Menangani rekaman yang sangat panjang, hingga 12 jam atau 2 GB per file sesuai dokumentasi Alibaba.
  • Stempel waktu (timestamps) selalu disertakan, jadi tidak diperlukan opsi tambahan untuk mendapatkannya.
  • Diarisasi pembicara memisahkan peserta dalam rapat dan diskusi kelompok.
  • Penyaringan kata sensitif dapat menutupi istilah yang terdaftar dalam teks transkrip.

Kapan harus beralih

  • Hasil tiba setelah pekerjaan selesai; keterangan langsung (live captions) memerlukan Paraformer Realtime v2.
  • Untuk rekaman telepon 8 kHz, varian 8K lebih cocok dengan audionya.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Suara ke teksEndpoint TokenLab
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="paraformer-v2" \
      -F language="en"

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Suara ke teks

per detik
Harga Official
$0.00001176
Official
$0.00001176
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Paraformer v2 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba paraformer-v2 dengan permintaan audio singkat di /v1/audio/transcriptions. Tampilkan hasil dan biayanya.

Skenario penggunaan

  • Arsip rapat

    Proses rekaman rapat yang disimpan menjadi teks yang dapat dicari dengan label pembicara dan stempel waktu.

  • Transkrip kuliah

    Transkripsikan kuliah berdurasi beberapa jam sekaligus, lalu indeks atau ringkas teksnya untuk siswa.

  • Persiapan moderasi konten

    Tutup kata sensitif yang dikonfigurasi dalam transkrip sebelum dibagikan kepada tim yang lebih luas.

Contoh prompt

Transkripsikan rekaman all-hands berdurasi 3 jam ini dengan label pembicara dan stempel waktu.

Transkripsikan audio video kuliah ini dan tutup kata sensitif yang terdaftar.

Transkripsikan rekaman stand-up mingguan ini menggunakan kata kunci untuk nama proyek kami.

FAQ

Apa kegunaan terbaik Paraformer v2?

Transkripsi offline untuk rekaman rapat, wawancara, dan percakapan. Model ini menerima format audio dan video umum pada laju sampel berapa pun dan mengembalikan teks beserta stempel waktunya.

Seberapa besar input yang dapat diterima?

Alibaba mendokumentasikan file hingga 2 GB dan 12 jam untuk model file Paraformer-nya. Pecah file yang lebih panjang menjadi beberapa bagian sebelum Anda mengirimkannya untuk ditranskripsi.

Bisakah saya mematikan stempel waktu?

Tidak. Alibaba menyatakan bahwa stempel waktu diaktifkan secara permanen untuk Paraformer, sehingga setiap transkrip memuatnya dan tidak diperlukan opsi permintaan untuk mendapatkan posisi waktu.

Paraformer v2 atau Fun-ASR?

Keduanya mentranskripsi file dengan diarisasi dan kata kunci. Fun-ASR adalah lini yang lebih baru; Paraformer v2 adalah lini yang sudah mapan. Jalankan sampel audio Anda melalui masing-masing model dan bandingkan kesalahan yang penting bagi Anda.

Berapa biaya Paraformer v2?

Di TokenLab, Paraformer v2 dikenakan $0.00001176 per detik. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Endpoint mana yang harus digunakan Paraformer v2?

Pakai https://api.tokenlab.sh/v1/audio/transcriptions sebagai default untuk Paraformer v2. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Paraformer v2?

Paraformer v2 mendukung Suara ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Paraformer v2

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Paraformer

Model terkait