Alibaba: Fun-ASR Flash 2026-06-15
fun-asr-flash-2026-06-15- Harga
- Mulai dari $0.000035
- Modalitas
- Audio
Tentang Fun-ASR Flash 2026-06-15
Fun-ASR Flash 2026-06-15 adalah rilis bertanggal dari model pengenalan ucapan Flash milik Alibaba, yang ditampilkan oleh Alibaba sebagai Qwen-Audio-3.0-ASR-Flash. Model ini mentranskripsikan file audio pendek melalui panggilan HTTP sinkron dan menggunakan giliran percakapan sebelumnya sebagai konteks untuk memengaruhi pengenalan. Menyematkan ID bertanggal menjaga pipeline tetap pada satu versi, berbeda dengan alias tanpa tanggal yang mungkin diperbarui.
Kelebihan
- Menerima giliran percakapan sebelumnya bersama dengan audio, sehingga kosakata dari diskusi yang sedang berlangsung mengarahkan pengenalan.
- Alibaba mencantumkan stempel waktu tingkat kata dan batas kalimat dalam respons sinkron yang sama.
- Tanggal dalam ID menyematkan satu rilis, yang menjaga agar pengulangan proses tetap dapat dibandingkan.
Kapan harus beralih
- Klip dibatasi sekitar lima menit, jadi rekaman panjang memerlukan Fun-ASR asinkron atau model filetrans.
- Model ini hanya menangani klip yang sudah selesai; untuk teks langsung atau dikte, Fun-ASR Realtime adalah model streaming-nya.
Memulai
Buat API key
Buat kunci di Console, gunakan untuk semua model di platform.
Kirim permintaan pertama Anda
Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.
Suara ke teksEndpoint TokenLabPOST/v1/audio/transcriptionscurl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \ -H "Authorization: Bearer sk-xxx" \ -F file="@audio.mp3" \ -F operation="stt" \ -F response_format="json" \ -F model="fun-asr-flash-2026-06-15" \ -F language="en"
Penetapan Harga
Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.
Suara ke teks
per detik- Harga Official
- $0.000035
- Official
- $0.000035
- Diskon
- —
| Harga Officialper detik | Officialper detik | Diskon | |
|---|---|---|---|
| Suara ke teks | $0.000035 | $0.000035 | — |
Penggunaan & aktivitas
Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.
Penggunaan & ketersediaan
24 jam terakhir- Permintaan
- Tingkat keberhasilan
- Latensi P95
- Total token
Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.
Buka di Console
Buka Fun-ASR Flash 2026-06-15 di Console dengan prompt siap diedit atau dikirim.
Bantu saya mencoba fun-asr-flash-2026-06-15 dengan permintaan audio singkat di /v1/audio/transcriptions. Tampilkan hasil dan biayanya.
Skenario penggunaan
Catatan suara
Mentranskripsikan catatan dan pesan rekaman pendek dalam satu permintaan, tanpa perlu mengantrekan pekerjaan asinkron.
Dikte medis
Sampaikan dialog sebelumnya sebagai konteks agar nama obat dan istilah klinis lebih mungkin dikenali.
Pipeline pengujian yang disematkan
Jaga versi tetap konstan saat membandingkan perubahan peringkasan hilir terhadap transkrip yang sama.
Contoh prompt
Transkripsikan rekaman klinik berdurasi 3 menit ini; konteks: giliran sebelumnya membahas dosis metformin.
Transkripsikan catatan suara teknisi lapangan tentang kesalahan PLC ini dan kembalikan stempel waktu kata.
Transkripsikan klip panggilan pelanggan singkat ini, menggunakan giliran obrolan sebelumnya sebagai konteks.
FAQ
Apa arti tanggal dalam fun-asr-flash-2026-06-15?
Itu mengidentifikasi rilis tertentu, 15 Juni 2026. Memanggil ID bertanggal menjaga pipeline Anda tetap pada rilis tersebut. Alibaba menyajikannya dengan nama Qwen-Audio-3.0-ASR-Flash.
Berapa lama durasi klip audio yang diperbolehkan?
Alibaba mendokumentasikan batas sekitar lima menit per panggilan, dengan file hingga 2 GB. Untuk rekaman yang lebih panjang, gunakan Fun-ASR atau Qwen3 ASR Flash Filetrans, yang keduanya menerima pekerjaan file asinkron.
Bisakah saya memberikan konteks tentang percakapan tersebut?
Ya. Model ini menggunakan format pesan gaya obrolan, sehingga Anda dapat menyampaikan giliran sebelumnya sebelum audio. Model menggunakannya untuk mendukung kosakata yang sesuai dengan topik, yang membantu dalam istilah spesialis.
Apakah model ini mengembalikan stempel waktu?
Ya. Alibaba menjelaskan stempel waktu tingkat kata dan batas kalimat dalam respons, sehingga Anda dapat menyelaraskan teks ke audio untuk subtitle, tinjauan, atau pencarian tanpa langkah penyelarasan terpisah.
Berapa biaya Fun-ASR Flash 2026-06-15?
Di TokenLab, Fun-ASR Flash 2026-06-15 dikenakan $0.000035 per detik. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.
Endpoint mana yang harus digunakan Fun-ASR Flash 2026-06-15?
Pakai https://api.tokenlab.sh/v1/audio/transcriptions sebagai default untuk Fun-ASR Flash 2026-06-15. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.
Operasi apa saja yang didukung Fun-ASR Flash 2026-06-15?
Fun-ASR Flash 2026-06-15 mendukung Suara ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.
Bandingkan Fun-ASR Flash 2026-06-15
Sumber
- Model Studio: speech-to-text models for real-time and file transcription
- Model Studio: recording file recognition models
Ditinjau 2 Okt 2026