Pilih Auto, TokenLab Verified, atau Official untuk setiap permintaan, dengan harga yang ditampilkan di awal.Lihat yang baru

Alibaba: Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15 adalah rilis pengenalan ucapan bertanggal untuk transkripsi file audio. Menyematkan versi ini berguna ketika alur kerja transkripsi memerlukan pilihan model yang konsisten di seluruh proses yang dijalankan berulang kali.
Bandingkan model
fun-asr-flash-2026-06-15
TersediaAlibabaUcapan ke TeksSinkronkan
Harga
Mulai dari $0.000035
Modalitas
Audio

Tentang Fun-ASR Flash 2026-06-15

Fun-ASR Flash 2026-06-15 adalah rilis bertanggal dari model pengenalan ucapan Flash milik Alibaba, yang ditampilkan oleh Alibaba sebagai Qwen-Audio-3.0-ASR-Flash. Model ini mentranskripsikan file audio pendek melalui panggilan HTTP sinkron dan menggunakan giliran percakapan sebelumnya sebagai konteks untuk memengaruhi pengenalan. Menyematkan ID bertanggal menjaga pipeline tetap pada satu versi, berbeda dengan alias tanpa tanggal yang mungkin diperbarui.

Kelebihan

  • Menerima giliran percakapan sebelumnya bersama dengan audio, sehingga kosakata dari diskusi yang sedang berlangsung mengarahkan pengenalan.
  • Alibaba mencantumkan stempel waktu tingkat kata dan batas kalimat dalam respons sinkron yang sama.
  • Tanggal dalam ID menyematkan satu rilis, yang menjaga agar pengulangan proses tetap dapat dibandingkan.

Kapan harus beralih

  • Klip dibatasi sekitar lima menit, jadi rekaman panjang memerlukan Fun-ASR asinkron atau model filetrans.
  • Model ini hanya menangani klip yang sudah selesai; untuk teks langsung atau dikte, Fun-ASR Realtime adalah model streaming-nya.

Memulai

  1. Buat API key

    Buat kunci di Console, gunakan untuk semua model di platform.

  2. Kirim permintaan pertama Anda

    Salin contoh untuk bahasa Anda dan jalankan terhadap endpoint tersebut.

    Suara ke teksEndpoint TokenLab
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr-flash-2026-06-15" \
      -F language="en"

Penetapan Harga

Harga Official adalah baseline publik pembuat model. Harga TokenLab adalah yang Anda bayar untuk model ini di TokenLab.

Suara ke teks

per detik
Harga Official
$0.000035
Official
$0.000035
Diskon
—

Penggunaan & aktivitas

Tingkat keberhasilan adalah proporsi permintaan yang selesai. Latensi adalah berapa lama respons penuh berlangsung; P95 berarti 95% permintaan selesai dalam waktu tersebut.

Penggunaan & ketersediaan

24 jam terakhir
Permintaan
Tingkat keberhasilan
Latensi P95
Total token
Performa model
Metrik akan muncul setelah ambang batas privasi dan volume data terpenuhi.

Data didasarkan pada permintaan pengguna gabungan, tidak termasuk pemeriksaan status.

Buka di Console

Buka Fun-ASR Flash 2026-06-15 di Console dengan prompt siap diedit atau dikirim.

Bantu saya mencoba fun-asr-flash-2026-06-15 dengan permintaan audio singkat di /v1/audio/transcriptions. Tampilkan hasil dan biayanya.

Skenario penggunaan

  • Catatan suara

    Mentranskripsikan catatan dan pesan rekaman pendek dalam satu permintaan, tanpa perlu mengantrekan pekerjaan asinkron.

  • Dikte medis

    Sampaikan dialog sebelumnya sebagai konteks agar nama obat dan istilah klinis lebih mungkin dikenali.

  • Pipeline pengujian yang disematkan

    Jaga versi tetap konstan saat membandingkan perubahan peringkasan hilir terhadap transkrip yang sama.

Contoh prompt

Transkripsikan rekaman klinik berdurasi 3 menit ini; konteks: giliran sebelumnya membahas dosis metformin.

Transkripsikan catatan suara teknisi lapangan tentang kesalahan PLC ini dan kembalikan stempel waktu kata.

Transkripsikan klip panggilan pelanggan singkat ini, menggunakan giliran obrolan sebelumnya sebagai konteks.

FAQ

Apa arti tanggal dalam fun-asr-flash-2026-06-15?

Itu mengidentifikasi rilis tertentu, 15 Juni 2026. Memanggil ID bertanggal menjaga pipeline Anda tetap pada rilis tersebut. Alibaba menyajikannya dengan nama Qwen-Audio-3.0-ASR-Flash.

Berapa lama durasi klip audio yang diperbolehkan?

Alibaba mendokumentasikan batas sekitar lima menit per panggilan, dengan file hingga 2 GB. Untuk rekaman yang lebih panjang, gunakan Fun-ASR atau Qwen3 ASR Flash Filetrans, yang keduanya menerima pekerjaan file asinkron.

Bisakah saya memberikan konteks tentang percakapan tersebut?

Ya. Model ini menggunakan format pesan gaya obrolan, sehingga Anda dapat menyampaikan giliran sebelumnya sebelum audio. Model menggunakannya untuk mendukung kosakata yang sesuai dengan topik, yang membantu dalam istilah spesialis.

Apakah model ini mengembalikan stempel waktu?

Ya. Alibaba menjelaskan stempel waktu tingkat kata dan batas kalimat dalam respons, sehingga Anda dapat menyelaraskan teks ke audio untuk subtitle, tinjauan, atau pencarian tanpa langkah penyelarasan terpisah.

Berapa biaya Fun-ASR Flash 2026-06-15?

Di TokenLab, Fun-ASR Flash 2026-06-15 dikenakan $0.000035 per detik. Tabel harga di atas menampilkan rincian lengkap. Tarif bergantung pada unit penagihan, spesifikasi, dan penggunaan. Bandingkan kondisi yang sama dalam harga detail model; satu tarif tidak menentukan total biaya.

Endpoint mana yang harus digunakan Fun-ASR Flash 2026-06-15?

Pakai https://api.tokenlab.sh/v1/audio/transcriptions sebagai default untuk Fun-ASR Flash 2026-06-15. Jika format native penyedia didukung, API workbench juga menampilkan endpoint tersebut.

Operasi apa saja yang didukung Fun-ASR Flash 2026-06-15?

Fun-ASR Flash 2026-06-15 mendukung Suara ke teks. Pilih operasi di API workbench di atas untuk melihat endpoint dan contoh kode terkait.

Bandingkan Fun-ASR Flash 2026-06-15

Sumber

Ditinjau 2 Okt 2026

Lainnya dari Fun-ASR

Model terkait