Fiyatları önceden gösterilen Auto, TokenLab Verified veya Official seçeneklerinden her istek için birini seçin.Yenilikleri gör

Alibaba: Fun-ASR

Fun-ASR, kaydedilmiş konuşmaları aranabilir ses arşivleri için metne dönüştürür. Röportajları, sesli notları ve kaydedilmiş konuşmaları incelenebilir, özetlenebilir veya dizine eklenebilir materyallere dönüştürmek için kullanışlıdır.
Modelleri karşılaştır
fun-asr
MevcutAlibabaKonuşmadan MetneSenkron / Asenkron
Fiyat
İtibaren $0.000035
Modlar
Ses

Fun-ASR hakkında

Fun-ASR, Alibaba'nın dosyalar üzerinde eşzamansız (asenkron) olarak çağrılan, kayıtlı seslere yönelik konuşma tanıma modelidir. Fun-ASR serisi içinde, gerçek zamanlı akış modeli ve kısa klipler için olan Flash sürümünün aksine, genel dosya dökümü için tercih edilen seçenektir. Alibaba; bu model için bağlam geliştirme, özel anahtar kelimeler, konuşmacı ayrıştırma (diarization), hassas kelime filtreleme ve cümle veya kelime düzeyinde zaman damgaları özelliklerini listeler; bu da onu toplantı ve röportaj arşivleri için uygun kılar.

Güçlü yönleri

  • Konuşmacı ayrıştırma, toplantı ve röportaj gibi çok kişili kayıtlarda kimin ne söylediğini etiketler.
  • Özel anahtar kelimeler, genel bir kelime dağarcığının gözden kaçırabileceği ürün adları, kişi isimleri ve teknik terimlere yönelik tanıma başarısını artırır.
  • Cümle ve kelime düzeyindeki zaman damgaları, dökümlerin altyazı veya arama işlemleri için ses kaydıyla eşleştirilmesine olanak tanır.
  • Herhangi bir örnekleme hızındaki yaygın ses formatlarını kabul eder, bu nedenle kayıtların önceden yeniden örneklenmesine nadiren ihtiyaç duyulur.

Alternatif aramanız gereken durumlar

  • Tamamlanmış dosyaları eşzamansız olarak işler, bu nedenle canlı altyazı oluşturamaz; bu iş için Fun-ASR Realtime uygundur.
  • Çıktı yalnızca döküm metnidir; özetler, çeviri veya aksiyon maddeleri için ayrı bir dil modeli gerekir.

Başlarken

  1. API anahtarı oluştur

    Console'da bir anahtar oluşturun, platformdaki tüm modellerle kullanın.

  2. İlk isteğinizi gönderin

    Diliniz için olan örneği kopyalayın ve uç noktada çalıştırın.

    Konuşmadan metneTokenLab uç noktası
    POST/v1/audio/transcriptions
    curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
      -H "Authorization: Bearer sk-xxx" \
      -F file="@audio.mp3" \
      -F operation="stt" \
      -F response_format="json" \
      -F model="fun-asr" \
      -F language="en"

Fiyatlandırma

Official fiyat, model yapımcısının açık temel fiyatıdır. TokenLab fiyatı, bu modeli TokenLab'de ödediğiniz tutardır.

Konuşmadan metne

saniye başına
Resmi fiyat
$0.000035
Official
$0.000035
İndirim
—

Kullanım ve etkinlik

Başarı oranı, tamamlanan isteklerin payıdır. Gecikme, tam bir yanıtın ne kadar sürdüğüdür; P95, isteklerin %95’inin bu süre içinde tamamlandığı anlamına gelir.

Kullanım ve kullanılabilirlik

Son 24 saat
İstekler
Başarı oranı
P95 gecikmesi
Toplam token
Model performansı
Metrikler, gizlilik ve veri hacmi eşikleri karşılandığında görünür.

Veriler, durum kontrolleri hariç tutularak toplu kullanıcı isteklerine dayanmaktadır.

Console'da aç

Fun-ASR modelini Console'da açın, istemi düzenlemek veya göndermek için hazır hale getirin.

fun-asr ile /v1/audio/transcriptions üzerinden kısa bir ses isteği dene. Sonucu ve maliyeti göster.

Kullanım senaryoları

  • Toplantı tutanakları

    Kaydedilmiş bir görüşmeyi konuşmacı etiketleriyle döküme dönüştürün, ardından metni tutanak ve aksiyon maddeleri taslağı hazırlaması için bir dil modeline gönderin.

  • Röportaj arşivleri

    Saatlerce süren kayıtlı röportajları, kelime zaman damgaları içeren aranabilir metinlere dönüştürün; böylece bir incelemeci alıntılanan bir bölüme doğrudan atlayabilir.

  • Marka terimi dökümleri

    Kayıtlı web seminerlerinin doğru yazımla çıkması için ürün ve şirket adlarını anahtar kelime olarak ekleyin.

Prompt örnekleri

Bu 90 dakikalık kurul toplantısı kaydını döküme dönüştürün, her konuşmacıyı etiketleyin ve cümle zaman damgalarını koruyun.

Bu müşteri röportajını 'Kubernetes', 'yol haritası' ve '3. çeyrek kaybı' anahtar kelimeleriyle döküme dönüştürün.

Bu podcast bölümünü döküme dönüştürün ve metin çıktısından hassas kelimeleri filtreleyin.

FAQ

Fun-ASR canlı ses için mi yoksa kayıtlı ses için mi?

Kayıtlı ses için. Dosyalar üzerinde eşzamansız olarak çağrılır. Mikrofon girişi veya canlı altyazılar için, ses oturum ilerledikçe işlenen ve insanlar konuşmaya devam ederken metin döndüren Fun-ASR Realtime kullanın.

Fun-ASR konuşmacıları birbirinden ayırabilir mi?

Evet. Alibaba, özellikler listesinde konuşmacı ayrıştırmayı belirtir, bu sayede döküm bir toplantı veya röportajdaki konuşmacıları ayırabilir. Doğruluk, ses kalitesine ve konuşmacıların ne kadar örtüştüğüne bağlıdır.

Fun-ASR zaman damgaları döndürür mü?

Evet. Alibaba, altyazı oluşturmak veya döküm metnini kayıttaki bir konuma bağlamak için kullanabileceğiniz cümle ve kelime düzeyinde zaman damgalarını belgeler.

Fun-ASR ne kadar büyük bir dosyayı işleyebilir?

Alibaba'nın dosya tanıma belgeleri, 2 GB ve 12 saate kadar olan kayıtları destekler. Daha uzun materyaller bölünmelidir. AAC, WAV ve MP3 gibi yaygın formatlar kabul edilir.

Fun-ASR ne kadara mal olur?

TokenLab üzerinde Fun-ASR $0.000035 saniye başına'dır. Tam dökümü yukarıdaki fiyat tablosunda bulabilirsiniz. Ücretler faturalandırma birimine, özelliklere ve kullanıma göre değişir. Modelin ayrıntılı fiyatlandırmasında eşleşen koşulları karşılaştırın; tek bir ücret toplam maliyeti belirlemez.

Fun-ASR hangi endpoint'i kullanmalı?

Fun-ASR için varsayılan olarak https://api.tokenlab.sh/v1/audio/transcriptions kullanın. Sağlayıcıya özgü yerel format destekleniyorsa API workbench bu endpoint'i de gösterir.

Fun-ASR hangi operasyonları destekler?

Fun-ASR Konuşmadan metne destekler. Yukarıdaki API workbench'te bir operasyon seçerek ilgili endpoint ve kod örneğini görebilirsiniz.

Fun-ASR karşılaştırması

Kaynaklar

2 Eki 2026 tarihinde incelendi

Fun-ASR serisinden daha fazlası

İlgili modeller