Modèles audio

Modèles d'IA pour la parole, la musique et le traitement audio

Audio · Alibaba Cloud

cosyvoice-v3.5-plus
Disponible
Texte vers parole
Prix TokenLab— Remise
—
Tarif Official
Entrée$22.06Sortie$0.00/1 M de caractères
qwen3.5-omni-flash-realtime
Disponible
Utilisation d'outilsVisionRecherche web
Prix TokenLab— Remise
—
Tarif Official
Entrée$3.97Sortie$15.74/1M
qwen3.5-omni-plus-realtime
Disponible
Utilisation d'outilsVisionRecherche web
Prix TokenLab— Remise
—
Tarif Official
Entrée$11.76Sortie$44.12/1M
qwen3-livetranslate-flash
Disponible
Vision
Prix TokenLab— Remise
—
Tarif Official
Entrée$1.47Sortie$1.47/1M
qwen3.5-livetranslate-flash-realtime
Disponible
Vision
Prix TokenLab— Remise
—
Tarif Official
Entrée$5.88Sortie$14.71/1M
fun-asr
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00003235/s
fun-asr-flash-2026-06-15
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00003235/s
fun-asr-realtime
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00004853/s
paraformer-8k-v2
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00001177/s
paraformer-realtime-8k-v2
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.0000353/s
paraformer-realtime-v2
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.0000353/s
paraformer-v2
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00001177/s
qwen3-asr-flash
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00003235/s
qwen3-asr-flash-filetrans
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00003235/s
qwen3-asr-flash-realtime
Disponible
Transcription (Speech to Text)
Prix TokenLab— Remise
—
Tarif Official
$0.00004853/s
qwen3-tts-flash
Disponible
Texte vers parole
Prix TokenLab— Remise
—
Tarif Official
Entrée$11.76Sortie$0.00/1 M de caractères
qwen3-tts-flash-realtime
Disponible
Texte vers parole
Prix TokenLab— Remise
—
Tarif Official
Entrée$14.71Sortie$0.00/1 M de caractères
sambert-zhiyuan-v1
Disponible
Texte vers parole
Prix TokenLab— Remise
—
Tarif Official
Entrée$14.71Sortie$0.00/1 M de caractères

Toutes les séries

3 séries

Choisir le bon modèle audio

Le modèle idéal concilie pertinence, qualité, latence et coût.

Signaux de sélection

  • Choisissez le modèle adapté à vos besoins réels d'entrée et de sortie.
  • Comparez les modèles utilisant la même unité de tarification.
  • Un test rapide révèle des écarts de qualité et de latence invisibles dans un catalogue.

FAQ

Quels critères pour un bon modèle audio ?

Un bon choix équilibre vos besoins en qualité, latence et budget. Utilisez un jeu d'évaluation pour comparer fiabilité et résultats.

Puis-je changer de modèle plus tard ?

Oui. Gardez l'ID du modèle public et le format de requête explicites pour comparer les alternatives sur des tâches identiques.