Modelos de audio

Modelos de IA para voz, música y procesamiento de audio

Audio · Alibaba Cloud

cosyvoice-v3.5-plus
Disponible
Texto a voz
Precio de TokenLab— Descuento
—
Precio Official
Entrada$22.06Salida$0.00/1 M de caracteres
qwen3.5-omni-flash-realtime
Disponible
Uso de herramientasVisiónBúsqueda web
Precio de TokenLab— Descuento
—
Precio Official
Entrada$3.97Salida$15.74/1M
qwen3.5-omni-plus-realtime
Disponible
Uso de herramientasVisiónBúsqueda web
Precio de TokenLab— Descuento
—
Precio Official
Entrada$11.76Salida$44.12/1M
qwen3-livetranslate-flash
Disponible
Visión
Precio de TokenLab— Descuento
—
Precio Official
Entrada$1.47Salida$1.47/1M
qwen3.5-livetranslate-flash-realtime
Disponible
Visión
Precio de TokenLab— Descuento
—
Precio Official
Entrada$5.88Salida$14.71/1M
fun-asr
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00003235/seg
fun-asr-flash-2026-06-15
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00003235/seg
fun-asr-realtime
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00004853/seg
paraformer-8k-v2
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00001177/seg
paraformer-realtime-8k-v2
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.0000353/seg
paraformer-realtime-v2
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.0000353/seg
paraformer-v2
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00001177/seg
qwen3-asr-flash
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00003235/seg
qwen3-asr-flash-filetrans
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00003235/seg
qwen3-asr-flash-realtime
Disponible
Voz a texto
Precio de TokenLab— Descuento
—
Precio Official
$0.00004853/seg
qwen3-tts-flash
Disponible
Texto a voz
Precio de TokenLab— Descuento
—
Precio Official
Entrada$11.76Salida$0.00/1 M de caracteres
qwen3-tts-flash-realtime
Disponible
Texto a voz
Precio de TokenLab— Descuento
—
Precio Official
Entrada$14.71Salida$0.00/1 M de caracteres
sambert-zhiyuan-v1
Disponible
Texto a voz
Precio de TokenLab— Descuento
—
Precio Official
Entrada$14.71Salida$0.00/1 M de caracteres

Todas las series

3 series

Elige el modelo de audio adecuado

El modelo ideal equilibra precisión, calidad, latencia y coste.

Señales de selección

  • Elige el modelo según la entrada y salida que necesites.
  • Compara modelos que usen la misma unidad de precio.
  • Una prueba rápida revela diferencias de calidad y latencia que un catálogo no muestra.

FAQ

¿Qué define a un buen modelo de audio?

Un modelo adecuado cumple con tus requisitos de calidad, velocidad y presupuesto. Usa un conjunto de evaluación para comparar fiabilidad y resultados.

¿Puedo cambiar de modelo más adelante?

Sí. Mantén el ID del modelo público y el formato de solicitud, y compara alternativas en las mismas tareas.