Modelos de Áudio

Modelos de IA para fala, música e processamento de áudio

Áudio · Alibaba Cloud

cosyvoice-v3.5-plus
Disponível
Texto para fala
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$22.06Saída$0.00/1 mi de caracteres
qwen3.5-omni-flash-realtime
Disponível
Uso de ferramentasVisãoPesquisa na web
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$3.97Saída$15.74/1M
qwen3.5-omni-plus-realtime
Disponível
Uso de ferramentasVisãoPesquisa na web
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$11.76Saída$44.12/1M
qwen3-livetranslate-flash
Disponível
Visão
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$1.47Saída$1.47/1M
qwen3.5-livetranslate-flash-realtime
Disponível
Visão
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$5.88Saída$14.71/1M
fun-asr
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00003235/seg
fun-asr-flash-2026-06-15
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00003235/seg
fun-asr-realtime
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00004853/seg
paraformer-8k-v2
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00001177/seg
paraformer-realtime-8k-v2
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.0000353/seg
paraformer-realtime-v2
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.0000353/seg
paraformer-v2
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00001177/seg
qwen3-asr-flash
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00003235/seg
qwen3-asr-flash-filetrans
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00003235/seg
qwen3-asr-flash-realtime
Disponível
Fala para Texto
Preço da TokenLab— Desconto
—
Preço oficial
$0.00004853/seg
qwen3-tts-flash
Disponível
Texto para fala
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$11.76Saída$0.00/1 mi de caracteres
qwen3-tts-flash-realtime
Disponível
Texto para fala
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$14.71Saída$0.00/1 mi de caracteres
sambert-zhiyuan-v1
Disponível
Texto para fala
Preço da TokenLab— Desconto
—
Preço oficial
Entrada$14.71Saída$0.00/1 mi de caracteres

Todas as séries

3 séries

Como escolher o modelo de áudio ideal

O modelo ideal equilibra adequação à tarefa, qualidade, latência e custo.

Sinais de escolha

  • Escolha o modelo ideal para a entrada e saída que você precisa.
  • Compare modelos que utilizam a mesma unidade de preço.
  • Um teste rápido revela diferenças de qualidade e latência que um catálogo não mostra.

FAQ

O que define um bom modelo de áudio?

Um bom modelo atende aos requisitos de tarefa, qualidade, latência e orçamento. Use um conjunto de avaliação para comparar qualidade e confiabilidade.

Posso trocar de modelo depois?

Sim. Mantenha o ID público do modelo e o formato da requisição explícitos para comparar alternativas nas mesmas tarefas.