Escolha Auto, TokenLab Verified ou Official para cada solicitação, com preços exibidos antecipadamente.Veja as novidades

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1 é uma voz de síntese de fala chinesa nomeada. É útil para narração consistente em mandarim em explicativos, anúncios e experiências de leitura que devem compartilhar a mesma identidade vocal.
Comparar modelos
sambert-zhiyuan-v1
DisponívelAlibabaTexto para falaSíncrono
Entrada / Saída
$14.71 / $0.00
Modalidades
Áudio

Sobre o Sambert Zhiyuan v1

Sambert Zhiyuan v1 é uma voz nomeada individual na família de síntese de fala Sambert da Alibaba, destinada à narração geral em chinês. Zhiyuan é uma voz feminina calma e erudita que também lê em inglês, e o modelo suporta carimbos de data/hora (timestamps) em nível de palavra e uma taxa de amostragem padrão de 16 kHz. É um mecanismo de voz fixa mais antigo: não possui clonagem, lista de dialetos ou controle de estilo como o CosyVoice v3.5 Plus ou o Qwen3-TTS-Flash.

Pontos fortes

  • Oferece uma voz consistente, para que o conteúdo repetido soe como o mesmo narrador.
  • Suporta carimbos de data/hora, o que ajuda a sincronizar legendas ou destacar o texto conforme ele é lido.
  • Lê textos em chinês e inglês.
  • Adequado para conteúdo calmo e explicativo, como artigos e anúncios.

Quando usar outro modelo

  • É uma voz fixa sem clonagem ou design, portanto, não pode representar uma voz de marca personalizada.
  • É um modelo da geração Sambert mais antiga, sem controle de instrução para emoção ou estilo.
  • A saída padrão de 16 kHz tem fidelidade menor do que a oferecida por modelos de síntese mais recentes.

Primeiros passos

  1. Criar chave de API

    Crie uma chave no Console e use com qualquer modelo da plataforma.

  2. Envie sua primeira requisição

    Copie o exemplo para sua linguagem e execute-o no endpoint.

    Texto para falaEndpoint do TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

Preço

O preço oficial é a base pública do criador do modelo. O preço TokenLab é o que você paga por este modelo na TokenLab.

Tts Text Number

Por milhão de caracteres
Preço oficial
Entrada $14.71 / Saída $0.00
Official
Entrada $14.71 / Saída $0.00
Desconto
—

Uso e atividade

A taxa de sucesso é a proporção de requisições concluídas. A latência é quanto tempo uma resposta completa leva; P95 significa que 95% das requisições terminaram dentro desse tempo.

Uso e disponibilidade

Últimas 24 horas
Requisições
Taxa de sucesso
Latência P95
Total de tokens
Desempenho do modelo
As métricas aparecerão assim que os limites de privacidade e volume de dados forem atingidos.

Os dados baseiam-se em solicitações agregadas de usuários, excluindo verificações de status.

Abrir no Console

Abra Sambert Zhiyuan v1 no Console com um prompt pronto para editar ou enviar.

Ajude-me a testar sambert-zhiyuan-v1 com uma solicitação de áudio em /v1/audio/speech. Exiba o resultado e custo.

Casos de uso

  • Leitura de artigos

    Leia artigos longos em chinês com uma voz estável que permanece a mesma de página para página.

  • Vídeos explicativos com legendas

    Use os carimbos de data/hora para sincronizar o texto na tela com a narração em vídeos educacionais curtos.

  • Anúncios

    Gere avisos repetidos em um tom consistente para quiosques, aplicativos e mensagens de sistema de som público.

Exemplos de prompt

Leia este aviso em mandarim em um ritmo calmo e uniforme.

Narrei o parágrafo a seguir e, em seguida, forneça os carimbos de data/hora das palavras para as legendas.

Leia esta introdução de produto bilíngue, primeiro em chinês e depois em inglês.

FAQ

O que é o Sambert Zhiyuan v1?

Uma voz feminina fixa chamada Zhiyuan da família de conversão de texto em fala Sambert da Alibaba. A Alibaba a descreve como uma voz chinesa de uso geral com um tom calmo e erudito, que também lida com textos em inglês.

Ele suporta carimbos de data/hora?

Sim. A Alibaba lista a saída de carimbos de data/hora para esta voz, o que permite alinhar legendas ou destacar palavras enquanto o áudio é reproduzido. Isso é útil em aplicativos de leitura e explicativos.

Posso personalizar a voz?

Não. Zhiyuan é uma voz fixa. Para clonagem, design de voz ou instruções de estilo, use o CosyVoice v3.5 Plus; para vozes multilíngues prontas via HTTP, use o Qwen3-TTS-Flash.

Qual taxa de amostragem ele produz?

O padrão é 16 kHz, de acordo com a documentação da Alibaba. Isso é adequado para fala em aplicativos e prompts, embora modelos de síntese mais recentes possam oferecer áudio mais rico para uso musical ou de transmissão.

Quando o Sambert ainda é uma boa escolha?

Quando você deseja um narrador chinês estável e previsível com carimbos de data/hora e não precisa de dialetos, clonagem ou controle emocional. Para a maioria dos novos projetos, o Qwen3-TTS-Flash possui uma cobertura de idiomas mais ampla.

Quanto custa o Sambert Zhiyuan v1?

No TokenLab, Sambert Zhiyuan v1 custa Entrada $14.71 / Saída $0.00 Por milhão de caracteres. A tabela de preços acima mostra o detalhamento completo. As tarifas dependem da unidade de cobrança, da especificação e do uso. Compare condições iguais no preço detalhado do modelo; uma única tarifa não determina o custo total.

Qual endpoint o Sambert Zhiyuan v1 deve usar?

Use https://api.tokenlab.sh/v1/audio/speech para Sambert Zhiyuan v1. O exemplo de requisição abaixo mostra o formato de código correspondente.

Quais operações o Sambert Zhiyuan v1 suporta?

Sambert Zhiyuan v1 suporta Texto para fala. Selecione uma operação acima para ver seu endpoint e exemplo de requisição.

Comparar Sambert Zhiyuan v1

Fontes

Revisado em 2 de out. de 2026

Modelos relacionados