Elija Auto, TokenLab Verified o Official para cada solicitud, con los precios mostrados por adelantado.Ver las novedades

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1 es una voz de síntesis de voz china con nombre propio. Es útil para una narración en mandarín consistente en explicadores, anuncios y experiencias de lectura que deben compartir la misma identidad vocal.
Comparar modelos
sambert-zhiyuan-v1
DisponibleAlibabaTexto a vozSíncrono
Entrada / Salida
$14.71 / $0.00
Modalidades
Audio

Sobre Sambert Zhiyuan v1

Sambert Zhiyuan v1 es una voz individual dentro de la familia de síntesis de voz Sambert de Alibaba, destinada a la narración general en chino. Zhiyuan es una voz femenina tranquila y académica que también lee en inglés, y el modelo admite marcas de tiempo a nivel de palabra y una frecuencia de muestreo predeterminada de 16 kHz. Es un motor de voz fija más antiguo: no cuenta con clonación, lista de dialectos ni control de estilo como CosyVoice v3.5 Plus o Qwen3-TTS-Flash.

Puntos fuertes

  • Ofrece una voz consistente, por lo que el contenido repetido suena como si fuera el mismo narrador.
  • Admite marcas de tiempo, lo que ayuda a sincronizar subtítulos o resaltar texto a medida que se lee.
  • Lee texto en chino e inglés.
  • Se adapta a contenido tranquilo y explicativo, como artículos y anuncios.

Cuándo buscar otra opción

  • Es una voz fija sin clonación ni diseño, por lo que no puede representar una voz de marca personalizada.
  • Es un modelo de la generación Sambert anterior sin control de instrucciones para emociones o estilos.
  • La salida predeterminada de 16 kHz tiene una fidelidad menor que la que ofrecen los modelos de síntesis más recientes.

Primeros pasos

  1. Crear clave API

    Genera una clave en Console y úsala con cualquier modelo de la plataforma.

  2. Envía tu primera solicitud

    Copia el ejemplo para tu lenguaje y ejecútalo contra el endpoint.

    Texto a vozEndpoint de TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

Precios

El precio oficial es la línea base pública del creador del modelo. El precio de TokenLab es lo que pagas por este modelo en TokenLab.

Tts Text Number

Por millón de caracteres
Precio Official
Entrada $14.71 / Salida $0.00
Official
Entrada $14.71 / Salida $0.00
Descuento
—

Uso y actividad

La tasa de éxito es la proporción de solicitudes completadas. La latencia es cuánto tarda una respuesta completa; P95 significa que el 95 % de las solicitudes terminaron dentro de ese tiempo.

Uso y disponibilidad

Últimas 24 horas
Solicitudes
Tasa de éxito
Latencia P95
Total de tokens
Desempeño del modelo
Las métricas aparecerán una vez que se alcancen los umbrales de privacidad y volumen de datos.

Los datos se basan en solicitudes de usuario agregadas, excluyendo las comprobaciones de estado.

Abrir en Console

Abre Sambert Zhiyuan v1 en Console con un prompt listo para editar o enviar.

Ayúdame a probar sambert-zhiyuan-v1 con una solicitud de audio breve en /v1/audio/speech. Muestra el resultado y el coste.

Casos de uso

  • Lectura de artículos

    Lea artículos largos en chino con una voz estable que se mantiene igual de una página a otra.

  • Videos explicativos con subtítulos

    Utilice las marcas de tiempo para sincronizar el texto en pantalla con la narración en videos educativos cortos.

  • Anuncios

    Genere avisos repetidos con un tono consistente para quioscos, aplicaciones y mensajes de megafonía pública.

Ejemplos de prompts

Lea este aviso en mandarín con un ritmo tranquilo y uniforme.

Narren el siguiente párrafo y luego proporcióneme las marcas de tiempo de las palabras para los subtítulos.

Lea esta introducción de producto bilingüe, primero en chino y luego en inglés.

FAQ

¿Qué es Sambert Zhiyuan v1?

Una voz femenina fija llamada Zhiyuan de la familia de texto a voz Sambert de Alibaba. Alibaba la describe como una voz en chino de propósito general con un tono tranquilo y académico, que también maneja texto en inglés.

¿Admite marcas de tiempo?

Sí. Alibaba incluye la salida de marcas de tiempo para esta voz, lo que le permite alinear subtítulos o resaltar palabras mientras se reproduce el audio. Esto es útil en aplicaciones de lectura y videos explicativos.

¿Puedo personalizar la voz?

No. Zhiyuan es una voz fija. Para clonación, diseño de voz o instrucciones de estilo, utilice CosyVoice v3.5 Plus; para voces multilingües listas para usar a través de HTTP, utilice Qwen3-TTS-Flash.

¿Qué frecuencia de muestreo emite?

El valor predeterminado es 16 kHz, según la documentación de Alibaba. Esto es adecuado para voz en aplicaciones y prompts, aunque los modelos de síntesis más nuevos pueden ofrecer un audio más rico para usos similares a la música o transmisiones.

¿Cuándo sigue siendo Sambert una buena opción?

Cuando desea un narrador en chino estable y predecible con marcas de tiempo, y no necesita dialectos, clonación o control emocional. Para la mayoría de los proyectos nuevos, Qwen3-TTS-Flash tiene una cobertura de idiomas más amplia.

¿Cuánto cuesta Sambert Zhiyuan v1?

En TokenLab, Sambert Zhiyuan v1 cuesta Entrada $14.71 / Salida $0.00 Por millón de caracteres. La tabla de precios arriba muestra el desglose completo. Las tarifas dependen de la unidad de facturación, la especificación y el uso. Compare condiciones iguales en el precio detallado del modelo; una sola tarifa no determina el coste total.

¿Qué endpoint debe usar Sambert Zhiyuan v1?

Utiliza https://api.tokenlab.sh/v1/audio/speech para Sambert Zhiyuan v1. El ejemplo de solicitud a continuación muestra la estructura de código correspondiente.

¿Qué operaciones soporta Sambert Zhiyuan v1?

Sambert Zhiyuan v1 admite Texto a voz. Selecciona una operación arriba para ver su endpoint y ejemplo de solicitud.

Comparar Sambert Zhiyuan v1

Fuentes

Revisado el 2 oct 2026

Modelos relacionados