Choisissez Auto, TokenLab Verified ou Official pour chaque demande, avec les prix affichés à l'avance.Voir les nouveautés

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1 est une voix de synthèse vocale chinoise nommée. Elle est utile pour une narration cohérente en mandarin à travers des explicatifs, des annonces et des expériences de lecture qui doivent partager la même identité vocale.
Comparer les modèles
sambert-zhiyuan-v1
DisponibleAlibabaTexte vers paroleSynchrone
Entrée / Sortie
$14.71 / $0.00
Modalités
Audio

À propos de Sambert Zhiyuan v1

Sambert Zhiyuan v1 est une voix nommée unique au sein de la famille de synthèse vocale Sambert d'Alibaba, destinée à la narration générale en chinois. Zhiyuan est une voix féminine calme et érudite qui lit également l'anglais, et le modèle prend en charge les horodatages au niveau du mot ainsi qu'un taux d'échantillonnage par défaut de 16 kHz. Il s'agit d'un moteur à voix fixe plus ancien : il ne propose ni clonage, ni liste de dialectes, ni contrôle de style comme CosyVoice v3.5 Plus ou Qwen3-TTS-Flash.

Points forts

  • Offre une voix cohérente, de sorte que le contenu répété ressemble au même narrateur.
  • Prend en charge les horodatages, ce qui aide à synchroniser les sous-titres ou à mettre en surbrillance le texte au fur et à mesure de sa lecture.
  • Lit le texte en chinois et en anglais.
  • Convient aux contenus calmes et explicatifs tels que les articles et les annonces.

Quand préférer un autre modèle

  • Il s'agit d'une voix fixe sans clonage ni conception, elle ne peut donc pas représenter une voix de marque personnalisée.
  • Il s'agit d'un modèle de génération Sambert plus ancien sans contrôle d'instruction pour l'émotion ou le style.
  • La sortie par défaut à 16 kHz est d'une fidélité inférieure à celle offerte par les modèles de synthèse plus récents.

Pour commencer

  1. Créer une clé API

    Générez une clé dans Console et utilisez-la avec tous les modèles de la plateforme.

  2. Envoyez votre première requête

    Copiez l'exemple pour votre langage et lancez-le.

    Texte vers paroleEndpoint TokenLab
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

Tarification

Le tarif officiel est la référence publique du créateur du modèle. Le tarif TokenLab est ce que vous payez pour ce modèle sur TokenLab.

Tts Text Number

Par million de caractères
Tarif Official
Entrée $14.71 / Sortie $0.00
Official
Entrée $14.71 / Sortie $0.00
Remise
—

Utilisation et activité

Le taux de réussite est la part de requêtes abouties. La latence est la durée d'une réponse complète ; P95 signifie que 95 % des requêtes ont fini dans ce délai.

Utilisation et disponibilité

Dernières 24 heures
Requêtes
Taux de succès
Latence P95
Total des jetons
Performance du modèle
Les métriques s'affichent une fois les seuils de confidentialité et de volume de données atteints.

Les données sont basées sur les requêtes agrégées des utilisateurs, à l'exclusion des vérifications de statut.

Ouvrir dans Console

Ouvrez Sambert Zhiyuan v1 dans Console avec un prompt prêt à modifier ou envoyer.

Aide-moi à tester sambert-zhiyuan-v1 avec une requête audio sur /v1/audio/speech. Affiche le résultat et le coût.

Cas d'usage

  • Lecture d'articles

    Lisez des articles longs en chinois avec une voix stable qui reste la même d'une page à l'autre.

  • Vidéos explicatives sous-titrées

    Utilisez les horodatages pour synchroniser le texte à l'écran avec la narration dans de courtes vidéos éducatives.

  • Annonces

    Générez des avis répétés sur un ton cohérent pour des bornes, des applications et des messages de type sonorisation publique.

Exemples de prompts

Lisez cet avis en mandarin sur un rythme calme et régulier.

Narrez le paragraphe suivant, puis donnez-moi les horodatages des mots pour les sous-titres.

Lisez cette présentation de produit bilingue, en chinois d'abord puis en anglais.

FAQ

Qu'est-ce que Sambert Zhiyuan v1 ?

Une voix féminine fixe nommée Zhiyuan issue de la famille de synthèse vocale Sambert d'Alibaba. Alibaba la décrit comme une voix chinoise polyvalente avec un ton calme et érudit, qui gère également le texte en anglais.

Prend-il en charge les horodatages ?

Oui. Alibaba répertorie la sortie d'horodatage pour cette voix, ce qui vous permet d'aligner les sous-titres ou de mettre en surbrillance les mots pendant la lecture audio. Ceci est utile dans les applications de lecture et d'explication.

Puis-je personnaliser la voix ?

Non. Zhiyuan est une voix fixe. Pour le clonage, la conception de voix ou les instructions de style, utilisez CosyVoice v3.5 Plus ; pour des voix multilingues prêtes à l'emploi via HTTP, utilisez Qwen3-TTS-Flash.

Quel taux d'échantillonnage produit-il ?

La valeur par défaut est de 16 kHz, selon la documentation d'Alibaba. Cela convient à la parole pour les applications et les invites, bien que les modèles de synthèse plus récents puissent offrir un son plus riche pour une utilisation musicale ou de diffusion.

Quand Sambert reste-t-il un bon choix ?

Lorsque vous souhaitez un narrateur chinois stable et prévisible avec des horodatages, et que vous n'avez pas besoin de dialectes, de clonage ou de contrôle émotionnel. Pour la plupart des nouveaux projets, Qwen3-TTS-Flash offre une couverture linguistique plus large.

Combien coûte Sambert Zhiyuan v1 ?

Sur TokenLab, Sambert Zhiyuan v1 coûte Entrée $14.71 / Sortie $0.00 Par million de caractères. La table tarifaire ci-dessus en montre le détail complet. Les tarifs dépendent de l’unité de facturation, de la spécification et de l’usage. Comparez des conditions identiques dans la tarification détaillée du modèle ; un tarif seul ne détermine pas le coût total.

Quel endpoint Sambert Zhiyuan v1 doit-il utiliser ?

Utilisez https://api.tokenlab.sh/v1/audio/speech pour Sambert Zhiyuan v1. L'exemple de requête ci-dessous montre la structure de code correspondante.

Quelles opérations Sambert Zhiyuan v1 prend-il en charge ?

Sambert Zhiyuan v1 prend en charge Texte vers parole. Sélectionnez une opération pour voir l'endpoint et un exemple.

Comparer Sambert Zhiyuan v1

Sources

Mis à jour le 2 oct. 2026

Modèles associés