各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1は、中国語の音声合成音声です。解説、アナウンス、読み上げ体験など、同一の音声アイデンティティを共有すべき場面で、一貫した北京語ナレーションを提供するのに役立ちます。
モデルを比較
sambert-zhiyuan-v1
利用可能Alibabaテキスト読み上げ同期
入力 / 出力
$14.71 / $0.00
モダリティ
オーディオ

Sambert Zhiyuan v1 について

Sambert Zhiyuan v1は、AlibabaのSambert音声合成ファミリーにおける特定の名称を持つ音声であり、汎用的な中国語のナレーションを目的としています。Zhiyuanは落ち着いた学術的な女性の声で、英語も読み上げます。このモデルは単語レベルのタイムスタンプとデフォルトの16 kHzサンプリングレートをサポートしています。これは古い固定音声エンジンであり、CosyVoice v3.5 PlusやQwen3-TTS-Flashのようなクローン作成、方言リスト、スタイル制御機能はありません。

得意なこと

  • 一貫した音声を生成するため、繰り返しコンテンツでも同じナレーターのように聞こえます。
  • タイムスタンプをサポートしており、字幕の同期や読み上げ中のテキストのハイライトに役立ちます。
  • 中国語と英語のテキストを読み上げます。
  • 記事やアナウンスなど、落ち着いた解説コンテンツに適しています。

他のモデルを検討すべきケース

  • クローン作成や設計機能のない固定音声であるため、カスタムブランドボイスを表現することはできません。
  • 感情やスタイルを指示制御できない、旧世代のSambertモデルです。
  • デフォルトの16 kHz出力は、新しい合成モデルが提供するよりも低忠実度です。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト読み上げTokenLab エンドポイント
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

Tts Text Number

100万文字あたり
公式価格
入力 $14.71 / 出力 $0.00
Official
入力 $14.71 / 出力 $0.00
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでSambert Zhiyuan v1を開き、プロンプトを編集・送信できます。

sambert-zhiyuan-v1と/v1/audio/speechで音声をテスト。結果とコストを表示します。

ユースケース

  • 記事の読み上げ

    ページ間で声が変わることのない安定した音声で、長文の中国語記事を読み上げます。

  • 字幕付き解説動画

    タイムスタンプを使用して、短い教育動画のナレーションと画面上のテキストを同期させます。

  • アナウンス

    キオスク、アプリ、公共放送スタイルのメッセージ用に、一貫したトーンで繰り返し通知を生成します。

プロンプト例

この通知を、落ち着いた一定のペースで北京語で読み上げてください。

以下の段落をナレーションし、字幕用の単語タイムスタンプを出力してください。

このバイリンガル製品紹介を、中国語を先に、英語を後に読み上げてください。

FAQ

Sambert Zhiyuan v1とは何ですか?

AlibabaのSambertテキスト読み上げファミリーに属する、Zhiyuanという名称の固定女性音声です。Alibabaはこれを、落ち着いた学術的なトーンを持つ汎用的な中国語音声として説明しており、英語のテキストも処理可能です。

タイムスタンプをサポートしていますか?

はい。Alibabaはこの音声に対してタイムスタンプ出力を提供しており、音声再生に合わせて字幕を合わせたり、単語をハイライトしたりできます。これは読書アプリや解説アプリで役立ちます。

音声をカスタマイズできますか?

いいえ。Zhiyuanは固定音声です。クローン作成、音声設計、またはスタイル指示が必要な場合はCosyVoice v3.5 Plusを、HTTP経由で既製の多言語音声が必要な場合はQwen3-TTS-Flashを使用してください。

どのサンプリングレートで出力されますか?

Alibabaのドキュメントによると、デフォルトは16 kHzです。これはアプリやプロンプト用の音声には適していますが、音楽や放送用途には、より新しい合成モデルの方が豊かな音声を提供する可能性があります。

Sambertが依然として良い選択肢となるのはどのような場合ですか?

方言、クローン作成、感情制御を必要とせず、安定した予測可能な中国語のナレーターとタイムスタンプが必要な場合です。ほとんどの新規プロジェクトでは、Qwen3-TTS-Flashの方がより広範な言語をカバーしています。

Sambert Zhiyuan v1 の料金はいくらですか?

TokenLab では Sambert Zhiyuan v1 は 入力 $14.71 / 出力 $0.00 100万文字あたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Sambert Zhiyuan v1 はどのエンドポイントを使うべきですか?

Sambert Zhiyuan v1 のデフォルトは https://api.tokenlab.sh/v1/audio/speech です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Sambert Zhiyuan v1 はどの操作に対応していますか?

Sambert Zhiyuan v1 は テキスト読み上げ に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Sambert Zhiyuan v1 を比較する

ソース

2026/10/02 時点での評価

関連モデル