為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Alibaba: Sambert Zhiyuan v1

Sambert Zhiyuan v1 是一款具名的中文語音合成聲音。它適用於在解說、公告與閱讀體驗中保持一致的普通話旁白,並共享相同的聲音識別度。
比較模型
sambert-zhiyuan-v1
可用Alibaba文字轉語音同步
輸入 / 輸出
$14.71 / $0.00
模態
音訊

關於 Sambert Zhiyuan v1

Sambert Zhiyuan v1 是阿里巴巴 Sambert 語音合成系列中一個具名的語音模型,旨在用於通用中文旁白。Zhiyuan 是一個冷靜、具書卷氣的女性聲音,同時支援閱讀英文,且該模型支援字級時間戳記與預設的 16 kHz 取樣率。這是一個較舊的固定語音引擎:它不像 CosyVoice v3.5 Plus 或 Qwen3-TTS-Flash 那樣具備語音複製、方言列表或風格控制功能。

適用場景

  • 提供單一且一致的聲音,確保重複播放的內容聽起來像同一位旁白。
  • 支援時間戳記,有助於同步字幕或在朗讀時高亮顯示文字。
  • 可朗讀中文與英文文字。
  • 適合冷靜、說明性的內容,例如文章與公告。

其他選擇建議

  • 這是一個固定的聲音,不具備複製或設計功能,因此無法代表自訂的品牌語音。
  • 這是一個較舊的 Sambert 世代模型,不支援情緒或風格的指令控制。
  • 預設的 16 kHz 輸出音質低於較新的合成模型。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉語音TokenLab 端點
    POST/v1/audio/speech
    curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "tts",
      "response_format": "mp3",
      "speed": 1,
      "model": "sambert-zhiyuan-v1",
      "input": "Hello from TokenLab.",
      "voice": "alloy"
    }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

Tts Text Number

每百萬字元
Official 定價
輸入 $14.71 / 輸出 $0.00
Official
輸入 $14.71 / 輸出 $0.00
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Sambert Zhiyuan v1,並準備好編輯或發送提示詞。

協助我使用 sambert-zhiyuan-v1 透過 /v1/audio/speech 進行音訊請求,並顯示結果與成本。

應用情境

  • 文章朗讀

    以穩定的語調朗讀長篇中文文章,確保頁面間的聲音保持一致。

  • 帶字幕的解說影片

    利用時間戳記將螢幕文字與短篇教育影片的旁白進行同步。

  • 公告通知

    為資訊站、應用程式及公共廣播類訊息生成語氣一致的重複性通知。

提示詞範例

用冷靜、平穩的語速以普通話朗讀此通知。

朗讀以下段落,並提供用於字幕的字級時間戳記。

朗讀這段雙語產品介紹,先讀中文,後讀英文。

FAQ

什麼是 Sambert Zhiyuan v1?

這是阿里巴巴 Sambert 文字轉語音系列中一個固定的女性聲音,名為 Zhiyuan。阿里巴巴將其描述為一種冷靜、具書卷氣的通用中文語音,同時也能處理英文文字。

它支援時間戳記嗎?

支援。阿里巴巴列出了該語音的時間戳記輸出功能,讓您能在音訊播放時對齊字幕或高亮顯示文字。這在閱讀與解說類應用中非常實用。

我可以自訂語音嗎?

不能。Zhiyuan 是一個固定的聲音。若需語音複製、語音設計或風格指令,請使用 CosyVoice v3.5 Plus;若需透過 HTTP 使用現成的多語言語音,請使用 Qwen3-TTS-Flash。

它的輸出取樣率是多少?

根據阿里巴巴的文件,預設為 16 kHz。這適用於應用程式與提示語音,但較新的合成模型可能為音樂類或廣播用途提供更豐富的音質。

Sambert 在什麼情況下仍是好選擇?

當您需要穩定、可預測的中文旁白與時間戳記,且不需要方言、語音複製或情緒控制時。對於大多數新專案,Qwen3-TTS-Flash 具備更廣泛的語言覆蓋範圍。

Sambert Zhiyuan v1 的費用是多少?

在 TokenLab 上,Sambert Zhiyuan v1 價格為 輸入 $14.71 / 輸出 $0.00 每百萬字元。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Sambert Zhiyuan v1 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/audio/speech 進行 Sambert Zhiyuan v1 的呼叫。下方的請求範例展示了對應的程式碼格式。

Sambert Zhiyuan v1 支援哪些操作?

Sambert Zhiyuan v1 支援 文字轉語音。請在上方選擇一項操作以查看其端點與請求範例。

比較 Sambert Zhiyuan v1

來源

更新於 2026年10月2日

相關模型