音訊與即時
建立語音
根據輸入文字產生音訊
請求本文
回傳方式取決於所選模型和 stream_format。輸入較長時,請將 HTTP 用戶端逾時設為至少 120s。
可選欄位、音色、輸出格式及 SSE 支援均以所選模型為準。傳送前請查詢 GET /v1/models/{model};不支援的參數可能回傳 400 unsupported_parameter。
tts-1TTS 模型 ID。透過 GET /v1/models?recommended_for=tts 取得目前可選模型。
要用來產生音訊的文字。最多 4096 個字元。
語音選擇器。可傳入 nova 等內建語音、Kore 等 Gemini 語音,或為相容的自訂語音傳入 { "id": "voice-id" }。
適用於支援此參數的模型,例如相容的 MiniMax 語音模型。
支援此欄位的 OpenAI 相容 TTS 模型可使用的風格或朗讀指令。
Gemini TTS 的可選朗讀風格 prompt。
可選語言代碼,例如 en-US,適用於 Gemini、xAI 和相容 TTS 路由。
音訊格式。常見值包括 mp3、opus、aac、flac、wav、pcm;具體支援值依模型家族而定。
audioTokenLab 交付格式:audio 或 sse。tts-1 和 tts-1-hd 不支援 stream_format=sse。
支援此欄位的模型家族可設定語速(0.25 到 4.0)。
Gemini 相容 TTS 路由的採樣溫度(0 到 2)。
回應
stream_format=audio 回傳音訊位元組;支援 stream_format=sse 的模型回傳 text/event-stream,應解析其中的事件,不要將整個回應直接儲存為音訊檔案。
請求
curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"voice": "nova",
"input": "Hello, welcome to TokenLab!"
}' \
--output speech.mp3語音範例
可用音色以模型為準;下列名稱僅為範例,並非所有 TTS 模型共用的音色清單。
| 語音 | 描述 |
|---|---|
alloy | 中性、均衡 |
ash | 平靜、沉穩 |
ballad | 富有旋律感、表現力強 |
coral | 溫暖、親切 |
echo | 溫暖、適合對話 |
fable | 表現力強、敘事感佳 |
nova | 友善、清晰 |
onyx | 低沉、具權威感 |
sage | 睿智、深思熟慮 |
shimmer | 柔和、溫柔 |
verse | 動態感強、用途多元 |
回應
<binary audio data>重要欄位
HTTP 回應的媒體類型:音訊格式,或 SSE 使用的 text/event-stream。
audio 模式為音訊位元組,sse 模式為事件串流。請依 Content-Type 與請求模式選擇解析方式。
MiniMax Speech 2.8 Turbo 可用指定聲音快速合成文字腳本,適用於需要即時回應的語音介面和旁白。
{
"model": "speech-2.8-turbo",
"input": "Welcome to TokenLab.",
"voice_id": "male-qn-qingse",
"speed": 1,
"response_format": "mp3",
"stream_format": "audio"
}授權
BearerAuth API Key 驗證。請在 Dashboard > API > API Keys 建立或管理 API 金鑰。
位置: header
請求標頭
單次請求傳遞策略。會覆寫 API key 與 Workspace 的預設值。系統會自動優先嘗試 TokenLab Verified,並可能在輸出、請求接受或建立持久性資源前切換至 Official 模式一次。
可選值
- "auto"
- "verified"
- "official"
請求主體
application/json
回應
application/json
application/json
application/json
application/json
application/json
application/json