オーディオとリアルタイム

音声を作成

入力テキストから音声を生成します

POST
/v1/audio/speech

リクエストボディ

応答形式は選択したモデルと stream_format によって異なります。入力が長い場合、HTTP クライアントのタイムアウトを少なくとも 120s に設定してください。

任意フィールド、音声、出力形式、SSE 対応はモデルごとに異なります。送信前に GET /v1/models/{model} を確認してください。未対応のパラメーターは 400 unsupported_parameter を返す場合があります。

modelstringデフォルト: tts-1

TTS モデル ID。現在の候補は GET /v1/models?recommended_for=tts で確認できます。

inputstring必須

音声を生成する対象のテキストです。最大 4096 文字。

voicestring | object

音声セレクター。nova などの組み込み音声、Kore などの Gemini 音声、または互換カスタム音声向けに { "id": "voice-id" } のようなオブジェクトを渡します。

voice_idstring

互換 MiniMax 音声モデルなど、このパラメーターに対応するモデルの音声 ID。

instructionsstring

対応する OpenAI 互換 TTS モデルで使える、任意のスタイルまたは読み上げ指示です。

promptstring

Gemini TTS モデル向けの任意の話し方スタイル prompt です。

language_codestring

Gemini、xAI、互換 TTS ルート向けの任意の言語コードです。例: en-US。

response_formatstring

音声形式。一般的な値は mp3、opus、aac、flac、wav、pcm です。サポート値はモデルファミリーによって異なります。

stream_formatstringデフォルト: audio

TokenLab の配信形式: audio または sse。tts-1 と tts-1-hd は stream_format=sse をサポートしません。

speednumber

対応するモデルファミリーで使える読み上げ速度です(0.25 ~ 4.0)。

temperaturenumber

Gemini 互換 TTS ルートのサンプリング temperature です(0 ~ 2)。

レスポンス

stream_format=audio は音声バイト列を返します。stream_format=sse に対応するモデルは text/event-stream を返すため、応答全体を音声ファイルに保存せず、イベントを解析してください。

リクエスト

curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-hd",
    "voice": "nova",
    "input": "Hello, welcome to TokenLab!"
  }' \
  --output speech.mp3

音声音声サンプル

利用できる音声はモデルによって異なります。以下は例であり、すべての TTS モデルに共通する一覧ではありません。

Voice説明
alloyニュートラルでバランスの取れた音声
ash落ち着いた、抑制の効いた音声
balladメロディックで表現力豊かな音声
coral温かみがあり、親しみやすい音声
echo温かみのある、会話的な音声
fable表現力があり、物語調の音声
nova親しみやすく、明瞭な音声
onyx深みがあり、威厳のある音声
sage賢明で、思慮深い音声
shimmer柔らかく、穏やかな音声
verseダイナミックで汎用性の高い音声

レスポンス例

レスポンス

200 OK
<binary audio data>

重要フィールド

Content-Typestring

HTTP 応答のメディアタイプ。音声形式、または SSE の text/event-stream です。

bodybinary | SSE

audio は音声バイト列、sse はイベントストリームです。Content-Type と要求したモードに応じて解析してください。

MiniMax Speech 2.8 Turbo は、選択した声で原稿をすばやく音声化します。迅速な応答が必要な音声インターフェースやナレーションに適しています。

{
  "model": "speech-2.8-turbo",
  "input": "Welcome to TokenLab.",
  "voice_id": "male-qn-qingse",
  "speed": 1,
  "response_format": "mp3",
  "stream_format": "audio"
}

認証

BearerAuth
AuthorizationBearer <token>

APIキー認証。Dashboard > API > API KeysでAPIキーを作成または管理します。

場所: header

ヘッダー

X-TokenLab-Delivery-Policy?string

リクエストごとの配信ポリシー。APIキーおよびWorkspaceのデフォルト設定を上書きします。自動的にまず TokenLab Verified を試行し、出力、リクエストの受け入れ、または永続的なリソース作成の前に、一度だけ Official に切り替える場合があります。

指定できる値

  • "auto"
  • "verified"
  • "official"

リクエストボディ

application/json

レスポンス

application/json

application/json

application/json

application/json

application/json

application/json