TokenLab

오디오 및 실시간

음성 생성

입력 텍스트로부터 오디오를 생성합니다

POST
/v1/audio/speech

요청 본문

응답 방식은 선택한 모델과 stream_format에 따라 달라집니다. 입력이 길면 HTTP 클라이언트 제한 시간을 최소 120s로 설정하세요.

선택 필드, 음성, 출력 형식 및 SSE 지원은 모델마다 다릅니다. 전송 전에 GET /v1/models/{model}을 확인하세요. 지원하지 않는 매개변수는 400 unsupported_parameter를 반환할 수 있습니다.

modelstring기본값: tts-1

TTS 모델 ID입니다. GET /v1/models?recommended_for=tts에서 현재 모델을 확인하세요.

inputstring필수

오디오를 생성할 텍스트입니다. 최대 4096자.

voicestring | object

음성 선택자입니다. nova 같은 내장 음성, Kore 같은 Gemini 음성, 또는 호환 커스텀 음성용 { "id": "voice-id" } 객체를 전달합니다.

voice_idstring

호환 MiniMax 음성 모델 등 이 매개변수를 지원하는 모델의 음성 ID입니다.

instructionsstring

지원되는 OpenAI 호환 TTS 모델에 전달하는 선택적 스타일 또는 전달 지시입니다.

promptstring

Gemini TTS 모델의 선택적 말하기 스타일 prompt입니다.

language_codestring

Gemini, xAI 및 호환 TTS route의 선택적 언어 코드입니다. 예: en-US.

response_formatstring

오디오 형식입니다. 일반 값은 mp3, opus, aac, flac, wav, pcm이며, 지원 값은 모델 패밀리별로 다릅니다.

stream_formatstring기본값: audio

TokenLab 전달 형식: audio 또는 sse. tts-1 및 tts-1-hd는 stream_format=sse를 지원하지 않습니다.

speednumber

이를 지원하는 모델 패밀리의 말하기 속도입니다(0.25~4.0).

temperaturenumber

Gemini 호환 TTS route의 샘플링 temperature입니다(0~2).

응답

stream_format=audio는 오디오 바이트를 반환합니다. stream_format=sse를 지원하는 모델은 text/event-stream을 반환하므로 전체 응답을 오디오 파일로 저장하지 말고 이벤트를 파싱하세요.

요청

curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-hd",
    "voice": "nova",
    "input": "Hello, welcome to TokenLab!"
  }' \
  --output speech.mp3

음성 샘플

사용 가능한 음성은 모델마다 다릅니다. 다음 이름은 예시이며 모든 TTS 모델이 공유하는 목록이 아닙니다.

음성설명
alloy중립적이고 균형 잡힘
ash차분하고 절제됨
ballad선율적이고 표현력이 풍부함
coral따뜻하고 친근함
echo따뜻하고 대화체 느낌
fable표현력이 풍부하고 서사적임
nova친근하고 명확함
onyx깊이 있고 권위적임
sage현명하고 사려 깊음
shimmer부드럽고 온화함
verse역동적이고 다재다능함

응답 예시

응답

200 OK
<binary audio data>

중요 필드

Content-Typestring

HTTP 응답의 미디어 유형입니다. 오디오 형식 또는 SSE의 text/event-stream입니다.

bodybinary | SSE

audio는 오디오 바이트, sse는 이벤트 스트림입니다. Content-Type과 요청 모드에 맞게 처리하세요.

MiniMax Speech 2.8 Turbo는 선택한 음성으로 대본을 빠르게 합성합니다. 신속한 응답이 필요한 음성 인터페이스와 내레이션에 적합합니다.

{
  "model": "speech-2.8-turbo",
  "input": "Welcome to TokenLab.",
  "voice_id": "male-qn-qingse",
  "speed": 1,
  "response_format": "mp3",
  "stream_format": "audio"
}

인증

BearerAuth
AuthorizationBearer <token>

API 키 인증입니다. Dashboard > API > API Keys에서 API 키를 생성하거나 관리하십시오.

위치: header

헤더

X-TokenLab-Delivery-Policy?string

요청별 전송 정책입니다. API 키 및 Workspace 기본값을 재정의합니다. 자동으로 TokenLab Verified를 먼저 시도하며, 출력, 요청 수락 또는 영구 리소스 생성 전에 Official 전용으로 한 번 전환될 수 있습니다.

허용 값

  • "auto"
  • "verified"
  • "official"

요청 본문

application/json

응답

application/json

application/json

application/json

application/json

application/json

application/json