Ses ve gerçek zamanlı

Konuşma Oluştur

Girdi metninden ses üretir

POST
/v1/audio/speech

İstek Gövdesi

Yanıt biçimi seçilen modele ve stream_format değerine bağlıdır. Uzun girdiler için HTTP zaman aşımını en az 120s olarak ayarlayın.

İsteğe bağlı alanlar, sesler, çıktı biçimleri ve SSE desteği modele bağlıdır. Göndermeden önce GET /v1/models/{model} ile kontrol edin. Desteklenmeyen parametreler 400 unsupported_parameter döndürebilir.

modelstringvarsayılan: tts-1

TTS model ID’si. Güncel seçenekleri GET /v1/models?recommended_for=tts ile bulun.

inputstringzorunlu

Ses üretilecek metin. Maksimum 4096 karakter.

voicestring | object

Ses seçici. nova gibi yerleşik bir ses, Kore gibi Gemini sesi veya uyumlu özel sesler için { "id": "voice-id" } gibi bir nesne gönderin.

voice_idstring

Uyumlu MiniMax konuşma modelleri gibi bu parametreyi destekleyen modeller için ses ID’si.

instructionsstring

Destekleyen OpenAI uyumlu TTS modelleri için isteğe bağlı stil veya okuma talimatları.

promptstring

Gemini TTS modelleri için isteğe bağlı konuşma stili prompt'u.

language_codestring

Gemini, xAI ve uyumlu TTS route’ları için isteğe bağlı dil kodu, örneğin en-US.

response_formatstring

Ses formatı. Yaygın değerler mp3, opus, aac, flac, wav ve pcm; desteklenen değerler model ailesine göre değişir.

stream_formatstringvarsayılan: audio

TokenLab teslim formatı: audio veya sse. tts-1 ve tts-1-hd için stream_format=sse desteklenmez.

speednumber

Destekleyen model aileleri için konuşma hızı (0.25 ile 4.0 arası).

temperaturenumber

Gemini uyumlu TTS route’ları için sampling temperature (0 ile 2 arası).

Yanıt

stream_format=audio ses baytlarını döndürür. stream_format=sse destekleyen modeller text/event-stream döndürür; yanıtın tamamını ses dosyası olarak kaydetmek yerine olayları ayrıştırın.

İstek

curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-hd",
    "voice": "nova",
    "input": "Hello, welcome to TokenLab!"
  }' \
  --output speech.mp3

Ses Örnekleri

Kullanılabilir sesler modele bağlıdır. Aşağıdaki adlar örnektir; tüm TTS modellerinin ortak ses listesi değildir.

SesAçıklama
alloyNötr, dengeli
ashSakin, ölçülü
balladMelodik, etkileyici
coralSıcak, davetkar
echoSıcak, konuşma tarzında
fableEtkileyici, anlatımsal
novaDostane, net
onyxDerin, otoriter
sageBilge, düşünceli
shimmerYumuşak, nazik
verseDinamik, çok yönlü

Yanıt örneği

Yanıt

200 OK
<binary audio data>

Önemli alanlar

Content-Typestring

HTTP yanıtının medya türü: ses biçimi veya SSE için text/event-stream.

bodybinary | SSE

audio için ses baytları, sse için olay akışı. Ayrıştırıcıyı Content-Type ve istenen moda göre seçin.

MiniMax Speech 2.8 Turbo, seçilen bir sesle metni hıza odaklanan bir iş akışı üzerinden seslendirir. Hızlı yanıt veren sesli arayüzler ve anlatım için uygundur.

{
  "model": "speech-2.8-turbo",
  "input": "Welcome to TokenLab.",
  "voice_id": "male-qn-qingse",
  "speed": 1,
  "response_format": "mp3",
  "stream_format": "audio"
}

Yetkilendirme

BearerAuth
AuthorizationBearer <token>

API Anahtarı kimlik doğrulaması. API anahtarlarını Dashboard > API > API Keys bölümünden oluşturun veya yönetin.

Konum: header

Başlıklar

X-TokenLab-Delivery-Policy?string

İstek bazlı Teslimat politikası. API anahtarı ve Çalışma Alanı varsayılanlarını geçersiz kılar. Otomatik olarak önce TokenLab Verified dener ve çıktı, istek kabulü veya kalıcı kaynak oluşturma öncesinde bir kez Official seçeneğine geçiş yapabilir.

Geçerli değerler

  • "auto"
  • "verified"
  • "official"

İstek gövdesi

application/json

Yanıt

application/json

application/json

application/json

application/json

application/json

application/json