Ses ve gerçek zamanlı
Konuşma Oluştur
Girdi metninden ses üretir
İstek Gövdesi
Yanıt biçimi seçilen modele ve stream_format değerine bağlıdır. Uzun girdiler için HTTP zaman aşımını en az 120s olarak ayarlayın.
İsteğe bağlı alanlar, sesler, çıktı biçimleri ve SSE desteği modele bağlıdır. Göndermeden önce GET /v1/models/{model} ile kontrol edin. Desteklenmeyen parametreler 400 unsupported_parameter döndürebilir.
tts-1TTS model ID’si. Güncel seçenekleri GET /v1/models?recommended_for=tts ile bulun.
Ses üretilecek metin. Maksimum 4096 karakter.
Ses seçici. nova gibi yerleşik bir ses, Kore gibi Gemini sesi veya uyumlu özel sesler için { "id": "voice-id" } gibi bir nesne gönderin.
Uyumlu MiniMax konuşma modelleri gibi bu parametreyi destekleyen modeller için ses ID’si.
Destekleyen OpenAI uyumlu TTS modelleri için isteğe bağlı stil veya okuma talimatları.
Gemini TTS modelleri için isteğe bağlı konuşma stili prompt'u.
Gemini, xAI ve uyumlu TTS route’ları için isteğe bağlı dil kodu, örneğin en-US.
Ses formatı. Yaygın değerler mp3, opus, aac, flac, wav ve pcm; desteklenen değerler model ailesine göre değişir.
audioTokenLab teslim formatı: audio veya sse. tts-1 ve tts-1-hd için stream_format=sse desteklenmez.
Destekleyen model aileleri için konuşma hızı (0.25 ile 4.0 arası).
Gemini uyumlu TTS route’ları için sampling temperature (0 ile 2 arası).
Yanıt
stream_format=audio ses baytlarını döndürür. stream_format=sse destekleyen modeller text/event-stream döndürür; yanıtın tamamını ses dosyası olarak kaydetmek yerine olayları ayrıştırın.
İstek
curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"voice": "nova",
"input": "Hello, welcome to TokenLab!"
}' \
--output speech.mp3Ses Örnekleri
Kullanılabilir sesler modele bağlıdır. Aşağıdaki adlar örnektir; tüm TTS modellerinin ortak ses listesi değildir.
| Ses | Açıklama |
|---|---|
alloy | Nötr, dengeli |
ash | Sakin, ölçülü |
ballad | Melodik, etkileyici |
coral | Sıcak, davetkar |
echo | Sıcak, konuşma tarzında |
fable | Etkileyici, anlatımsal |
nova | Dostane, net |
onyx | Derin, otoriter |
sage | Bilge, düşünceli |
shimmer | Yumuşak, nazik |
verse | Dinamik, çok yönlü |
Yanıt
<binary audio data>Önemli alanlar
HTTP yanıtının medya türü: ses biçimi veya SSE için text/event-stream.
audio için ses baytları, sse için olay akışı. Ayrıştırıcıyı Content-Type ve istenen moda göre seçin.
MiniMax Speech 2.8 Turbo, seçilen bir sesle metni hıza odaklanan bir iş akışı üzerinden seslendirir. Hızlı yanıt veren sesli arayüzler ve anlatım için uygundur.
{
"model": "speech-2.8-turbo",
"input": "Welcome to TokenLab.",
"voice_id": "male-qn-qingse",
"speed": 1,
"response_format": "mp3",
"stream_format": "audio"
}Yetkilendirme
BearerAuth API Anahtarı kimlik doğrulaması. API anahtarlarını Dashboard > API > API Keys bölümünden oluşturun veya yönetin.
Konum: header
Başlıklar
İstek bazlı Teslimat politikası. API anahtarı ve Çalışma Alanı varsayılanlarını geçersiz kılar. Otomatik olarak önce TokenLab Verified dener ve çıktı, istek kabulü veya kalıcı kaynak oluşturma öncesinde bir kez Official seçeneğine geçiş yapabilir.
Geçerli değerler
- "auto"
- "verified"
- "official"
İstek gövdesi
application/json
Yanıt
application/json
application/json
application/json
application/json
application/json
application/json