Audio & realtime
Buat Speech
Menghasilkan audio dari teks input
Body Permintaan
Mode respons bergantung pada model yang dipilih dan stream_format. Untuk input panjang, atur batas waktu HTTP setidaknya 120s.
Field opsional, suara, format keluaran, dan dukungan SSE bergantung pada model. Periksa GET /v1/models/{model} sebelum mengirimnya. Parameter yang tidak didukung dapat mengembalikan 400 unsupported_parameter.
tts-1ID model TTS. Temukan pilihan terkini melalui GET /v1/models?recommended_for=tts.
Teks untuk menghasilkan audio. Maksimum 4096 karakter.
Selector suara. Kirim nama bawaan seperti nova, suara Gemini seperti Kore, atau objek seperti { "id": "voice-id" } untuk suara kustom yang kompatibel.
ID suara untuk model yang mendukung parameter ini, seperti model suara MiniMax yang kompatibel.
Instruksi gaya atau delivery opsional untuk model TTS kompatibel OpenAI yang mendukungnya.
Prompt gaya bicara opsional untuk model Gemini TTS.
Kode bahasa opsional, misalnya en-US, untuk route Gemini, xAI, dan TTS kompatibel.
Format audio. Nilai umum mencakup mp3, opus, aac, flac, wav, dan pcm; nilai yang didukung berbeda menurut family model.
audioFormat delivery TokenLab: audio atau sse. stream_format=sse tidak didukung untuk tts-1 atau tts-1-hd.
Kecepatan bicara untuk family model yang mendukungnya (0.25 hingga 4.0).
Sampling temperature untuk route TTS kompatibel Gemini (0 hingga 2).
Respons
stream_format=audio mengembalikan byte audio. Model yang mendukung stream_format=sse mengembalikan text/event-stream; proses event-nya alih-alih menyimpan seluruh respons sebagai file audio.
Permintaan
curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"voice": "nova",
"input": "Hello, welcome to TokenLab!"
}' \
--output speech.mp3Sampel Voice
Suara yang tersedia bergantung pada model. Nama di bawah hanya contoh, bukan daftar suara bersama untuk semua model TTS.
| Voice | Deskripsi |
|---|---|
alloy | Netral, seimbang |
ash | Tenang, terukur |
ballad | Melodis, ekspresif |
coral | Hangat, mengundang |
echo | Hangat, percakapan |
fable | Ekspresif, naratif |
nova | Ramah, jelas |
onyx | Dalam, berwibawa |
sage | Bijaksana, penuh pertimbangan |
shimmer | Lembut, halus |
verse | Dinamis, serbaguna |
Respons
<binary audio data>Field penting
Jenis media respons HTTP: format audio atau text/event-stream untuk SSE.
Byte audio untuk audio; aliran event untuk sse. Pilih parser sesuai Content-Type dan mode yang diminta.
MiniMax Speech 2.8 Turbo menyintesis naskah dengan suara pilihan melalui alur yang berfokus pada kecepatan. Model ini berguna untuk antarmuka suara yang responsif dan narasi.
{
"model": "speech-2.8-turbo",
"input": "Welcome to TokenLab.",
"voice_id": "male-qn-qingse",
"speed": 1,
"response_format": "mp3",
"stream_format": "audio"
}Otorisasi
BearerAuth Autentikasi API Key. Buat atau kelola API key di Dashboard > API > API Keys.
Lokasi: header
Header
Kebijakan Pengiriman per-permintaan. Menggantikan default API key dan Workspace. Secara otomatis mencoba TokenLab Verified terlebih dahulu dan dapat beralih satu kali ke Official saja sebelum output, penerimaan permintaan, atau pembuatan sumber daya persisten.
Nilai yang tersedia
- "auto"
- "verified"
- "official"
Body permintaan
application/json
Respons
application/json
application/json
application/json
application/json
application/json
application/json