Audio & realtime

Buat Speech

Menghasilkan audio dari teks input

POST
/v1/audio/speech

Body Permintaan

Mode respons bergantung pada model yang dipilih dan stream_format. Untuk input panjang, atur batas waktu HTTP setidaknya 120s.

Field opsional, suara, format keluaran, dan dukungan SSE bergantung pada model. Periksa GET /v1/models/{model} sebelum mengirimnya. Parameter yang tidak didukung dapat mengembalikan 400 unsupported_parameter.

modelstringbawaan: tts-1

ID model TTS. Temukan pilihan terkini melalui GET /v1/models?recommended_for=tts.

inputstringwajib

Teks untuk menghasilkan audio. Maksimum 4096 karakter.

voicestring | object

Selector suara. Kirim nama bawaan seperti nova, suara Gemini seperti Kore, atau objek seperti { "id": "voice-id" } untuk suara kustom yang kompatibel.

voice_idstring

ID suara untuk model yang mendukung parameter ini, seperti model suara MiniMax yang kompatibel.

instructionsstring

Instruksi gaya atau delivery opsional untuk model TTS kompatibel OpenAI yang mendukungnya.

promptstring

Prompt gaya bicara opsional untuk model Gemini TTS.

language_codestring

Kode bahasa opsional, misalnya en-US, untuk route Gemini, xAI, dan TTS kompatibel.

response_formatstring

Format audio. Nilai umum mencakup mp3, opus, aac, flac, wav, dan pcm; nilai yang didukung berbeda menurut family model.

stream_formatstringbawaan: audio

Format delivery TokenLab: audio atau sse. stream_format=sse tidak didukung untuk tts-1 atau tts-1-hd.

speednumber

Kecepatan bicara untuk family model yang mendukungnya (0.25 hingga 4.0).

temperaturenumber

Sampling temperature untuk route TTS kompatibel Gemini (0 hingga 2).

Respons

stream_format=audio mengembalikan byte audio. Model yang mendukung stream_format=sse mengembalikan text/event-stream; proses event-nya alih-alih menyimpan seluruh respons sebagai file audio.

Permintaan

curl -X POST "https://api.tokenlab.sh/v1/audio/speech" \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "tts-1-hd",
    "voice": "nova",
    "input": "Hello, welcome to TokenLab!"
  }' \
  --output speech.mp3

Sampel Voice

Suara yang tersedia bergantung pada model. Nama di bawah hanya contoh, bukan daftar suara bersama untuk semua model TTS.

VoiceDeskripsi
alloyNetral, seimbang
ashTenang, terukur
balladMelodis, ekspresif
coralHangat, mengundang
echoHangat, percakapan
fableEkspresif, naratif
novaRamah, jelas
onyxDalam, berwibawa
sageBijaksana, penuh pertimbangan
shimmerLembut, halus
verseDinamis, serbaguna

Contoh respons

Respons

200 OK
<binary audio data>

Field penting

Content-Typestring

Jenis media respons HTTP: format audio atau text/event-stream untuk SSE.

bodybinary | SSE

Byte audio untuk audio; aliran event untuk sse. Pilih parser sesuai Content-Type dan mode yang diminta.

MiniMax Speech 2.8 Turbo menyintesis naskah dengan suara pilihan melalui alur yang berfokus pada kecepatan. Model ini berguna untuk antarmuka suara yang responsif dan narasi.

{
  "model": "speech-2.8-turbo",
  "input": "Welcome to TokenLab.",
  "voice_id": "male-qn-qingse",
  "speed": 1,
  "response_format": "mp3",
  "stream_format": "audio"
}

Otorisasi

BearerAuth
AuthorizationBearer <token>

Autentikasi API Key. Buat atau kelola API key di Dashboard > API > API Keys.

Lokasi: header

Header

X-TokenLab-Delivery-Policy?string

Kebijakan Pengiriman per-permintaan. Menggantikan default API key dan Workspace. Secara otomatis mencoba TokenLab Verified terlebih dahulu dan dapat beralih satu kali ke Official saja sebelum output, penerimaan permintaan, atau pembuatan sumber daya persisten.

Nilai yang tersedia

  • "auto"
  • "verified"
  • "official"

Body permintaan

application/json

Respons

application/json

application/json

application/json

application/json

application/json

application/json