Audio & realtime
Buat Transkripsi
Mentranskripsikan audio ke dalam bahasa input
Body Permintaan
Transkripsi dapat langsung mengembalikan teks atau menerima tugas asinkron dengan HTTP 200, id, dan status. Untuk tugas yang diterima, ikuti poll_url atau periksa /v1/tasks/{id}. Untuk audio panjang yang diproses sinkron, gunakan batas waktu setidaknya 120s.
File audio untuk ditranskripsikan. Format yang didukung: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Ukuran file maksimum: 25 MB.
whisper-1ID model transkripsi, misalnya whisper-1 atau gpt-4o-transcribe. Temukan pilihan terkini melalui GET /v1/models?recommended_for=stt.
Bahasa audio dalam format ISO-639-1 (misalnya, en, zh, ja).
Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya.
jsonFormat keluaran. Whisper mendukung json, text, srt, verbose_json, dan vtt; model lain dapat mendukung pilihan berbeda. Periksa detail model.
Temperatur sampling dari 0 hingga 1, hanya untuk model yang mendukung parameter ini.
word dan/atau segment, jika didukung model. Whisper memerlukan response_format=verbose_json. Dalam multipart, ulangi timestamp_granularities[] untuk beberapa nilai.
Respons
Field berikut menjelaskan respons JSON transkripsi atau terjemahan. text, srt, dan vtt mengembalikan teks atau subtitel mentah, bukan objek JSON. Field tambahan bergantung pada model dan format keluaran.
Teks hasil transkripsi.
Untuk verbose_json:
Nama tugas jika dikembalikan, misalnya transcribe.
Bahasa yang terdeteksi.
Durasi audio dalam detik.
Segmen transkripsi dengan timestamp.
Timestamp tingkat kata (jika diminta).
Tugas transkripsi asinkron yang diterima mengembalikan field berikut, bukan teks transkripsi:
ID tugas.
Alias identifier tugas asinkron ketika tersedia.
Status tugas: pending, processing, completed, atau failed.
URL polling yang diutamakan saat disediakan oleh respons pembuatan.
Permintaan
curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
-H "Authorization: Bearer sk-your-api-key" \
-F file="@audio.mp3" \
-F model="whisper-1" \
-F language="en"Respons
{
"text": "Hello, this is a test of the transcription API."
}Terjemahan
Untuk menerjemahkan audio ke bahasa Inggris, gunakan endpoint translations:
with open("audio.mp3", "rb") as audio_file:
response = client.audio.translations.create(
model="whisper-1",
file=audio_file
)
print(response.text)Otorisasi
BearerAuth Autentikasi API Key. Buat atau kelola API key di Dashboard > API > API Keys.
Lokasi: header
Header
Kebijakan Pengiriman per-permintaan. Menggantikan default API key dan Workspace. Secara otomatis mencoba TokenLab Verified terlebih dahulu dan dapat beralih satu kali ke Official saja sebelum output, penerimaan permintaan, atau pembuatan sumber daya persisten.
Nilai yang tersedia
- "auto"
- "verified"
- "official"
Body permintaan
multipart/form-data
Respons
application/json
application/json
application/json
application/json
application/json
application/json