Audio & realtime

Buat Transkripsi

Mentranskripsikan audio ke dalam bahasa input

POST
/v1/audio/transcriptions

Body Permintaan

Transkripsi dapat langsung mengembalikan teks atau menerima tugas asinkron dengan HTTP 200, id, dan status. Untuk tugas yang diterima, ikuti poll_url atau periksa /v1/tasks/{id}. Untuk audio panjang yang diproses sinkron, gunakan batas waktu setidaknya 120s.

filefilewajib

File audio untuk ditranskripsikan. Format yang didukung: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Ukuran file maksimum: 25 MB.

modelstringbawaan: whisper-1

ID model transkripsi, misalnya whisper-1 atau gpt-4o-transcribe. Temukan pilihan terkini melalui GET /v1/models?recommended_for=stt.

languagestring

Bahasa audio dalam format ISO-639-1 (misalnya, en, zh, ja).

promptstring

Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya.

response_formatstringbawaan: json

Format keluaran. Whisper mendukung json, text, srt, verbose_json, dan vtt; model lain dapat mendukung pilihan berbeda. Periksa detail model.

temperaturenumber

Temperatur sampling dari 0 hingga 1, hanya untuk model yang mendukung parameter ini.

timestamp_granularitiesarray

word dan/atau segment, jika didukung model. Whisper memerlukan response_format=verbose_json. Dalam multipart, ulangi timestamp_granularities[] untuk beberapa nilai.

Respons

Field berikut menjelaskan respons JSON transkripsi atau terjemahan. text, srt, dan vtt mengembalikan teks atau subtitel mentah, bukan objek JSON. Field tambahan bergantung pada model dan format keluaran.

textstring

Teks hasil transkripsi.

Untuk verbose_json:

taskstring

Nama tugas jika dikembalikan, misalnya transcribe.

languagestring

Bahasa yang terdeteksi.

durationnumber

Durasi audio dalam detik.

segmentsarray

Segmen transkripsi dengan timestamp.

wordsarray

Timestamp tingkat kata (jika diminta).

Tugas transkripsi asinkron yang diterima mengembalikan field berikut, bukan teks transkripsi:

idstring

ID tugas.

task_idstring

Alias identifier tugas asinkron ketika tersedia.

statusstring

Status tugas: pending, processing, completed, atau failed.

poll_urlstring

URL polling yang diutamakan saat disediakan oleh respons pembuatan.

Permintaan

curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F file="@audio.mp3" \
  -F model="whisper-1" \
  -F language="en"

Respons

{
  "text": "Hello, this is a test of the transcription API."
}

Terjemahan

Untuk menerjemahkan audio ke bahasa Inggris, gunakan endpoint translations:

with open("audio.mp3", "rb") as audio_file:
    response = client.audio.translations.create(
        model="whisper-1",
        file=audio_file
    )

print(response.text)

Otorisasi

BearerAuth
AuthorizationBearer <token>

Autentikasi API Key. Buat atau kelola API key di Dashboard > API > API Keys.

Lokasi: header

Header

X-TokenLab-Delivery-Policy?string

Kebijakan Pengiriman per-permintaan. Menggantikan default API key dan Workspace. Secara otomatis mencoba TokenLab Verified terlebih dahulu dan dapat beralih satu kali ke Official saja sebelum output, penerimaan permintaan, atau pembuatan sumber daya persisten.

Nilai yang tersedia

  • "auto"
  • "verified"
  • "official"

Body permintaan

multipart/form-data

Respons

application/json

application/json

application/json

application/json

application/json

application/json