Ses ve gerçek zamanlı
Transkripsiyon Oluştur
Sesi giriş diline transkribe eder
İstek Gövdesi
Transkripsiyon metni doğrudan döndürebilir veya HTTP 200, id ve status ile asenkron bir görevi kabul edebilir. Kabul edilen görev için poll_url adresini izleyin ya da /v1/tasks/{id} sorgulayın. Uzun sesin senkron işlenmesinde en az 120s zaman aşımı kullanın.
Transkribe edilecek ses dosyası. Desteklenen formatlar: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Maksimum dosya boyutu: 25 MB.
whisper-1Transkripsiyon model ID’si; örneğin whisper-1 veya gpt-4o-transcribe. Güncel seçenekleri GET /v1/models?recommended_for=stt ile bulun.
Sesin dili, ISO-639-1 formatında (ör. en, zh, ja).
Modelin stilini yönlendirmek veya önceki bir segmenti devam ettirmek için isteğe bağlı metin.
jsonÇıktı biçimi. Whisper json, text, srt, verbose_json ve vtt destekler; diğer modeller farklı seçenekler sunabilir. Model ayrıntılarını kontrol edin.
0 ile 1 arasında örnekleme sıcaklığı; yalnızca bu parametreyi destekleyen modeller için.
Model destekliyorsa word ve/veya segment. Whisper için response_format=verbose_json gerekir. Multipart isteklerde birden fazla değer için timestamp_granularities[] alanını tekrarlayın.
Yanıt
Aşağıdaki alanlar JSON transkripsiyon veya çeviri yanıtlarını açıklar. text, srt ve vtt, JSON nesnesi yerine ham metin veya altyazı döndürür. Ek alanlar modele ve çıktı biçimine bağlıdır.
Transkribe edilen metin.
verbose_json için:
Döndürüldüğünde görev adı; örneğin transcribe.
Algılanan dil.
Ses süresi, saniye cinsinden.
Zaman damgalarıyla birlikte transkripsiyon segmentleri.
Kelime düzeyinde zaman damgaları (istenirse).
Kabul edilen asenkron transkripsiyon görevi, metin yerine aşağıdaki alanları döndürür:
Görev ID'si.
Uygun olduğunda dönen asenkron görev kimliği takma adı.
Görev durumu: pending, processing, completed veya failed.
Oluşturma yanıtı sağladığında tercih edilen yoklama URL’si.
İstek
curl -X POST "https://api.tokenlab.sh/v1/audio/transcriptions" \
-H "Authorization: Bearer sk-your-api-key" \
-F file="@audio.mp3" \
-F model="whisper-1" \
-F language="en"Yanıt
{
"text": "Hello, this is a test of the transcription API."
}Çeviri
Sesi İngilizceye çevirmek için translations endpoint'ini kullanın:
with open("audio.mp3", "rb") as audio_file:
response = client.audio.translations.create(
model="whisper-1",
file=audio_file
)
print(response.text)Yetkilendirme
BearerAuth API Anahtarı kimlik doğrulaması. API anahtarlarını Dashboard > API > API Keys bölümünden oluşturun veya yönetin.
Konum: header
Başlıklar
İstek bazlı Teslimat politikası. API anahtarı ve Çalışma Alanı varsayılanlarını geçersiz kılar. Otomatik olarak önce TokenLab Verified dener ve çıktı, istek kabulü veya kalıcı kaynak oluşturma öncesinde bir kez Official seçeneğine geçiş yapabilir.
Geçerli değerler
- "auto"
- "verified"
- "official"
İstek gövdesi
multipart/form-data
Yanıt
application/json
application/json
application/json
application/json
application/json
application/json