Audio & Echtzeit

Übersetzung erstellen

Übersetzt Audio in englischen Text

POST
/v1/audio/translations

Überblick

Übersetzt Audio in jeder unterstützten Sprache in englischen Text. Im Gegensatz zur Transkription gibt dieser Endpoint unabhängig von der Eingabesprache immer englischen Text aus.

Dieser Endpunkt übersetzt Audio ins Englische. Senden Sie kein language: Audioübersetzung unterstützt den Parameter nicht und kann unsupported_parameter zurückgeben. Für Textübersetzung verwenden Sie POST /v1/translations; darauf bezieht sich recommended_for=translation.

Anfragekörper

Die Antwort erfolgt nach Abschluss der Übersetzung. Für längere Audiodateien sollte das HTTP-Timeout mindestens 120s betragen.

filefileerforderlich

Die Audio-Datei, die übersetzt werden soll. Unterstützte Formate: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Die maximale Dateigröße beträgt 25 MB.

modelstringStandard: whisper-1

Modell-ID für Audioübersetzung, etwa whisper-1. Prüfen Sie in den aktuellen Modelldetails die Unterstützung für POST /v1/audio/translations.

promptstring

Ein optionaler Text, um den Stil des Modells zu steuern oder ein vorheriges Segment fortzusetzen. Sollte auf Englisch sein.

response_formatstringStandard: json

Ausgabeformat. Whisper unterstützt json, text, srt, verbose_json und vtt; andere Modelle können eine andere Auswahl unterstützen. Prüfen Sie die Modelldetails.

temperaturenumber

Sampling-Temperatur von 0 bis 1, nur für Modelle, die diesen Parameter unterstützen.

Antwort

Die folgenden Felder beschreiben JSON-Antworten für Transkription oder Übersetzung. text, srt und vtt liefern Text bzw. Untertitel statt eines JSON-Objekts. Zusätzliche Felder hängen vom Modell und Ausgabeformat ab.

textstring

Der übersetzte Text auf Englisch.

Für das Format verbose_json enthält die Antwort außerdem:

languagestring

Sprachangabe aus der Antwort, sofern vorhanden.

durationnumber

Die Dauer des Eingabe-Audios in Sekunden.

segmentsarray

Segmente des übersetzten Textes mit Zeitstempeln.

Anfrage

curl -X POST "https://api.tokenlab.sh/v1/audio/translations" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F "file=@german_audio.mp3" \
  -F "model=whisper-1"

Antwort

{
  "text": "Hello, my name is Wolfgang and I come from Germany. Where are you from?"
}

Übersetzung vs. Transkription

FunktionÜbersetzungTranskription
AusgabespracheImmer EnglischGleich wie die Eingabe
AnwendungsfallFremdsprachiges Audio in Englisch umwandelnOriginalsprache beibehalten
SprachparameterNicht anwendbarOptionaler Hinweis

Autorisierung

BearerAuth
AuthorizationBearer <token>

API-Key-Authentifizierung. Erstellen oder verwalten Sie API-Keys unter Dashboard > API > API Keys.

Ort: header

Header

X-TokenLab-Delivery-Policy?string

Zustellungsrichtlinie pro Anfrage. Überschreibt die API-Key- und Workspace-Standardeinstellungen. Versucht automatisch zuerst TokenLab Verified und kann vor der Ausgabe, der Annahme der Anfrage oder der Erstellung persistenter Ressourcen einmalig auf Official umstellen.

Zulässige Werte

  • "auto"
  • "verified"
  • "official"

Anfragekörper

multipart/form-data

Antwort

application/json

application/json

application/json

application/json

application/json

application/json