TokenLab

오디오 및 실시간

번역 생성

오디오를 영어 텍스트로 번역합니다

POST
/v1/audio/translations

개요

지원되는 모든 언어의 오디오를 영어 텍스트로 번역합니다. transcription과 달리, 이 endpoint는 입력 언어와 관계없이 항상 영어 텍스트를 출력합니다.

이 엔드포인트는 오디오를 영어로 번역합니다. 오디오 번역은 language를 지원하지 않으므로 전송하면 unsupported_parameter가 반환될 수 있습니다. 텍스트 번역에는 POST /v1/translations를 사용하세요. recommended_for=translation은 해당 텍스트 API를 가리킵니다.

요청 본문

번역 처리가 완료되면 응답합니다. 긴 오디오는 HTTP 클라이언트 제한 시간을 최소 120s로 설정하세요.

filefile필수

번역할 오디오 파일입니다. 지원 형식: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. 최대 파일 크기는 25 MB입니다.

modelstring기본값: whisper-1

오디오 번역 모델 ID입니다. 예: whisper-1. 현재 모델 세부정보에서 POST /v1/audio/translations 지원을 확인하세요.

promptstring

model의 스타일을 유도하거나 이전 세그먼트를 이어가기 위한 선택적 텍스트입니다. 영어로 작성해야 합니다.

response_formatstring기본값: json

출력 형식입니다. Whisper는 json, text, srt, verbose_json, vtt를 지원합니다. 다른 모델의 지원 범위는 모델 세부정보에서 확인하세요.

temperaturenumber

0~1 범위의 샘플링 온도입니다. 이 매개변수를 지원하는 모델에서만 사용하세요.

응답

다음 필드는 JSON 전사 또는 번역 응답에 해당합니다. text, srt, vtt는 JSON 객체 대신 원시 텍스트나 자막을 반환합니다. 추가 필드는 모델과 출력 형식에 따라 다릅니다.

textstring

영어로 번역된 텍스트입니다.

verbose_json 형식의 경우, 응답에는 다음도 포함됩니다:

languagestring

응답에 제공되는 경우의 언어 표시입니다.

durationnumber

초 단위의 입력 오디오 길이입니다.

segmentsarray

타임스탬프가 포함된 번역 텍스트 세그먼트입니다.

요청

curl -X POST "https://api.tokenlab.sh/v1/audio/translations" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F "file=@german_audio.mp3" \
  -F "model=whisper-1"

응답

{
  "text": "Hello, my name is Wolfgang and I come from Germany. Where are you from?"
}

번역 vs 전사

기능번역전사
출력 언어항상 영어입력과 동일
사용 사례외국어 오디오를 영어로 변환원본 언어 유지
Language parameter해당 없음선택적 힌트

인증

BearerAuth
AuthorizationBearer <token>

API 키 인증입니다. Dashboard > API > API Keys에서 API 키를 생성하거나 관리하십시오.

위치: header

헤더

X-TokenLab-Delivery-Policy?string

요청별 전송 정책입니다. API 키 및 Workspace 기본값을 재정의합니다. 자동으로 TokenLab Verified를 먼저 시도하며, 출력, 요청 수락 또는 영구 리소스 생성 전에 Official 전용으로 한 번 전환될 수 있습니다.

허용 값

  • "auto"
  • "verified"
  • "official"

요청 본문

multipart/form-data

응답

application/json

application/json

application/json

application/json

application/json

application/json