오디오 및 실시간
번역 생성
오디오를 영어 텍스트로 번역합니다
개요
지원되는 모든 언어의 오디오를 영어 텍스트로 번역합니다. transcription과 달리, 이 endpoint는 입력 언어와 관계없이 항상 영어 텍스트를 출력합니다.
이 엔드포인트는 오디오를 영어로 번역합니다. 오디오 번역은 language를 지원하지 않으므로 전송하면 unsupported_parameter가 반환될 수 있습니다. 텍스트 번역에는 POST /v1/translations를 사용하세요. recommended_for=translation은 해당 텍스트 API를 가리킵니다.
요청 본문
번역 처리가 완료되면 응답합니다. 긴 오디오는 HTTP 클라이언트 제한 시간을 최소 120s로 설정하세요.
번역할 오디오 파일입니다. 지원 형식: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. 최대 파일 크기는 25 MB입니다.
whisper-1오디오 번역 모델 ID입니다. 예: whisper-1. 현재 모델 세부정보에서 POST /v1/audio/translations 지원을 확인하세요.
model의 스타일을 유도하거나 이전 세그먼트를 이어가기 위한 선택적 텍스트입니다. 영어로 작성해야 합니다.
json출력 형식입니다. Whisper는 json, text, srt, verbose_json, vtt를 지원합니다. 다른 모델의 지원 범위는 모델 세부정보에서 확인하세요.
0~1 범위의 샘플링 온도입니다. 이 매개변수를 지원하는 모델에서만 사용하세요.
응답
다음 필드는 JSON 전사 또는 번역 응답에 해당합니다. text, srt, vtt는 JSON 객체 대신 원시 텍스트나 자막을 반환합니다. 추가 필드는 모델과 출력 형식에 따라 다릅니다.
영어로 번역된 텍스트입니다.
verbose_json 형식의 경우, 응답에는 다음도 포함됩니다:
응답에 제공되는 경우의 언어 표시입니다.
초 단위의 입력 오디오 길이입니다.
타임스탬프가 포함된 번역 텍스트 세그먼트입니다.
요청
curl -X POST "https://api.tokenlab.sh/v1/audio/translations" \
-H "Authorization: Bearer sk-your-api-key" \
-F "file=@german_audio.mp3" \
-F "model=whisper-1"응답
{
"text": "Hello, my name is Wolfgang and I come from Germany. Where are you from?"
}번역 vs 전사
| 기능 | 번역 | 전사 |
|---|---|---|
| 출력 언어 | 항상 영어 | 입력과 동일 |
| 사용 사례 | 외국어 오디오를 영어로 변환 | 원본 언어 유지 |
| Language parameter | 해당 없음 | 선택적 힌트 |
인증
BearerAuth API 키 인증입니다. Dashboard > API > API Keys에서 API 키를 생성하거나 관리하십시오.
위치: header
헤더
요청별 전송 정책입니다. API 키 및 Workspace 기본값을 재정의합니다. 자동으로 TokenLab Verified를 먼저 시도하며, 출력, 요청 수락 또는 영구 리소스 생성 전에 Official 전용으로 한 번 전환될 수 있습니다.
허용 값
- "auto"
- "verified"
- "official"
요청 본문
multipart/form-data
응답
application/json
application/json
application/json
application/json
application/json
application/json