Áudio e tempo real

Criar Tradução

Traduz áudio em texto em inglês

POST
/v1/audio/translations

Visão geral

Traduz áudio em qualquer idioma suportado para texto em inglês. Diferentemente da transcrição, este endpoint sempre retorna texto em inglês, independentemente do idioma de entrada.

Este endpoint traduz áudio para inglês. Não envie language: a tradução de áudio não aceita esse parâmetro e pode retornar unsupported_parameter. Para traduzir texto, use POST /v1/translations; recommended_for=translation se refere a essa API de texto.

Corpo da requisição

A resposta é retornada ao concluir a tradução. Para áudios longos, configure um tempo limite HTTP de pelo menos 120s.

filefileobrigatório

O arquivo de áudio a ser traduzido. Formatos suportados: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. O tamanho máximo do arquivo é 25 MB.

modelstringpadrão: whisper-1

ID do modelo de tradução de áudio, como whisper-1. Confirme nos detalhes atuais o suporte a POST /v1/audio/translations.

promptstring

Um texto opcional para orientar o estilo do model ou continuar um segmento anterior. Deve estar em inglês.

response_formatstringpadrão: json

Formato de saída. Whisper aceita json, text, srt, verbose_json e vtt; outros modelos podem aceitar um conjunto diferente. Consulte os detalhes do modelo.

temperaturenumber

Temperatura de amostragem de 0 a 1, apenas para modelos que aceitam esse parâmetro.

Resposta

Os campos abaixo descrevem respostas JSON de transcrição ou tradução. text, srt e vtt retornam texto ou legendas sem um objeto JSON. Campos adicionais dependem do modelo e do formato.

textstring

O texto traduzido em inglês.

Para o formato verbose_json, a resposta também inclui:

languagestring

Indicação de idioma fornecida na resposta, quando presente.

durationnumber

A duração do áudio de entrada em segundos.

segmentsarray

Segmentos do texto traduzido com timestamps.

Requisição

curl -X POST "https://api.tokenlab.sh/v1/audio/translations" \
  -H "Authorization: Bearer sk-your-api-key" \
  -F "file=@german_audio.mp3" \
  -F "model=whisper-1"

Resposta

{
  "text": "Hello, my name is Wolfgang and I come from Germany. Where are you from?"
}

Tradução vs Transcrição

RecursoTraduçãoTranscrição
Idioma de saídaSempre inglêsIgual ao de entrada
Caso de usoConverter áudio estrangeiro para inglêsPreservar o idioma original
Parâmetro languageNão se aplicaDica opcional

Autorização

BearerAuth
AuthorizationBearer <token>

Autenticação por Chave de API. Crie ou gerencie chaves de API em Dashboard > API > API Keys.

Local: header

Cabeçalhos

X-TokenLab-Delivery-Policy?string

Política de entrega por solicitação. Substitui os padrões da API key e do Workspace. Tenta automaticamente o TokenLab Verified primeiro e pode alternar uma vez para Official apenas antes da saída, aceitação da solicitação ou criação de recurso persistente.

Valores permitidos

  • "auto"
  • "verified"
  • "official"

Corpo da requisição

multipart/form-data

Resposta

application/json

application/json

application/json

application/json

application/json

application/json