Skip to main content
Iniciar Tradução

Iniciar Tradução

Crie um novo projeto de tradução enviando um arquivo de vídeo ou áudio. O processo de tradução é executado de forma assíncrona em segundo plano. Use o endpoint de status para acompanhar o progresso e recuperar resultados. Use Obter Detalhes do Projeto quando precisar do histórico da versão traduzida ou do histórico de sincronização labial.

Limite de Simultaneidade

Você pode executar até 10 traduções ao mesmo tempo por conta. Se 10 traduções já estiverem em andamento, novas solicitações retornam CONCURRENT_TRANSLATION_LIMIT_REACHED (HTTP 429).

Solicitação

Este endpoint aceita multipart/form-data com um upload de arquivo.

Cabeçalhos

string
obrigatório
Sua chave de API VoiceCheap. Obtenha uma em app.voicecheap.ai/page-api.

Parâmetros do corpo

file
obrigatório
O arquivo de vídeo ou áudio a ser traduzido.Formatos de vídeo suportados: video/mp4, video/quicktime, video/x-matroska, video/webm, video/mpegFormatos de áudio suportados: audio/mpeg, audio/wav, audio/mp4, audio/x-m4a, audio/flac, audio/ogg, audio/aac, audio/webmTamanho máximo de arquivo por plano: Beginner 5 GB, Starter 10 GB, Creator 20 GB, Pro 30 GB, Scale 40 GB e Enterprise 60 GB.
string
obrigatório
O idioma para o qual o conteúdo será traduzido. Deve estar em letras minúsculas.Valores permitidos (70+): afrikaans, albanian, amharic, arabic, armenian, assamese, azerbaijani, basque, belarusian, bengali, bosnian, bulgarian, catalan, croatian, czech, danish, dutch, english, british english, estonian, finnish, french, french canadian, galician, german, greek, gujarati, hebrew, hindi, hungarian, icelandic, indonesian, irish, italian, japanese, kannada, kazakh, khmer, korean, lao, latvian, lithuanian, macedonian, malay, malayalam, mandarin, marathi, mongolian, nepali, norwegian, persian, polish, portuguese, brazilian portuguese, punjabi, romanian, russian, serbian, slovak, slovenian, spanish, swahili, swedish, tagalog, tamil, telugu, thai, turkish, ukrainian, urdu, vietnamese, welsh, yoruba, zulu
string
O idioma de origem do conteúdo usando códigos de idioma ISO (por exemplo, en, es, fr, de, ja, zh).
Altamente recomendado: Deixe este campo vazio para detecção automática.Forneça este parâmetro apenas se tiver 100% de certeza de que o código do idioma está correto e no formato ISO válido. Códigos de idioma incorretos causarão falhas na transcrição. Nossa detecção automática suporta mais de 80 idiomas e é altamente precisa.
Padrão: auto-detect
string
Um nome personalizado para o projeto. Útil para identificar projetos em seu painel.Padrão: O ID do projeto será usado se não for fornecido.
string
Um endpoint https que recebe a eventos de webhook para este projeto, substituindo o endpoint configurado em sua conta.Padrão: O endpoint de webhook da conta, quando um estiver configurado.
string
auto-detect ou um número inteiro de 1 a 32. Uma contagem de falantes conhecida pode melhorar a diarização.Padrão: auto-detect
string
Uma matriz de strings JSON de nomes, marcas, siglas ou termos especializados específicos da solicitação. Esses termos são mesclados com o glossário salvo da conta ou da equipe.
boolean
Remova palavras de preenchimento comuns da transcrição de origem antes da tradução.Padrão: true
string
Uma transcrição SRT existente no idioma de origem. originalLanguage deve ser explícito quando este campo for fornecido.
boolean
Se deve preservar o áudio de fundo na saída.Quando ativado, mantém música de fundo, ambiente, risadas, aplausos e sons de multidão, removendo apenas a voz original (separação de stems). Desative se sua fonte não tiver áudio de fundo.Padrão: true
boolean
Mantenha o falante original em volume baixo sob a voz traduzida.Padrão: false
number
Volume da voz original de 1 a 70 quando keepOriginalVoice estiver ativado.Padrão: 30
string
Modo de isolamento de voz quando keepBackgroundMusic estiver ativado. Controla a qualidade e as características da separação de voz.
Nosso processamento de voz padrão, projetado para qualidade de áudio profissional:
  • Remove ecos e reverberações
  • Limpa imperfeições técnicas
  • Produz uma voz clara e nítida
Recomendado para: A maioria dos projetos onde a qualidade do áudio é fundamental. Ideal para tutoriais, conteúdo educacional, vídeos de marketing e qualquer conteúdo que exija clareza de voz ideal.
Preserva as características naturais do ambiente de gravação:
  • Mantém um som mais próximo da gravação original
  • Preserva as características ambientais
Recomendado para: Conteúdo onde a autenticidade do ambiente é importante, como vlogs ao ar livre, documentários ou conteúdo onde o ambiente sonoro seja parte integrante da experiência.
Esta opção pode criar artefatos ou efeitos inesperados em alguns casos devido à preservação de elementos de fundo.
Valores permitidos: studio, realisticPadrão: studio
boolean
Se deve gerar legendas para o vídeo traduzido.Quando ativado, adiciona legendas limpas em preto e branco no estilo Netflix. Use subtitlesSource para escolher o texto original (idioma de origem) ou traduzido (idioma de destino). As legendas são sincronizadas automaticamente para uma legibilidade ideal.Nota: Legendas embutidas (hard-burned) exigem FFmpeg com o filtro subtitles (libass). Se não estiver disponível, a API recorrerá à incorporação de uma faixa de legenda em vez de usar o estilo embutido.Padrão: false
string
Escolha a fonte do texto das legendas quando subtitles estiver ativado.Valores permitidos: translated, originalPadrão: translatedNota: Se original for selecionado, mas a transcrição original não estiver disponível, as legendas usarão translated como alternativa.
string
Aciona o processamento de sincronização labial após a conclusão da dublagem.
  • standard = Lip Sync
  • pro = Lip Sync Pro
  • studio = Lip Sync Studio
Os modos premium aplicam seus requisitos normais de plano, duração e créditos.Padrão: omita o campo para ignorar a sincronização labial.
boolean
Ativa a detecção de orador ativo para a execução de sincronização labial solicitada.Padrão: false
boolean
Seletor de sincronização labial legado mantido para compatibilidade com versões anteriores.
  • false = Sincronização labial padrão (4 minutos de créditos por 1 minuto de vídeo)
  • true = Lip Sync Pro (9 minutos de créditos por 1 minuto de vídeo)
Lip Sync Pro está disponível a partir do plano Creator.
Duração máxima: 30 minutos por vídeo.Latência: O processamento de sincronização labial normalmente adiciona 2x-4x a duração do vídeo original.
E-mails de conclusão e falha de sincronização labial não são enviados para solicitações acionadas por API. Use o status endpoint para acompanhar o progresso.
Padrão: não ativado (omita o campo para ignorar a sincronização labial)Form-data: Envie valores booleanos como strings true ou false (por exemplo, -F "lipsyncPro=false").
Não combine lipsyncPro com um lipSyncMode conflitante.
string
Estratégia de voz: cloning ou custom.Padrão: cloning
string
Obrigatório quando voiceMode é custom. A voz deve pertencer ao proprietário efetivo do projeto. IDs de voz arbitrários ou sem proprietário são rejeitados.
object
Ajuste os parâmetros de clonagem de voz para controle avançado sobre a voz gerada. Passe como uma string JSON ao usar form-data. Todos os valores devem estar entre 0 e 1 (com incremento de 0,01).
Estas configurações aplicam-se apenas quando voiceMode é cloning.
Valores padrão (equilibrados):
Recomendado para evitar a reprodução de sotaque:
string
Uma matriz JSON de intervalos de tempo de origem que devem permanecer no idioma original.
Pulos de tempo exigem entrada de vídeo e keepBackgroundMusic=true. Eles não podem ser combinados com keepOriginalVoice e não podem sobrepor segmentos de transcrição.

Resposta

boolean
obrigatório
Sempre true para solicitações bem-sucedidas
string
obrigatório
Uma mensagem legível por humanos descrevendo o resultado
string
obrigatório
O identificador único para o projeto de tradução criado. Use este ID para verificar o status.
number
obrigatório
Estimativa aproximada de processamento em minutos. A estimativa atual é de cinco minutos de processamento por minuto iniciado de mídia de origem.

Exemplos

Regras de glossário salvas e instruções de tradução personalizadas da conta ou equipe efetiva são aplicadas automaticamente.

Exemplo de Resposta

Erros