Skip to main content
Avvia traduzione

Avvia traduzione

Crea un nuovo progetto di traduzione caricando un file video o audio. Il processo di traduzione viene eseguito in modo asincrono in background. Utilizza l’endpoint di stato per monitorare l’avanzamento e recuperare i risultati. Utilizza Ottieni dettagli del progetto quando hai bisogno della cronologia delle versioni tradotte o della cronologia della sincronizzazione labiale.

Limite di concorrenza

Puoi eseguire fino a 10 traduzioni contemporaneamente per account. Se 10 traduzioni sono già in corso, le nuove richieste restituiscono CONCURRENT_TRANSLATION_LIMIT_REACHED (HTTP 429).

Richiesta

Questo endpoint accetta multipart/form-data con un caricamento di file.

Intestazioni

string
obbligatorio
La tua chiave API VoiceCheap. Ottienine una da app.voicecheap.ai/page-api.

Parametri del corpo

file
obbligatorio
Il file video o audio da tradurre.Formati video supportati: video/mp4, video/quicktime, video/x-matroska, video/webm, video/mpegFormati audio supportati: audio/mpeg, audio/wav, audio/mp4, audio/x-m4a, audio/flac, audio/ogg, audio/aac, audio/webmDimensione massima del file per piano: Beginner 5 GB, Starter 10 GB, Creator 20 GB, Pro 30 GB, Scale 40 GB e Enterprise 60 GB.
string
obbligatorio
La lingua in cui tradurre il contenuto. Deve essere in minuscolo.Valori consentiti (70+): afrikaans, albanian, amharic, arabic, armenian, assamese, azerbaijani, basque, belarusian, bengali, bosnian, bulgarian, catalan, croatian, czech, danish, dutch, english, british english, estonian, finnish, french, french canadian, galician, german, greek, gujarati, hebrew, hindi, hungarian, icelandic, indonesian, irish, italian, japanese, kannada, kazakh, khmer, korean, lao, latvian, lithuanian, macedonian, malay, malayalam, mandarin, marathi, mongolian, nepali, norwegian, persian, polish, portuguese, brazilian portuguese, punjabi, romanian, russian, serbian, slovak, slovenian, spanish, swahili, swedish, tagalog, tamil, telugu, thai, turkish, ukrainian, urdu, vietnamese, welsh, yoruba, zulu
string
La lingua di origine del contenuto utilizzando i codici lingua ISO (es. en, es, fr, de, ja, zh).
Fortemente consigliato: lasciare vuoto per il rilevamento automatico.Fornisci questo parametro solo se sei sicuro al 100% che il codice lingua sia corretto e nel formato ISO valido. Codici lingua errati causeranno errori di trascrizione. Il nostro rilevamento automatico supporta oltre 80 lingue ed è altamente accurato.
Predefinito: auto-detect
string
Un nome personalizzato per il progetto. Utile per identificare i progetti nella tua dashboard.Predefinito: Se non fornito, verrà utilizzato l’ID progetto.
string
Un endpoint https che riceve gli eventi webhook per questo progetto, sovrascrivendo l’endpoint configurato sul tuo account.Predefinito: L’endpoint webhook dell’account, quando configurato.
string
auto-detect o un numero intero da 1 a 32. Un numero noto di parlanti può migliorare la diarizzazione.Predefinito: auto-detect
string
Un array di stringhe JSON di nomi, marchi, acronimi o termini specialistici specifici della richiesta. Questi termini vengono uniti al glossario salvato dell’account o del team.
boolean
Rimuovi le comuni parole riempitive dalla trascrizione di origine prima della traduzione.Predefinito: true
string
Una trascrizione SRT in lingua originale esistente. originalLanguage deve essere esplicito quando viene fornito questo campo.
boolean
Indica se preservare l’audio di sottofondo nell’output.Se abilitato, mantiene la musica di sottofondo, l’ambiente, le risate, gli applausi e i suoni della folla rimuovendo solo la voce originale (separazione delle tracce). Disattiva se la tua sorgente non ha audio di sottofondo.Predefinito: true
boolean
Mantieni la voce originale a basso volume sotto la voce tradotta.Predefinito: false
number
Volume della voce originale da 1 a 70 quando keepOriginalVoice è abilitato.Predefinito: 30
string
Modalità di isolamento vocale quando keepBackgroundMusic è abilitato. Controlla la qualità e le caratteristiche della separazione vocale.
La nostra elaborazione vocale predefinita, progettata per una qualità audio professionale:
  • Rimuove echi e riverberi
  • Pulisce le imperfezioni tecniche
  • Produce una voce chiara e nitida
Consigliato per: La maggior parte dei progetti in cui la qualità audio è fondamentale. Ideale per tutorial, contenuti educativi, video di marketing e qualsiasi contenuto che richieda una chiarezza vocale ottimale.
Preserva le caratteristiche naturali dell’ambiente di registrazione:
  • Mantiene un suono più vicino alla registrazione originale
  • Preserva le caratteristiche ambientali
Consigliato per: Contenuti in cui l’autenticità dell’ambiente è importante, come vlog all’aperto, documentari o contenuti in cui l’atmosfera sonora è parte integrante dell’esperienza.
Questa opzione potrebbe creare artefatti o effetti imprevisti in alcuni casi a causa della conservazione degli elementi di sottofondo.
Valori consentiti: studio, realisticPredefinito: studio
boolean
Indica se generare sottotitoli per il video tradotto.Se abilitato, aggiunge sottotitoli puliti in bianco e nero in stile Netflix. Usa subtitlesSource per scegliere il testo originale (lingua di origine) o tradotto (lingua di destinazione). I sottotitoli sono sincronizzati automaticamente per una leggibilità ottimale.Nota: I sottotitoli impressi richiedono FFmpeg con il filtro subtitles (libass). Se non disponibile, l’API ripiegherà sull’incorporamento di una traccia sottotitoli invece dello stile impresso.Predefinito: false
string
Scegli la fonte del testo dei sottotitoli quando subtitles è abilitato.Valori consentiti: translated, originalPredefinito: translatedNota: Se viene selezionato original ma la trascrizione originale non è disponibile, i sottotitoli ripiegheranno su translated.
string
Avvia l’elaborazione della sincronizzazione labiale al termine della traduzione.
  • standard = Lip Sync
  • pro = Lip Sync Pro
  • studio = Lip Sync Studio
Le modalità premium applicano i requisiti standard di piano, durata e crediti.Predefinito: omettere il campo per saltare la sincronizzazione labiale.
boolean
Abilita il rilevamento del parlante attivo per l’esecuzione della sincronizzazione labiale richiesta.Predefinito: false
boolean
Selettore di sincronizzazione labiale legacy mantenuto per compatibilità con le versioni precedenti.
  • false = Sincronizzazione labiale standard (4 minuti di crediti per 1 minuto di video)
  • true = Lip Sync Pro (9 minuti di crediti per 1 minuto di video)
Lip Sync Pro è disponibile a partire dal piano Creator.
Durata massima: 30 minuti per video.Latenza: L’elaborazione della sincronizzazione labiale aggiunge solitamente 2x-4x la durata del video originale.
Le email di completamento e fallimento della sincronizzazione labiale non vengono inviate per le richieste attivate tramite API. Utilizza l’endpoint di stato per monitorare l’avanzamento.
Predefinito: non abilitato (omettere il campo per saltare la sincronizzazione labiale)Form-data: Invia i valori booleani come stringhe true o false (es. -F "lipsyncPro=false").
Non combinare lipsyncPro con un lipSyncMode in conflitto.
string
Strategia vocale: cloning o custom.Predefinito: cloning
string
Obbligatorio quando voiceMode è custom. La voce deve appartenere al proprietario effettivo del progetto. Gli ID vocali arbitrari o non posseduti vengono rifiutati.
object
Ottimizza i parametri di clonazione vocale per un controllo avanzato sulla voce generata. Passa come stringa JSON quando utilizzi form-data. Tutti i valori devono essere compresi tra 0 e 1 (con incrementi di 0,01).
Queste impostazioni si applicano solo quando voiceMode è cloning.
Valori predefiniti (bilanciati):
Consigliato per evitare la riproduzione dell’accento:
string
Un array JSON di intervalli di tempo sorgente che dovrebbero rimanere nella lingua originale.
I salti temporali richiedono un input video e keepBackgroundMusic=true. Non possono essere combinati con keepOriginalVoice e non possono sovrapporsi ai segmenti di trascrizione.

Risposta

boolean
obbligatorio
Sempre true per le richieste riuscite
string
obbligatorio
Un messaggio leggibile dall’utente che descrive il risultato
string
obbligatorio
L’identificativo univoco per il progetto di traduzione creato. Usa questo ID per controllare lo stato.
number
obbligatorio
Stima approssimativa dell’elaborazione in minuti. La stima attuale è di cinque minuti di elaborazione per ogni minuto di file multimediale sorgente avviato.

Esempi

Le regole del glossario salvate e le istruzioni di traduzione personalizzate dell’account o del team effettivo vengono applicate automaticamente.

Esempio di risposta

Errori