Skip to main content
Übersetzung starten

Übersetzung starten

Erstellen Sie ein neues Übersetzungsprojekt durch Hochladen einer Video- oder Audiodatei. Der Übersetzungsprozess läuft asynchron im Hintergrund. Verwenden Sie den Status-Endpunkt, um den Fortschritt zu verfolgen und Ergebnisse abzurufen. Verwenden Sie Projektdetails abrufen, wenn Sie eine übersetzte Versionshistorie oder Lippensynchronisationshistorie benötigen.

Gleichzeitige Ausführungsgrenze

Sie können bis zu 10 Übersetzungen gleichzeitig pro Konto ausführen. Wenn bereits 10 Übersetzungen laufen, geben neue Anfragen CONCURRENT_TRANSLATION_LIMIT_REACHED (HTTP 429) zurück.

Anfrage

Dieser Endpunkt akzeptiert multipart/form-data mit einem Datei-Upload.
string
erforderlich
Ihr VoiceCheap API-Schlüssel. Erhalten Sie einen von app.voicecheap.ai/page-api.

Body-Parameter

file
erforderlich
Die zu übersetzende Video- oder Audiodatei.Unterstützte Videoformate: video/mp4, video/quicktime, video/x-matroska, video/webm, video/mpegUnterstützte Audioformate: audio/mpeg, audio/wav, audio/mp4, audio/x-m4a, audio/flac, audio/ogg, audio/aac, audio/webmMaximale Dateigröße nach Plan: Beginner 5 GB, Starter 10 GB, Creator 20 GB, Pro 30 GB, Scale 40 GB und Enterprise 60 GB.
string
erforderlich
Die Sprache, in die der Inhalt übersetzt werden soll. Muss kleingeschrieben sein.Zulässige Werte (70+): afrikaans, albanian, amharic, arabic, armenian, assamese, azerbaijani, basque, belarusian, bengali, bosnian, bulgarian, catalan, croatian, czech, danish, dutch, english, british english, estonian, finnish, french, french canadian, galician, german, greek, gujarati, hebrew, hindi, hungarian, icelandic, indonesian, irish, italian, japanese, kannada, kazakh, khmer, korean, lao, latvian, lithuanian, macedonian, malay, malayalam, mandarin, marathi, mongolian, nepali, norwegian, persian, polish, portuguese, brazilian portuguese, punjabi, romanian, russian, serbian, slovak, slovenian, spanish, swahili, swedish, tagalog, tamil, telugu, thai, turkish, ukrainian, urdu, vietnamese, welsh, yoruba, zulu
string
Die Quellsprache des Inhalts unter Verwendung von ISO-Sprachcodes (z. B. en, es, fr, de, ja, zh).
Dringend empfohlen: Lassen Sie dies für die automatische Erkennung leer.Geben Sie diesen Parameter nur an, wenn Sie zu 100 % sicher sind, dass der Sprachcode korrekt ist und im gültigen ISO-Format vorliegt. Falsche Sprachcodes führen zu Transkriptionsfehlern. Unsere automatische Erkennung unterstützt über 80 Sprachen und ist hochpräzise.
Standard: auto-detect
string
Ein benutzerdefinierter Name für das Projekt. Nützlich zur Identifizierung von Projekten in Ihrem Dashboard.Standard: Die Projekt-ID wird verwendet, falls keine Angabe gemacht wird.
string
Ein https-Endpunkt, der die Webhook-Ereignisse für dieses Projekt empfängt, und den für Ihr Konto konfigurierten Endpunkt überschreibt.Standard: Der Webhook-Endpunkt des Kontos, sofern einer konfiguriert ist.
string
auto-detect oder eine Ganzzahl von 1 bis 32. Eine bekannte Sprecheranzahl kann die Diarisierung verbessern.Standard: auto-detect
string
Ein JSON-String-Array von anfragespezifischen Namen, Marken, Akronymen oder Fachbegriffen. Diese Begriffe werden mit dem gespeicherten Konto- oder Team-Glossar zusammengeführt.
boolean
Entfernen Sie häufige Füllwörter aus dem Quelltranskript vor der Übersetzung.Standard: true
string
Ein vorhandenes SRT-Transkript in der Quellsprache. originalLanguage muss explizit angegeben werden, wenn dieses Feld bereitgestellt wird.
boolean
Ob das Hintergrundaudio in der Ausgabe beibehalten werden soll.Wenn aktiviert, bleiben Hintergrundmusik, Umgebungsgeräusche, Lachen, Klatschen und Publikumsgeräusche erhalten, während nur die Originalstimme entfernt wird (Stems-Trennung). Deaktivieren Sie dies, wenn Ihre Quelle kein Hintergrundaudio enthält.Standard: true
boolean
Behalten Sie den ursprünglichen Sprecher leise unter der übersetzten Stimme bei.Standard: false
number
Lautstärke der Originalstimme von 1 bis 70, wenn keepOriginalVoice aktiviert ist.Standard: 30
string
Stimmisolationsmodus, wenn keepBackgroundMusic aktiviert ist. Steuert die Qualität und Eigenschaften der Stimmtrennung.
Unsere Standard-Stimmverarbeitung, entwickelt für professionelle Audioqualität:
  • Entfernt Echos und Nachhall
  • Bereinigt technische Unvollkommenheiten
  • Erzeugt eine klare und deutliche Stimme
Empfohlen für: Die meisten Projekte, bei denen Audioqualität oberste Priorität hat. Ideal für Tutorials, Bildungsinhalte, Marketingvideos und alle Inhalte, die eine optimale Stimmklarheit erfordern.
Bewahrt die natürlichen Eigenschaften der Aufnahmeumgebung:
  • Behält einen Klang bei, der der Originalaufnahme näher kommt
  • Bewahrt Umgebungseigenschaften
Empfohlen für: Inhalte, bei denen die Authentizität der Umgebung wichtig ist, wie z. B. Outdoor-Vlogs, Dokumentationen oder Inhalte, bei denen das Klangambiente ein wesentlicher Bestandteil des Erlebnisses ist.
Diese Option kann in einigen Fällen aufgrund der Bewahrung von Hintergrundelementen Artefakte oder unerwartete Effekte erzeugen.
Zulässige Werte: studio, realisticStandard: studio
boolean
Ob Untertitel für das übersetzte Video generiert werden sollen.Wenn aktiviert, werden saubere Untertitel im Netflix-Stil in Schwarz-Weiß hinzugefügt. Verwenden Sie subtitlesSource, um zwischen Originaltext (Quellsprache) oder übersetztem Text (Zielsprache) zu wählen. Untertitel werden automatisch für optimale Lesbarkeit synchronisiert.Hinweis: Eingebrannte Untertitel erfordern FFmpeg mit dem subtitles-Filter (libass). Falls nicht verfügbar, greift die API stattdessen auf das Einbetten einer Untertitelspur zurück, anstatt ein fest eingebranntes Styling zu verwenden.Standard: false
string
Wählen Sie die Untertitel-Textquelle, wenn subtitles aktiviert ist.Zulässige Werte: translated, originalStandard: translatedHinweis: Wenn original ausgewählt ist, aber die ursprüngliche Transkription nicht verfügbar ist, greifen die Untertitel auf translated zurück.
string
Löst die Lippensynchronisation-Verarbeitung nach Abschluss der Synchronisation aus.
  • standard = Lip Sync
  • pro = Lip Sync Pro
  • studio = Lip Sync Studio
Premium-Modi erzwingen ihre normalen Plan-, Dauer- und Guthabenanforderungen.Standard: Lassen Sie das Feld weg, um die Lippensynchronisation zu überspringen.
boolean
Aktivieren Sie die Erkennung aktiver Sprecher für den angeforderten Lippensynchronisation-Durchlauf.Standard: false
boolean
Legacy-Lippensynchronisation-Auswahl für Abwärtskompatibilität beibehalten.
  • false = Standard-Lippensynchronisation (4 Minuten Guthaben pro 1 Minute Video)
  • true = Lip Sync Pro (9 Minuten Guthaben pro 1 Minute Video)
Lip Sync Pro ist ab dem Creator-Plan verfügbar.
Maximale Dauer: 30 Minuten pro Video.Latenz: Die Lippensynchronisation-Verarbeitung fügt normalerweise das 2- bis 4-fache der ursprünglichen Videodauer hinzu.
E-Mails zum Abschluss oder Fehler der Lippensynchronisation werden für API-ausgelöste Anfragen nicht gesendet. Verwenden Sie den Status-Endpunkt, um den Fortschritt zu verfolgen.
Standard: nicht aktiviert (lassen Sie das Feld weg, um die Lippensynchronisation zu überspringen)Form-data: Senden Sie boolesche Werte als true- oder false-Strings (z. B. -F "lipsyncPro=false").
Kombinieren Sie lipsyncPro nicht mit einem widersprüchlichen lipSyncMode.
string
Sprachstrategie: cloning oder custom.Standard: cloning
string
Erforderlich, wenn voiceMode auf custom gesetzt ist. Die Stimme muss dem effektiven Projektinhaber gehören. Beliebige oder nicht zugeordnete Sprach-IDs werden abgelehnt.
object
Feinabstimmung der Parameter für das Stimmklonen für eine erweiterte Kontrolle über die generierte Stimme. Übergeben Sie dies als JSON-String bei Verwendung von form-data. Alle Werte müssen zwischen 0 und 1 liegen (mit einer Schrittweite von 0,01).
Diese Einstellungen gelten nur, wenn voiceMode auf cloning gesetzt ist.
Standardwerte (ausgewogen):
Empfohlen zur Vermeidung der Wiedergabe von Akzenten:
string
Ein JSON-Array von Quellzeitbereichen, die in der Originalsprache verbleiben sollten.
Zeitübersprünge erfordern Videoeingabe und keepBackgroundMusic=true. Sie können nicht mit keepOriginalVoice kombiniert werden und dürfen sich nicht mit Transkriptsegmenten überschneiden.

Antwort

boolean
erforderlich
Immer true bei erfolgreichen Anfragen
string
erforderlich
Eine für Menschen lesbare Nachricht, die das Ergebnis beschreibt
string
erforderlich
Die eindeutige Kennung für das erstellte Synchronisationsprojekt. Verwenden Sie diese ID, um den Status zu überprüfen.
number
erforderlich
Grobe Verarbeitungsschätzung in Minuten. Die aktuelle Schätzung liegt bei fünf Minuten Verarbeitungszeit pro begonnener Minute Quellmedium.

Beispiele

Gespeicherte Glossar-Regeln und benutzerdefinierte Synchronisationsanweisungen des aktiven Kontos oder Teams werden automatisch angewendet.

Antwortbeispiel

Fehler