Skip to main content
Medien transkribieren

Medien transkribieren

Laden Sie eine Audio- oder Videodatei hoch und erhalten Sie direkt das Transkript. Dieser eigenständige Endpunkt erstellt kein Synchronisationsprojekt. Der Endpunkt akzeptiert Dateien bis zu 200 MB und 2 Stunden. Er verwendet dieselben API-Schlüssel-Zugriffsregeln wie die Übersetzungs-API. Erfolgreiche Anfragen geben HTTP 200 zurück.

Anfrage

Senden Sie multipart/form-data mit den folgenden Feldern.
string
erforderlich
Ihr VoiceCheap API-Schlüssel.
file
erforderlich
Die zu transkribierende Audio- oder Videodatei. Unterstützte Formate sind MP4, MOV, MKV, WebM, MPEG, MP3, WAV, M4A, FLAC, OGG und AAC.
string
Standard:"json"
Antwortformat: json, srt oder vtt.
string
Standard:"auto-detect"
Unterstützter ISO-Code der Quellsprache. Lassen Sie dies als auto-detect, es sei denn, Sie kennen die Quellsprache. Nicht unterstützte explizite Sprachen führen vor Beginn der Verarbeitung zu einem Validierungsfehler.
string
Standard:"auto-detect"
auto-detect oder eine Ganzzahl von 1 bis 32.
string
Ein JSON-String-Array von Namen, Marken, Akronymen oder Fachbegriffen zur Erkennung. Anfrageterme werden mit dem gespeicherten Konto- oder Team-Glossar zusammengeführt.
boolean
Standard:"true"
Entfernen Sie häufige Füllwörter aus dem Transkript.
boolean
Standard:"false"
Stellen Sie SRT-Cues Speaker N: voran oder fügen Sie VTT-Sprach-Tags hinzu. JSON enthält immer den numerischen Sprecher für jedes Segment und jedes Wort.

JSON-Antwort

JSON ist die vollständigste Ausgabe. Sie enthält den vollständigen Text, die Sprachkonfidenz, die Mediendauer, Sprecher, zeitgestempelte Segmente und zeitgestempelte Wörter.

Beispiele

Fehler