Skip to main content
メディアの文字起こし

メディアの文字起こし

オーディオまたはビデオファイルをアップロードして、そのトランスクリプトを直接受け取ります。このスタンドアロンエンドポイントは、吹き替えプロジェクトを作成しません。 このエンドポイントは、最大200 MBかつ2時間までのファイルを受け付けます。翻訳APIと同じAPIキーアクセスルールを使用します。 リクエストが成功すると、HTTP 200 が返されます。

リクエスト

以下のフィールドを含む multipart/form-data を送信します。
string
必須
お客様の VoiceCheap APIキー。
file
必須
文字起こしするオーディオまたはビデオファイル。サポートされている形式は、MP4、MOV、MKV、WebM、MPEG、MP3、WAV、M4A、FLAC、OGG、およびAACです。
string
デフォルト:"json"
レスポンス形式: jsonsrt、または vtt
string
デフォルト:"auto-detect"
サポートされているソース言語のISOコード。ソース言語が不明な場合を除き、これを auto-detect のままにしてください。サポートされていない明示的な言語を指定すると、処理開始前に検証エラーが返されます。
string
デフォルト:"auto-detect"
auto-detect または 1 から 32 までの整数。
string
認識させる名前、ブランド、頭字語、またはドメイン用語のJSON文字列配列。リクエストされた用語は、保存されたアカウントまたはチームの用語集とマージされます。
boolean
デフォルト:"true"
トランスクリプトから一般的なフィラーワードを削除します。
boolean
デフォルト:"false"
SRTキューに Speaker N: をプレフィックスとして付けるか、VTT音声タグを追加します。JSONには常に、すべてのセグメントと単語に数値のスピーカーが含まれます。

JSONレスポンス

JSONは最も完全な出力です。全文、言語の信頼度、メディアの長さ、スピーカー、タイムスタンプ付きセグメント、およびタイムスタンプ付き単語が含まれています。

エラー