Skip to main content
翻訳を開始

翻訳を開始

ビデオまたはオーディオファイルをアップロードして、新しい翻訳プロジェクトを作成します。翻訳プロセスはバックグラウンドで非同期に実行されます。進捗状況の追跡と結果の取得には ステータスエンドポイント を使用してください。翻訳されたバージョン履歴やリップシンク履歴が必要な場合は、プロジェクト詳細を取得 を使用してください。

同時実行制限

アカウントごとに最大10個の翻訳を同時に実行できます。すでに10個の翻訳が進行中の場合、新しいリクエストは CONCURRENT_TRANSLATION_LIMIT_REACHED (HTTP 429) を返します。

リクエスト

このエンドポイントは、ファイルアップロードを伴う multipart/form-data を受け付けます。

ヘッダー

string
必須
VoiceCheap APIキー。app.voicecheap.ai/page-apiから取得してください。

ボディパラメータ

file
必須
翻訳対象の動画または音声ファイル。サポートされている動画形式: video/mp4video/quicktimevideo/x-matroskavideo/webmvideo/mpegサポートされている音声形式: audio/mpegaudio/wavaudio/mp4audio/x-m4aaudio/flacaudio/oggaudio/aacaudio/webmプランごとの最大ファイルサイズ: Beginner 5 GB、Starter 10 GB、Creator 20 GB、Pro 30 GB、Scale 40 GB、Enterprise 60 GB。
string
必須
コンテンツの翻訳先言語。小文字である必要があります。許可される値 (70以上): afrikaansalbanianamharicarabicarmenianassameseazerbaijanibasquebelarusianbengalibosnianbulgariancatalancroatianczechdanishdutchenglishbritish englishestonianfinnishfrenchfrench canadiangaliciangermangreekgujaratihebrewhindihungarianicelandicindonesianirishitalianjapanesekannadakazakhkhmerkoreanlaolatvianlithuanianmacedonianmalaymalayalammandarinmarathimongoliannepalinorwegianpersianpolishportuguesebrazilian portuguesepunjabiromanianrussianserbianslovakslovenianspanishswahiliswedishtagalogtamilteluguthaiturkishukrainianurduvietnamesewelshyorubazulu
string
ISO言語コードを使用したコンテンツのソース言語(例: enesfrdejazh)。
強く推奨: 自動検出を行う場合は、この項目を空のままにしてください。このパラメータは、言語コードが正しいこと、および有効なISO形式であることを100%確信している場合にのみ指定してください。誤った言語コードを指定すると、文字起こしが失敗します。当社の自動検出機能は80以上の言語に対応しており、非常に高精度です。
デフォルト: auto-detect
string
プロジェクトのカスタム名。ダッシュボードでプロジェクトを識別するのに便利です。デフォルト: 指定がない場合はプロジェクトIDが使用されます。
string
このプロジェクトのwebhookイベントを受信するhttpsエンドポイント。 アカウントに設定されたエンドポイントを上書きします。デフォルト: 設定されている場合は、アカウントのwebhookエンドポイント。
string
auto-detect、または1から32までの整数。話者数が判明している場合、話者分離(ダイアライゼーション)の精度が向上します。デフォルト: auto-detect
string
リクエスト固有の名前、ブランド、頭字語、専門用語のJSON文字列配列。これらの用語は、保存されたアカウントまたはチームの用語集と統合されます。
boolean
翻訳前に、ソースの文字起こしから一般的なフィラーワード(言い淀み)を削除します。デフォルト: true
string
既存のソース言語のSRT文字起こしファイル。このフィールドを指定する場合、originalLanguageを明示する必要があります。
boolean
出力に背景音声を保持するかどうか。有効にすると、元の音声のみを削除(ステム分離)し、背景音楽、環境音、笑い声、拍手、群衆の音を保持します。ソースに背景音声がない場合はオフにしてください。デフォルト: true
boolean
翻訳された音声の下で、元の話者の音声を小さく保持します。デフォルト: false
number
keepOriginalVoiceが有効な場合の、1から70までの元の音声の音量。デフォルト: 30
string
keepBackgroundMusicが有効な場合の音声分離モード。音声分離の品質と特性を制御します。
プロフェッショナルな音質のために設計された、当社のデフォルトの音声処理:
  • エコーや残響を除去
  • 技術的な不完全さをクリーンアップ
  • 明瞭で鮮明な音声を生成
推奨用途: 音質が最優先されるほとんどのプロジェクト。チュートリアル、教育コンテンツ、マーケティング動画、および最適な音声の明瞭さが求められるあらゆるコンテンツに最適です。
録音環境の自然な特性を保持します:
  • 元の録音に近い音を維持
  • 環境特性を保持
推奨用途: 屋外のVlog、ドキュメンタリー、または音の雰囲気が体験の不可欠な要素であるコンテンツなど、環境の真正性が重要なコンテンツ。
このオプションは、背景要素を保持するため、場合によってはアーティファクトや予期しない影響が生じることがあります。
許可される値: studiorealisticデフォルト: studio
boolean
翻訳された動画の字幕を生成するかどうか。有効にすると、Netflixスタイルのクリーンな白黒字幕が追加されます。subtitlesSourceを使用して、オリジナル(ソース言語)または翻訳済み(ターゲット言語)のテキストを選択してください。字幕は最適な読みやすさのために自動的に同期されます。注: 字幕の焼き込みには、subtitlesフィルタ(libass)を備えたFFmpegが必要です。利用できない場合、APIはハード焼き込みスタイルの代わりに字幕トラックを埋め込む方式にフォールバックします。デフォルト: false
string
subtitlesが有効な場合に、字幕テキストのソースを選択します。許可される値: translated, originalデフォルト: translated注: originalが選択されているにもかかわらず元の文字起こしが利用できない場合、字幕はtranslatedにフォールバックします。
string
翻訳完了後にリップシンク処理をトリガーします。
  • standard = Lip Sync
  • pro = Lip Sync Pro
  • studio = Lip Sync Studio
プレミアムモードでは、通常のプラン、期間、およびクレジット要件が適用されます。デフォルト: フィールドを省略するとリップシンクをスキップします。
boolean
リクエストされたリップシンク実行に対して、アクティブスピーカー検出を有効にします。デフォルト: false
boolean
下位互換性のために保持されているレガシーリップシンクセレクターです。
  • false = 標準リップシンク (動画1分あたり4分のクレジット)
  • true = Lip Sync Pro (動画1分あたり9分のクレジット)
Lip Sync ProはCreatorプランから利用可能です。
最大期間: 動画1本あたり30分。レイテンシ: リップシンク処理は通常、元の動画時間の2倍〜4倍の時間を要します。
API経由のリクエストでは、リップシンクの完了および失敗のメールは送信されません。ステータスエンドポイントを使用して 進捗状況を追跡してください。
デフォルト: 無効(フィールドを省略するとリップシンクをスキップします)フォームデータ: ブール値はtrueまたはfalseの文字列として送信してください(例: -F "lipsyncPro=false")。
lipsyncProと競合するlipSyncModeを組み合わせないでください。
string
音声戦略: cloningまたはcustomデフォルト: cloning
string
voiceModecustomの場合に必須です。音声は有効なプロジェクト所有者に属している必要があります。任意の音声IDや所有されていない音声IDは拒否されます。
object
生成される音声の詳細な制御のために、音声クローニングのパラメータを微調整します。フォームデータを使用する場合はJSON文字列として渡してください。すべての値は0から1の間である必要があります(0.01刻み)。
これらの設定は、voiceModecloningの場合にのみ適用されます。
デフォルト値 (バランス型):
アクセントの再現を避けるために推奨:
string
元の言語のままにするソース時間範囲のJSON配列。
タイムスキップには動画入力とkeepBackgroundMusic=trueが必要です。これらはkeepOriginalVoiceと組み合わせることはできず、文字起こしセグメントと重複させることもできません。

レスポンス

boolean
必須
リクエストが成功した場合は常にtrue
string
必須
結果を説明する人間が読める形式のメッセージ
string
必須
作成された吹き替えプロジェクトの一意の識別子。このIDを使用してステータスを確認してください。
number
必須
分単位での概算処理時間。現在の見積もりでは、ソースメディアの開始1分あたり5分の処理時間がかかります。

有効なアカウントまたはチームに保存されている用語集ルールとカスタム翻訳指示が自動的に適用されます。

レスポンス例

エラー