Skip to main content
번역 시작

번역 시작

비디오 또는 오디오 파일을 업로드하여 새로운 번역 프로젝트를 생성하세요. 번역 프로세스는 백그라운드에서 비동기적으로 실행됩니다. 진행 상황을 추적하고 결과를 검색하려면 상태 엔드포인트을 사용하세요. 번역된 버전 기록이나 립싱크 기록이 필요할 때는 프로젝트 세부 정보 가져오기을 사용하세요.

동시성 제한

계정당 최대 10개의 번역을 동시에 실행할 수 있습니다. 이미 10개의 번역이 진행 중인 경우, 새로운 요청은 CONCURRENT_TRANSLATION_LIMIT_REACHED (HTTP 429)을 반환합니다.

요청

이 엔드포인트는 파일 업로드와 함께 multipart/form-data을 허용합니다.

헤더

string
필수
귀하의 VoiceCheap API 키입니다. app.voicecheap.ai/page-api에서 키를 발급받으세요.

본문 매개변수

file
필수
번역할 비디오 또는 오디오 파일입니다.지원되는 비디오 형식: video/mp4, video/quicktime, video/x-matroska, video/webm, video/mpeg지원되는 오디오 형식: audio/mpeg, audio/wav, audio/mp4, audio/x-m4a, audio/flac, audio/ogg, audio/aac, audio/webm플랜별 최대 파일 크기: Beginner 5 GB, Starter 10 GB, Creator 20 GB, Pro 30 GB, Scale 40 GB, Enterprise 60 GB.
string
필수
콘텐츠를 번역할 언어입니다. 소문자로 입력해야 합니다.허용되는 값 (70개 이상): afrikaans, albanian, amharic, arabic, armenian, assamese, azerbaijani, basque, belarusian, bengali, bosnian, bulgarian, catalan, croatian, czech, danish, dutch, english, british english, estonian, finnish, french, french canadian, galician, german, greek, gujarati, hebrew, hindi, hungarian, icelandic, indonesian, irish, italian, japanese, kannada, kazakh, khmer, korean, lao, latvian, lithuanian, macedonian, malay, malayalam, mandarin, marathi, mongolian, nepali, norwegian, persian, polish, portuguese, brazilian portuguese, punjabi, romanian, russian, serbian, slovak, slovenian, spanish, swahili, swedish, tagalog, tamil, telugu, thai, turkish, ukrainian, urdu, vietnamese, welsh, yoruba, zulu
string
ISO 언어 코드를 사용하는 콘텐츠의 원본 언어입니다 (예: en, es, fr, de, ja, zh).
강력 권장: 자동 감지를 위해 이 항목을 비워 두세요.언어 코드가 정확하고 유효한 ISO 형식임을 100% 확신하는 경우에만 이 매개변수를 제공하세요. 잘못된 언어 코드는 전사 실패를 유발합니다. 당사의 자동 감지는 80개 이상의 언어를 지원하며 매우 정확합니다.
기본값: auto-detect
string
프로젝트의 사용자 지정 이름입니다. 대시보드에서 프로젝트를 식별하는 데 유용합니다.기본값: 제공되지 않으면 프로젝트 ID가 사용됩니다.
string
이 프로젝트에 대한 웹훅 이벤트을 수신하는 https 엔드포인트이며, 계정에 구성된 엔드포인트를 재정의합니다.기본값: 구성된 경우 계정 웹훅 엔드포인트가 사용됩니다.
string
auto-detect 또는 1에서 32 사이의 정수입니다. 화자 수를 알고 있으면 화자 분리(diarization) 성능이 향상될 수 있습니다.기본값: auto-detect
string
요청별 이름, 브랜드, 약어 또는 전문 용어의 JSON 문자열 배열입니다. 이러한 용어는 저장된 계정 또는 팀 용어집과 병합됩니다.
boolean
번역 전 원본 전사에서 일반적인 추임새 단어를 제거합니다.기본값: true
string
기존 원본 언어 SRT 전사 파일입니다. 이 필드가 제공될 때 originalLanguage을 명시해야 합니다.
boolean
출력물에서 배경 오디오를 보존할지 여부입니다.활성화하면 원본 음성만 제거(스템 분리)하면서 배경 음악, 주변 소음, 웃음소리, 박수 소리 및 군중 소리를 유지합니다. 원본에 배경 오디오가 없는 경우 끄십시오.기본값: true
boolean
번역된 음성 아래에 원본 화자의 목소리를 작게 유지합니다.기본값: false
number
keepOriginalVoice가 활성화된 경우 1에서 70까지의 원본 음성 볼륨입니다.기본값: 30
string
keepBackgroundMusic이 활성화된 경우의 음성 분리 모드입니다. 음성 분리의 품질과 특성을 제어합니다.
전문적인 오디오 품질을 위해 설계된 기본 음성 처리 방식입니다:
  • 에코 및 잔향 제거
  • 기술적 결함 정리
  • 맑고 선명한 음성 생성
권장 대상: 오디오 품질이 가장 중요한 대부분의 프로젝트. 튜토리얼, 교육 콘텐츠, 마케팅 비디오 및 최적의 음성 선명도가 필요한 모든 콘텐츠에 이상적입니다.
녹음 환경의 자연스러운 특성을 보존합니다:
  • 원본 녹음과 더 가까운 사운드 유지
  • 환경적 특성 보존
권장 대상: 야외 브이로그, 다큐멘터리 또는 사운드 분위기가 경험의 필수적인 부분인 콘텐츠와 같이 환경의 진정성이 중요한 콘텐츠.
이 옵션은 배경 요소를 보존하기 때문에 경우에 따라 아티팩트나 예상치 못한 효과가 발생할 수 있습니다.
허용되는 값: studio, realistic기본값: studio
boolean
번역된 비디오에 자막을 생성할지 여부입니다.활성화하면 깔끔한 넷플릭스 스타일의 흑백 자막이 추가됩니다. subtitlesSource을 사용하여 원본(원본 언어) 또는 번역된(대상 언어) 텍스트를 선택하세요. 자막은 최적의 가독성을 위해 자동으로 동기화됩니다.참고: 번인(Burned-in) 자막을 사용하려면 subtitles 필터(libass)가 포함된 FFmpeg이 필요합니다. 사용할 수 없는 경우 API는 하드 번인 스타일 대신 자막 트랙을 삽입하는 방식으로 대체됩니다.기본값: false
string
subtitles이 활성화된 경우 자막 텍스트 소스를 선택합니다.허용된 값: translated, original기본값: translated참고: original이 선택되었으나 원본 전사가 제공되지 않는 경우, 자막은 translated로 대체됩니다.
string
번역 완료 후 립싱크 처리를 트리거합니다.
  • standard = Lip Sync
  • pro = Lip Sync Pro
  • studio = Lip Sync Studio
프리미엄 모드는 일반적인 플랜, 기간 및 크레딧 요구 사항을 적용합니다.기본값: 립싱크를 건너뛰려면 필드를 생략하십시오.
boolean
요청된 립싱크 실행에 대해 활성 화자 감지를 활성화합니다.기본값: false
boolean
이전 버전과의 호환성을 위해 유지되는 레거시 립싱크 선택기입니다.
  • false = 표준 립싱크 (비디오 1분당 4분 크레딧)
  • true = Lip Sync Pro (비디오 1분당 9분 크레딧)
Lip Sync Pro은 Creator 플랜부터 사용할 수 있습니다.
최대 지속 시간: 비디오당 30분.지연 시간: 립싱크 처리는 일반적으로 원본 비디오 지속 시간의 2배~4배가 추가됩니다.
API로 트리거된 요청에 대해서는 립싱크 완료 및 실패 이메일이 발송되지 않습니다. 상태 엔드포인트을 사용하여 진행 상황을 추적하십시오.
기본값: 활성화되지 않음 (립싱크를 건너뛰려면 필드를 생략하십시오)Form-data: 불리언 값을 true 또는 false 문자열로 보냅니다 (예: -F "lipsyncPro=false").
lipsyncPro을 충돌하는 lipSyncMode과 결합하지 마십시오.
string
음성 전략: cloning 또는 custom.기본값: cloning
string
voiceModecustom일 때 필수입니다. 음성은 유효한 프로젝트 소유자의 것이어야 합니다. 임의의 음성 ID나 소유자가 없는 음성 ID는 거부됩니다.
object
생성된 음성을 고급 제어하기 위해 음성 복제 매개변수를 미세 조정합니다. form-data 사용 시 JSON 문자열로 전달하십시오. 모든 값은 0에서 1 사이여야 합니다 (0.01 단위).
이 설정은 voiceModecloning일 때만 적용됩니다.
기본값 (균형 잡힘):
억양 재현 방지를 위해 권장됨:
string
원본 언어로 유지되어야 하는 소스 시간 범위의 JSON 배열입니다.
시간 건너뛰기에는 비디오 입력과 keepBackgroundMusic=true이 필요합니다. 이는 keepOriginalVoice과 결합할 수 없으며 전사 세그먼트와 겹칠 수 없습니다.

응답

boolean
필수
성공적인 요청의 경우 항상 true
string
필수
결과를 설명하는 사람이 읽을 수 있는 메시지
string
필수
생성된 더빙 프로젝트의 고유 식별자입니다. 이 ID를 사용하여 상태를 확인하세요.
number
필수
분 단위의 대략적인 처리 예상 시간입니다. 현재 예상 처리 시간은 소스 미디어 1분당 5분입니다.

예시

유효한 계정 또는 팀의 저장된 용어집 규칙 및 맞춤 더빙 지침이 자동으로 적용됩니다.

응답 예시

오류