你的视频实际经历了什么
我们裁出前 60 秒,把说话内容转写下来,翻译,然后再把译文重新塑形,好让它落在原本的节奏里。最后这一步比多数人想的更重要:中文句子和英文原句的长度往往不同,忽略这一点的配音,几句话之内就会失去同步。
上传视频、选择语言,就能听到视频里的人用另一种语言说话。第一分钟免费,也不需要账号。
上传任意视频,从 70 多种目标语言中选一种,VoiceCheap 会用为每位识别出的说话人克隆的声音,为前 60 秒配音。不需要账号,音频上没有水印,也不需要绑卡。你会得到一个可播放的文件,可以和原声对比,并立即下载。
MP4、MOV、WebM、MP3 等 — 最大 100 MB
人名与术语
需要准确书写的人名、品牌和专业词汇。
三个步骤,无需账号,大约两分钟。
拖入任意时长的视频或音频文件。我们只保留前 60 秒。
选定配音语言,如有需要可补充需要准确书写的人名和术语。
把配音和原声对比一下,然后下载文件。
每天一次免费配音,足以回答那个真正重要的问题:我的视频在这个语言里成立吗?

上传的文件在我们裁出第一分钟后立即删除,配音结果在生成一小时后删除。克隆声音只在本次处理期间存在,结束时即被移除。任何内容都不会留作训练用途。
我们裁出前 60 秒,把说话内容转写下来,翻译,然后再把译文重新塑形,好让它落在原本的节奏里。最后这一步比多数人想的更重要:中文句子和英文原句的长度往往不同,忽略这一点的配音,几句话之内就会失去同步。
我们不让通用旁白去念译文,而是用每位说话人自己的音频建立声音,再用于他们的台词。两人对谈的视频会得到两个不同的声音,分别对应正在说话的人。
清晰的说话、同一时间只有一个人开口、背景音乐较少。响亮的音乐、人群嘈杂声或重叠的声音,会同时增加转写和声音克隆的难度。如果视频以纯音乐片头开场,上传前先剪掉,让免费的一分钟用在人声上。
试听多语言AI声音库,选择表达风格,登录后生成自然语音或克隆声音。
免费转写音视频文件。上传不超过60分钟,获取原文、段落或句子格式的转写结果。
Convert audio to text online for free. Upload MP3, WAV, M4A, or any audio file and get an accurate transcript in seconds — up to 60 minutes per file.
Convert MP3 to text online for free. Upload an MP3 file and get an accurate transcript in seconds — up to 60 minutes, no signup.
Convert speech to text online for free. Upload an audio or video recording and get accurate, editable text in seconds — up to 60 minutes.
从音频或视频中免费生成干净的 SRT 字幕文件。可立即复制或下载 SRT。
从音频或视频免费生成字幕。在视频旁预览并编辑每个字幕片段,然后下载 SRT。
在线为视频创建自动字幕。上传视频,生成字幕,调整可读性并导出结果。
Paste a public YouTube link and extract a clean transcript with timestamps for free. Copy the text or download TXT and SRT exports instantly.
通过任意公开 YouTube 视频链接生成准确的时间戳章节。免费编辑、复制并下载可直接粘贴的章节文本。
Translate SRT or VTT subtitle files online while preserving cue timing and file structure.
上传视频并立即生成字幕。免费下载 SRT 文件和带字幕的 MP4。
描述视频内容,添加最多三张照片,几分钟内生成精美的 16:9 YouTube 缩略图。

翻译你的视频并使用音频和视频工具