直答:VMEG 配音的核心是「语音克隆」——先学习原说话人的音色,再用目标语言重新演绎,观众听到的还是同一个人在说话。操作只比普通翻译多一步:在任务确认页勾选克隆原声。标准配音包含在 60 积分/分钟的翻译费用内,不单独加价。
第 1 步:上传后进入语音设置
按视频翻译教程完成上传与语言选择后,进入语音设置区。这里有两条路:克隆原声(推荐真人出镜内容)或选用预置音色(适合旁白、口播量产)。
第 2 步:多说话人视频的音色对应
访谈、对话类视频勾选多说话人检测后,VMEG 会把每位说话人分离出来、逐一克隆并对应到译文的相应段落,不会出现「两个人一个声」的错乱。上传前尽量用人声清晰、背景音乐低的版本,分离效果更好。
上图是一条韩语美妆视频输出泰语配音的实拍界面:克隆标识亮起,语速与情绪跟随原片。
第 3 步:不克隆时怎么挑音色
预置音色库有 17,000+ 条,按语言、性别、年龄与风格筛选。口播带货选「明亮/快节奏」类,课程讲解选「沉稳/清晰」类;先用 1 分钟片段试听,确定后再批量。
第 4 步:导出前试听关键句
在预览里重点听三类位置:开场句、数字与价格(例如 $25 这类金额)、专有名词。发现译法不对,在编辑器里改词后重新合成——已购视频不重复扣积分。
翻车点排查
- 克隆声音发闷:多为原片人声与配乐混在同轨,换用人声更干净的素材。
- 情绪太平:切换到同语言的另一条克隆采样,或改用预置音色对比。
- 口型对不上:这是口型同步功能的领域,见口型同步教程。