上传说话视频,再粘贴翻译文字或添加配音音频,口型自动重新同步到新语言。 支持两条完整流程:输入文字并选择预置或获授权的克隆声音,或者上传/现场录制音频。输出是无水印口型同步视频;免费版支持 133 个文本码点或 20 秒音频。
你需要什么
- 源素材: 使用一位正面说话人的连续片段,并准备已经审校、朗读时长接近原片的译文。
- 语音输入: 粘贴翻译后的台词并选择/克隆声音,或上传、录制完成的配音。免费文字支持 133 字符,免费音频支持 20 秒,付费套餐会同时提升两项上限。
- 只使用你有权使用的素材与声音。: 只上传你拥有或已获授权使用的人脸、声音、音乐和脚本。
实际源素材与输入
Hola y bienvenidos. En esta breve actualización, explicaré cómo nuestro nuevo flujo de trabajo ayuda a los equipos globales a compartir mensajes de producto claros.
未经剪辑的结果
上传说话视频,再粘贴翻译文字或添加配音音频,口型自动重新同步到新语言。 支持两条完整流程:输入文字并选择预置或获授权的克隆声音,或者上传/现场录制音频。输出是无水印口型同步视频;免费版支持 133 个文本码点或 20 秒音频。
如何给视频配音并对上口型
- 上传源视频 — 支持 MP4、MOV、WebM,画面中需有一张清晰的说话人脸。原视频的语音音轨将被替换。
- 选择文字或音频 — 粘贴翻译后的台词并选择/克隆声音,或上传、录制完成的配音。免费文字支持 133 字符,免费音频支持 20 秒,付费套餐会同时提升两项上限。
- 生成 — 需要时本页会先从文字生成语音,再逐帧把说话人的嘴型同步到新语言,让配音版看起来像原生拍摄而不是后期配音。
- 对比并下载 — 在浏览器中与原片对比效果,登录后下载无水印配音视频。
文字模式与音频模式
不会。请先完成翻译,再在文字模式粘贴译文,或在音频模式提供完成的配音。本页会生成或接收新语音并重新同步嘴型,翻译质量仍由你把控。
更容易获得好结果的输入
- 从清晰人脸开始: 使用一位正面说话人的连续片段,并准备已经审校、朗读时长接近原片的译文。
- 使用干净语音: 减少音乐、回声、爆音和含混的长停顿,让表演与目标表情一致。
- 先测试短句: 受控短句更容易发现时序、闭口音和源素材问题,再决定是否生成长片段。
限制与不支持的情况
- 工具不会自动翻译或改写;多人、切镜、遮挡和过大的时长差异都会降低质量。
- 生成器只改变可见的说话动作,不会自动翻译、核查事实、添加字幕或编辑周围场景。
- 发布前仍需人工检查,尤其是涉及身份、语言或敏感语境时。
按结果计费,不按分钟计费
免费生成不扣 Pro Video,输出无水印,但仍受免费登录与分辨率规则约束。Starter 每个高清结果使用 1 个 Pro Video,不按秒或分钟扣积分;有效 Pro 订阅包含不限量 Pro Video 生成权益。
《2026 AI 视频价格报告》按 20 个 Starter 结果平均每个 1 分钟计算,有效成本约为每分钟 0.25 美元。这是用于市场比较的换算,不是 FreeLipSync 的计费单位。
版权、同意与披露
- 使用获授权的影像与声音;当观众可能误认为是真实录音时,必须披露对白已被修改。
- 只上传你拥有或已获授权使用的人脸、声音、音乐和脚本。
- 当观众可能误认为内容真实时,应清楚标注为合成或经过修改的媒体。
常见问题
AI 视频配音工具免费吗?
免费。无需账号即可用文字或音频配音,输出无水印。免费文字支持 133 字符,免费音频支持 20 秒;下载需免费登录,为低分辨率版本,可用 1 个 Pro Video 解锁原分辨率。
工具会帮我翻译视频吗?
不会。请先完成翻译,再在文字模式粘贴译文,或在音频模式提供完成的配音。本页会生成或接收新语音并重新同步嘴型,翻译质量仍由你把控。
这比普通配音画外音好在哪?
画外音会让嘴型继续按原语言动,观众一眼就能看出来。把嘴型重新同步到配音上,视频就像用目标语言原生拍摄的一样。
支持哪些文件格式?
视频支持 MP4、MOV、WebM。音频模式支持 MP3、WAV、M4A、AAC、OGG、FLAC 或浏览器录音;文字模式接受译文,并搭配预置或克隆声音。



