上传人脸视频,使用文字或音频,无需本地配置即可进入快速启动、重视准确度和嘴部细节的在线口型同步流程。 支持两条完整流程:输入文字并选择预置或获授权的克隆声音,或者上传/现场录制音频。输出是无水印口型同步视频;免费版支持 133 个文本码点或 20 秒音频。
你需要什么
- 源素材: 使用稳定近景,嘴部清晰无遮挡,并提供包含清楚辅音和停顿的干净语音。
- 语音输入: 输入替换台词并选择/克隆声音,或上传、录制语音。免费文字支持 133 字符,免费音频支持 20 秒,付费套餐会同时提升两项上限。
- 只使用你有权使用的素材与声音。: 只上传你拥有或已获授权使用的人脸、声音、音乐和脚本。
实际源素材与输入
未经剪辑的结果
上传人脸视频,使用文字或音频,无需本地配置即可进入快速启动、重视准确度和嘴部细节的在线口型同步流程。 支持两条完整流程:输入文字并选择预置或获授权的克隆声音,或者上传/现场录制音频。输出是无水印口型同步视频;免费版支持 133 个文本码点或 20 秒音频。
如何使用重视准确度的 Wav2Lip 在线流程
- 上传人脸视频 — 支持 MP4、MOV、WebM,画面中需有一张清晰人脸。正面、嘴部无遮挡的素材最适合改进引擎处理。
- 选择文字或音频 — 输入替换台词并选择/克隆声音,或上传、录制语音。免费文字支持 133 字符,免费音频支持 20 秒,付费套餐会同时提升两项上限。
- 运行在线流程 — 需要时本页会先从文字生成语音,再分析其节奏并渲染口型与人脸细节。使用已公布的对比方法时,请保持输入不变。
- 检查并下载 — 重点检查快速对白、辅音和停顿,确认后登录下载干净无水印的 MP4。
文字模式与音频模式
无需账号即可用文字或音频生成,输出无水印。免费文字支持 133 字符,免费音频支持 20 秒;下载需免费登录,为低分辨率版本,可用 1 个 Pro Video 解锁原分辨率。
更容易获得好结果的输入
- 从清晰人脸开始: 使用稳定近景,嘴部清晰无遮挡,并提供包含清楚辅音和停顿的干净语音。
- 使用干净语音: 减少音乐、回声、爆音和含混的长停顿,让表演与目标表情一致。
- 先测试短句: 受控短句更容易发现时序、闭口音和源素材问题,再决定是否生成长片段。
限制与不支持的情况
- 这是强调准确度的在线工作流,并不代表已发布的对照胜出;多人、切镜、侧脸和遮挡仍然困难。
- 生成器只改变可见的说话动作,不会自动翻译、核查事实、添加字幕或编辑周围场景。
- 发布前仍需人工检查,尤其是涉及身份、语言或敏感语境时。
按结果计费,不按分钟计费
免费生成不扣 Pro Video,输出无水印,但仍受免费登录与分辨率规则约束。Starter 每个高清结果使用 1 个 Pro Video,不按秒或分钟扣积分;有效 Pro 订阅包含不限量 Pro Video 生成权益。
《2026 AI 视频价格报告》按 20 个 Starter 结果平均每个 1 分钟计算,有效成本约为每分钟 0.25 美元。这是用于市场比较的换算,不是 FreeLipSync 的计费单位。
版权、同意与披露
- 使用获授权的视频与语音,披露合成对白,并在进行比较前查看已公布的可复现测试方法。
- 只上传你拥有或已获授权使用的人脸、声音、音乐和脚本。
- 当观众可能误认为内容真实时,应清楚标注为合成或经过修改的媒体。
常见问题
Wav2Lip 在线版是什么?
这是 FreeLipSync 提供的独立在线工作流:上传人脸视频,再用文字或音频驱动口型。无需本地安装,流程强调对口型时序和人脸细节的检查。
Wav2Lip 在线版免费吗?
无需账号即可用文字或音频生成,输出无水印。免费文字支持 133 字符,免费音频支持 20 秒;下载需免费登录,为低分辨率版本,可用 1 个 Pro Video 解锁原分辨率。
如何评估准确度?
使用教程中固定的源视频、辅音与停顿音频、五次运行时长记录和逐帧检查方法。在同等基线发布前,本页不主张已经测得对照胜出。
为什么能快速开始?
在线流程省去了本地安装和 Notebook 配置,可以从视频加文字或音频直接进入托管渲染。这里描述的是启动流程,不是尚未公布的模型速度对比。



